Marketplace
MarketplaceMobil mega-meny för innehåll, tjänster och konto.

Huvudspår

Köp & säljAnnonserBoendeBostadObjektObjektBe om prisOffertFöretagsregisterFöretagLånBanklånLokaltHittaKarriärJobbDestinationerResorCoinsKryptoDiskussionForumKunskapWiki
AI-nyheter

Google Veo lanseras – videogeneratorn skapar 1080p-klipp från text och bild

Google Veo lanseras – videogeneratorn skapar 1080p-klipp från text och bild

Den 14 maj 2024 presenterade Google Veo, en generativ AI-modell för video som kunde skapa högupplösta 1080p-klipp från text, bilder och visuella instruktioner. Google uppgav att modellen kunde producera videor längre än en minut och förstå filmiska begrepp som timelapse, flygbild och olika typer av kamerarörelser.

Marketplace sammanfattar lanseringen i efterhand. Veo gjordes först tillgänglig för utvalda kreatörer genom en väntelista till det experimentella verktyget VideoFX. Presentationen var därför början på en produktlinje, inte ett besked om att alla Google-användare omedelbart kunde skapa obegränsade filmer.

Veo i korthet

| Punkt | Uppgift vid presentationen |
|---|---|
| Lanseringsdatum | 14 maj 2024 |
| Produkt | Generativ AI-modell för video |
| Upplösning | Upp till 1080p i de visade funktionerna |
| Längd | Klipp längre än en minut enligt Google |
| Indata | Textprompt, bild och visuella instruktioner |
| Första verktyg | VideoFX genom väntelista i Google Labs |
| Viktiga förmågor | Kamerarörelser, filmiska stilar och visuell kontinuitet |
| Märkning | SynthID för AI-genererat material |

Från textprompt till rörlig scen

Text-till-video innebär att modellen omvandlar en beskrivning till en serie bildrutor som tillsammans ska bilda en sammanhängande video.

En prompt kunde exempelvis ange:

  • miljö
  • personer eller objekt
  • handling
  • ljus
  • bildstil
  • kameravinkel
  • rörelse
  • tempo

Utmaningen är betydligt större än för en stillbild. Modellen måste hålla karaktärer, föremål och perspektiv tillräckligt konsekventa över tid.

Ett ansikte som ser korrekt ut i en bild kan förändras mellan bildrutorna. Ett föremål kan byta form eller försvinna. Veo utvecklades för att minska sådana problem och skapa bättre tidsmässig kontinuitet.

Filmtermer i prompten

Google lyfte fram att Veo kunde förstå filmiska termer. En kreatör kunde be om:

  • panorering
  • tracking shot
  • drone shot
  • timelapse
  • shallow depth of field
  • cinematic lighting
  • slow motion

Det gjorde prompten mer användbar för personer med erfarenhet av film och fotografi. Modellen försökte omvandla termerna till visuella och tidsmässiga egenskaper.

Begreppen fungerade inte som exakta kommandon i en professionell kamera. Resultatet kunde variera mellan körningar, och en önskad kamerarörelse kunde påverka motivets form eller stabilitet.

Bild-till-video

Veo kunde använda en bild som utgångspunkt. Det gav möjlighet att animera en stillbild eller behålla delar av en viss komposition.

Användningsområden:

  • animera en produktmockup
  • skapa rörelse i ett koncept
  • bygga en scen från en storyboardbild
  • skapa variationer av ett konstverk
  • ge en kampanjbild ett kort videouttryck

Användaren behövde ha rätt att använda bilden. Ett foto på en verklig person eller ett skyddat verk kunde inte automatiskt göras om till video bara för att verktyget tekniskt tillät uppladdning.

Längre videor och sammanhang

Google uppgav att Veo kunde skapa klipp längre än en minut. Längre generering är svår eftersom modellen måste behålla sammanhang över fler bildrutor.

Vanliga problem i långa AI-videor är:

  • karaktärer byter utseende
  • kläder eller föremål förändras
  • rörelsen saknar fysisk logik
  • scenen övergår utan avsikt
  • text och symboler deformeras
  • berättelsen tappar riktning

En längre tidsgräns betyder inte att modellen automatiskt producerar en färdig film med dramaturgi. Kreatören behöver fortfarande välja klipp, redigera och bygga samman en berättelse.

VideoFX som första arbetsyta

Veo introducerades genom VideoFX, ett experimentellt Google Labs-verktyg. Utvalda användare kunde registrera intresse och ge återkoppling.

En förhandsversion gör det möjligt att testa:

  1. användbarhet
  2. belastning
  3. säkerhetsfilter
  4. typiska misslyckanden
  5. kostnad per generering
  6. kreatörernas arbetsflöden

Resultat från en kontrollerad demo behöver inte motsvara upplevelsen i ett fullbelastat konsumentverktyg. Väntetid, begränsningar och tillgängliga format kan förändras under utrullningen.

Samarbete med filmskapare

Google sade att företaget samarbetade med kreatörer och filmskapare för att förstå hur modellen kunde användas i praktiken.

AI-video kan hjälpa i flera produktionssteg:

  • idévisualisering
  • storyboard
  • förproduktion
  • koncepttrailers
  • bakgrundsmaterial
  • specialeffektsutkast
  • snabb versionering för olika format

Det innebär inte att en modell ersätter regi, skådespeleri, foto, ljud, klippning och rättighetsarbete. Ett användbart filmprojekt består av många beslut som inte kan reduceras till en prompt.

YouTube och framtida integrationer

Google sade att vissa Veo-funktioner skulle kunna komma till YouTube Shorts och andra produkter. Det gav företaget en särskild distributionsfördel: modellen kunde kopplas till en av världens största videoplattformar.

En sådan integration kräver tydliga regler för:

  • märkning
  • upphovsrätt
  • syntetiska personer
  • annonser
  • vilseledande nyhetsmaterial
  • intäktsdelning
  • moderering

När generering och publicering sker i samma ekosystem måste användaren förstå när ett experiment blir offentligt och vilka villkor som gäller.

SynthID och teknisk märkning

Google använde SynthID för att bädda in en signal i AI-genererat material. Syftet var att göra innehållets ursprung lättare att identifiera även när en synlig etikett saknades.

Teknisk märkning har begränsningar. En video kan:

  • komprimeras
  • beskäras
  • filmas av från en annan skärm
  • redigeras i ett annat program
  • exporteras genom en tjänst som tar bort metadata

SynthID bör därför kombineras med synlig märkning och plattformsinformation när videon kan uppfattas som dokumentär.

Läs vår senare genomgång av Google, SynthID och EU:s kod för AI-märkning.

Deepfakes och verkliga personer

Videogenerering kan användas för att skapa falska scener med verkliga människor. Riskerna omfattar:

  • politisk desinformation
  • bedrägerier
  • falska uttalanden
  • sexuellt material utan samtycke
  • varumärkesintrång
  • imitation av artister

Google införde säkerhetsfilter och begränsningar, men inget system är perfekt. Den som publicerar material har ansvar att inte vilseleda eller kränka någon.

Företag bör ha en policy som kräver samtycke när en verklig persons ansikte, röst eller tydliga identitet används.

Fysik och visuella fel

AI-video kan se realistisk ut på avstånd men innehålla ologiska detaljer:

  • vatten rör sig fel
  • händer förändras
  • skuggor saknar rätt ljuskälla
  • objekt går genom varandra
  • antalet föremål ändras
  • text blir oläslig

Kreatörer bör granska klippet bildruta för bildruta före kommersiell användning. Ett fel som är svårt att se i mobilen kan bli tydligt på stor skärm.

Upphovsrätt och träningsdata

Veo lanserades i en tid då kreatörer och rättighetshavare diskuterade hur generativa modeller tränas. Google beskrev säkerhets- och ansvarsåtgärder men offentliggjorde inte en fullständig lista över allt träningsmaterial.

Företag som använde resultat behövde kontrollera:

  • produktens kommersiella villkor
  • likhet med kända filmer eller karaktärer
  • musik och ljudrättigheter
  • uppladdade referensbilder
  • logotyper och varumärken
  • skådespelares och modellerade personers samtycke

Ett genererat klipp kan vara nytt men ändå ligga nära ett skyddat uttryck eller innehålla en identifierbar person.

Veo jämfört med Sora

OpenAI hade visat Sora i februari 2024. Veo blev Googles tydliga svar inom text-till-video.

| Veo vid Google I/O | Sora vid den första presentationen |
|---|---|
| Kopplad till Google Labs och framtida YouTube-funktioner | Presenterades som OpenAI:s forskningsmodell |
| Upp till 1080p och längre än en minut enligt Google | Upp till en minut i de första demonstrationerna |
| SynthID-märkning | OpenAI utvecklade egna provenance- och säkerhetsmetoder |
| Filmtermer och bild-till-video | Stark visuell kvalitet och komplexa scener |

Det gick inte att avgöra en generell vinnare enbart från utvalda demonstrationsklipp. Verkliga jämförelser behöver samma promptar, flera körningar och produktionsversioner.

Läs vår historiska artikel om Soras första presentation den 15 februari 2024.

Svenska företag och kreatörer

Veo kunde på sikt användas av svenska byråer, e-handlare och mediebolag för:

  • konceptvideo
  • annonser
  • produktvisualisering
  • sociala medier
  • utbildningsmaterial
  • lokalisering och variationer

En säker process bör ha mänsklig granskning, rättighetskontroll och tydlig märkning. AI-video bör särskilt undvikas som falskt dokumentärt material i journalistik eller kundreferenser.

Vanliga frågor

När presenterades Google Veo?

Google presenterade Veo den 14 maj 2024 på Google I/O.

Kunde Veo skapa video från en bild?

Ja. Modellen kunde använda både text och bild som underlag.

Hur lång video kunde modellen skapa?

Google uppgav att Veo kunde skapa 1080p-klipp längre än en minut.

Var Veo tillgängligt för alla direkt?

Nej. Första tillgången gick genom en väntelista till VideoFX för utvalda kreatörer.

Märktes videorna som AI-genererade?

Google använde SynthID och andra säkerhetsåtgärder, men teknisk märkning behövde kompletteras med synlig information.

Kunde Veo skapa en färdig långfilm?

Nej. Modellen skapade klipp och konceptmaterial. Professionell film kräver fortsatt manus, regi, klippning, ljud och rättighetsarbete.

Sammanfattning

Google Veo presenterades den 14 maj 2024 som en högupplöst text- och bild-till-video-modell. Den kunde förstå filmtermer, skapa längre klipp och ge kreatörer en ny prototypyta genom VideoFX.

Lanseringen visade hur snabbt AI-video utvecklades, men också varför demonstrationskvalitet inte är samma sak som färdig produktion. Kontinuitet, fysik, rättigheter, deepfakes och märkning behövde granskas i varje klipp. AI kunde förkorta vägen från idé till visuellt utkast, men inte ta över det publicistiska ansvaret.

Faktaunderlag: Google DeepMind och Google, presentationen av Veo på Google I/O den 14 maj 2024. Artikeln är en historisk sammanfattning publicerad i efterhand.

Utvalda vägar vidare

Jämför och välj med bättre underlag

Tydligt märkta partnererbjudanden, placerade nära rätt beslut.

Partnererbjudande · Banklån

Räkna på banklån innan du ansöker

Se ungefärlig månadskostnad, löptid och villkor på ett ställe.

Räkna på lån

Marketplace kan få ersättning om du går vidare.

Partnererbjudande · Casino · 18+

Casino bonus 2026 – jämför villkor

Se svensk licens, omsättningskrav och aktuell bonusstatus.

Öppna jämförelsen

18+ · Spela ansvarsfullt · Annonslänk · Villkor gäller.

Kommentarer

Kommentarer

Diskutera artikeln i tråden nedan.

Inga omdömen ännu0 omdömen
Fortsätt diskussionen i ForumEn gemensam tråd skapas för artikeln. Har du redan konto kan du logga in och fortsätta direkt.
Diskutera i Forum
Lägg till kommentar

Kommentaren granskas innan den publiceras.

Ditt omdöme