Googles DeepMind-divisjon avduket sin andre generasjons Veo-videogenerasjonsmodell på mandag, som kan lage klipp på opptil to minutter og med oppløsninger som når 4K-kvalitet – det er seks ganger lengden og fire ganger oppløsningen til klippene med 20 sekunder/1080p oppløsning. Sora kan generere.
Det er selvfølgelig Veo 2s teoretiske øvre grenser. Modellen er foreløpig kun tilgjengelig på VideoFX, Googles eksperimentelle videogenereringsplattform, og klippene er begrenset til åtte sekunder og 720p-oppløsning. VideoFX er også på venteliste, så ikke hvem som helst kan logge på for å prøve Veo 2, selv om selskapet kunngjorde at det vil utvide tilgangen i løpet av de kommende ukene. En talsperson for Google bemerket også at Veo 2 vil bli gjort tilgjengelig på Vertex AI-plattformen når selskapet kan skalere modellens evner tilstrekkelig.
Anbefalte videoer
«I løpet av de kommende månedene vil vi fortsette å iterere basert på tilbakemeldinger fra brukere,» fortalte Eli Collins TechCrunch«og [we’ll] ser etter å integrere Veo 2s oppdaterte funksjoner i overbevisende brukstilfeller på tvers av Googles økosystem … Vi forventer å dele flere oppdateringer neste år.»
I dag kunngjør vi Veo 2: vår toppmoderne videogenerasjonsmodell som produserer realistiske klipp av høy kvalitet fra tekst- eller bildemeldinger.
Vi slipper også en forbedret versjon av vår tekst-til-bilde-modell, Imagen 3 – tilgjengelig for bruk i ImageFX gjennom… pic.twitter.com/h6ejHaMUM4
— Google DeepMind (@GoogleDeepMind) 16. desember 2024
Veo 2 har angivelig en rekke fordeler i forhold til forgjengerne, inkludert en bedre forståelse av fysikk (tenk bedre væskedynamikk og bedre belysnings-/skyggeeffekter) samt kapasiteten til å generere «klarere» videoklipp, ved at genererte teksturer og bilder er skarpere og mindre utsatt for uskarphet ved bevegelse. Den nye modellen tilbyr også forbedrede kamerakontroller, som gjør det mulig for brukeren å plassere den virtuelle kameralinsen med større presisjon enn før.
Som TechCrunch bemerker, har Veo 2 ennå ikke perfeksjonert videogenereringsprosessen, selv om den ser ut til å hallusinere langt mindre enn rivaler som Sora, Kling, Movie Gen eller Gen 3 Alpha. «Koherens og konsistens er områder for vekst,» sa Collins. «Veo kan konsekvent følge en melding i et par minutter, men [it can’t] følge komplekse spørsmål over lange horisonter. På samme måte kan karakterkonsistens være en utfordring. Det er også rom for å bli bedre når det gjelder å generere intrikate detaljer, raske og komplekse bevegelser og fortsette å flytte realismens grenser.»
Google annonserte også forbedringer av Imagen 3 på mandag, noe som gjør det mulig for den kommersielle bildegenereringsmodellen å lage «lysere, bedre sammensatte» utganger. Modellen, tilgjengelig på ImageFX, vil også tilby ytterligere beskrivende forslag basert på nøkkelord i brukerens ledetekst, med hvert søkeord som skaper en rullegardinmeny med relaterte termer.
Støtt vårt arbeid ❤️
Hvis du likte denne artikkelen, vurder å gi en tips for å hjelpe oss med å fortsette å publisere kvalitetsinnhold.




















