Google låter Gemini Omni förlänga video till 40 sekunder
Omni 1.1 Flash får styrning med start- och slutbild, videoreferenser och 4K-uppskalning – men flera redigeringslägen är ännu spärrade i EES.
Google lanserade den 27 augusti Gemini Omni 1.1 Flash, en produktionsversion av sin multimodala videomodell i Gemini API. Den nya versionen kan förlänga en scen, binda ihop en bestämd start- och slutbild och använda korta videoklipp som referenser.
Den stora förändringen är mer kontroll över ett förlopp. Enligt Googles lansering tittar modellen på de sista tio sekunderna av en video när den ska fortsätta scenen. Tidigare modeller utgick bara från den sista sekunden. Varje fortsättning kan vara tio sekunder och samma video kan byggas ut till totalt 40 sekunder.

Från klippgenerator till redigeringsverktyg
Omni 1.1 kan också få en startbild och en slutbild och generera rörelsen däremellan. Referensläget tar emot upp till tre videoklipp på högst tre sekunder vardera för att hålla fast vid en person, ett objekt eller en rörelse. Via Interactions API kan utvecklaren sedan fortsätta redigera samma video med ett tidigare interaktions-id, utan att ladda upp allt på nytt.

För snabbare iteration erbjuder Google ett 360p-läge som bolaget uppger är upp till 60 procent snabbare och kostar en tredjedel av 720p-läget. Färdiga klipp kan skalas upp till 1080p eller 4K. Dokumentationen är tydlig med att de högre upplösningarna är uppskalade, inte bildrutor som modellen genererar direkt i 4K.
Google har gjort modellen tillgänglig i Google AI Studio och Gemini Enterprise Agent Platform. Den finns också i Flow och Gemini-appen för betalande Google AI-abonnenter, men tillgången varierar mellan funktionerna.
EES får inte hela redigeringskedjan
Den nordiska begränsningen är konkret. Utvecklare i EES, Schweiz och Storbritannien kan inte redigera eller förlänga en video som de själva laddar upp. De kan däremot fortsätta en video som Omni redan har genererat. Uppladdade klipp får dessutom vara högst tio sekunder, röstredigering och ljudreferenser stöds inte och modellen kan inte resonera över flera separata videor.
Google visar polerade demos men redovisar ännu ingen oberoende mätning av hur ofta personer, rörelser och ljud faktiskt håller ihop genom flera förlängningar. Alla genererade videor märks med SynthID, men för professionella arbetsflöden återstår det att se hur ofta en kreatör kan gå från första utkast till användbart slutklipp utan att börja om.
Google lanserade Gemini Omni 1.1 Flash med scenförlängning upp till 40 sekunder, styrning med start- och slutbild, videoreferenser och 4K-uppskalning. Modellen är tillgänglig via Gemini API och flera av Googles kreativa verktyg.
För videoutvecklare flyttar kontrollen arbetet från fristående klipp mot redigerbara sekvenser. Begränsningarna i EES gör samtidigt att nordiska team ännu inte får använda hela kedjan på eget material.
Start- och slutbild plus tio sekunders kontext är mer intressant än 4K-knappen. Om kontinuiteten håller genom flera varv kan AI-video bli ett verktyg för sekvenser, inte bara en generator av imponerande lösryckta klipp. Google har visat möjligheten; tillförlitligheten är fortfarande den obesvarade frågan.




