Innhold Vis
Hvis du bygger med AI-video, er Gemini Omni 1.1 Flash en oppdatering det er verdt å få med seg. Google har gitt modellen kontrollene som mangler når et morsomt eksperiment skal bli en faktisk arbeidsflyt: lengre scener, overgang mellom et bestemt første og siste bilde, billige utkast og ferdig video i opptil 4K.
Det viktigste er ikke 4K-merkelappen alene. Det er at du kan jobbe i flere trinn uten å betale full pris for hvert forsøk, og at modellen får mer kontekst når en scene skal fortsette. Du kan lage utkast i 360p, velge retningen som fungerer og først da be om høyere oppløsning. Akkurat sånn bør et produksjonsverktøy fungere.
Omni 1.1 er nå produksjonsklar i den offisielle Gemini API-en, ifølge Googles lansering 27. august. Da jeg skrev om den første Gemini Omni-versjonen, var poenget den samtalebaserte redigeringen og muligheten til å bygge videre på video med vanlig språk. Nå har Google lagt til kontrollene som gjør den ideen langt mer praktisk.
Hva er nytt i Gemini Omni 1.1 Flash?
Gemini Omni 1.1 Flash er Googles multimodale modell for generering og redigering av video. Den tar imot tekst, bilder, lyd og video, og den kan bevare en løpende redigeringshistorikk gjennom Interactions API. Oppdateringen fra 27. august 2026 gir fire sentrale forbedringer: sceneforlengelse, første og siste bilde, 360p-utkast og oppskalering til 1080p eller 4K.
Modellen heter gemini-omni-1.1-flash i API-et. Ifølge Googles utviklerdokumentasjon er standardformatet 16:9 og standardoppløsningen 720p, mens 9:16 kan velges for stående video. Videoen kan genereres fra tekst, et bilde eller eksisterende video, og videre redigering kan gjøres med oppfølgingsinstruksjoner.
Omni-familien skiller seg fra en vanlig tekst-til-video-generator ved at samtalen og den genererte videoen kan henge sammen over flere runder. Du sender inn previous_interaction_id når neste endring skal bygge på forrige resultat. Dermed slipper du å laste opp den samme videoen og forklare hele scenen på nytt for hver lille justering.
Scener kan forlenges til 40 sekunder
Omni 1.1 kan forlenge en scene i bolker på 10 sekunder, opptil en samlet lengde på 40 sekunder. Når modellen fortsetter en video den selv har generert, analyserer den opptil de siste 10 sekundene som kontekst. Den forrige utgaven støttet bare det siste sekundet, så dette er et betydelig større grunnlag for å holde figurer, bevegelse, lyd og fortelling samlet.
Forskjellen er lett å undervurdere. Ett sekund forteller modellen omtrent hvor scenen endte. Ti sekunder forteller hva som var på vei til å skje, hvordan kameraet beveget seg, hvem som snakket og hvilken rytme scenen hadde. Google viser blant annet eksempler der kameraet fortsetter gjennom flere miljøer og dialogen går videre uten et tydelig brudd mellom klippene.
Utvidelsen skjer ved å referere til forrige interaksjon og be modellen fortsette scenen. Det grunnleggende Python-kallet ser slik ut:
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-omni-1.1-flash",
previous_interaction_id=previous_video_interaction.id,
input=[{"type": "text", "text": "Continue the scene."}],
response_format={"resolution": "360p"},
)
Du kan også laste opp en video via Files API og be Omni forlenge den. Her kommer det en viktig begrensning for norske brukere: redigering og forlengelse av opplastet video er foreløpig ikke tilgjengelig i EØS, Sveits eller Storbritannia. Forlengelse av video som Omni selv har generert i en flertrinnssamtale, er derimot støttet i alle regioner der modellen er tilgjengelig.
Første og siste bilde gir faktisk kamerakontroll
Du kan nå angi både startbildet og sluttbildet for et klipp. Omni 1.1 genererer bevegelsen mellom de to bildene, slik at du kan styre hvor kameraet begynner, hvor det skal ende og hva slags overgang som skal binde dem sammen. Det passer til blant annet kamerabaner, zoomoverganger og sømløse løkker.
Dette er en mer nyttig form for kontroll enn å håpe at en lang prompt skal tvinge modellen til riktig sluttpunkt. Hvis du skal bevege kameraet fra ett rom til et annet, kan du gi modellen de to utsnittene som faste holdepunkter. Prompten beskriver hvordan reisen skal se ut; bildene bestemmer hvor den starter og lander.
Det betyr ikke at alle overganger automatisk blir perfekte. Første og siste bilde kan være visuelt uforenlige, og modellen må fortsatt finne en troverdig vei mellom dem. Men arbeidsformen gjør det mulig å planlegge klippet før generering, i stedet for å oppdage etterpå at kameraet endte på feil sted.
Modellen støtter også opptil tre videoreferanser på maksimalt tre sekunder hver. De kan brukes som bevegelses- eller utseendereferanser, men lyden i referansevideoene blir ignorert. Google advarer samtidig mot å be modellen resonnere på tvers av flere videoer; det kan gi svakere eller uventede resultater.
360p-utkast gjør prøving billigere
Den smarteste nyheten kan være den minst prangende. Omni 1.1 kan generere utkast i 360p opptil 60 prosent raskere enn standardoppløsningen på 720p, til en tredel av kostnaden. Det gjør det mulig å prøve tre eller fire varianter, endre én ting om gangen og sammenligne resultatene før du bruker penger på sluttversjonen.
Den offisielle prislisten for Gemini API oppgir omtrent 0,10 dollar per sekund for 720p-video på betalt nivå. Med Norges Banks dollarkurs 27. august blir det cirka 93 øre per sekund, eller omtrent 9,34 kroner for et klipp på 10 sekunder. Et 360p-utkast til en tredel av kostnaden havner rundt 31 øre per sekund, altså cirka 3,11 kroner for 10 sekunder.
Det er fortsatt lett å brenne penger hvis du genererer på måfå. Derfor liker jeg retningen her: bruk 360p som et bevegelig storyboard. Test komposisjon, bevegelse, timing og om scenen i det hele tatt fungerer. Be først om 1080p eller 4K når du har et klipp som fortjener det.
Standardoppløsningen er fortsatt 720p. I response_format kan du velge 360p, 720p, 1080p eller 4k. De to høyeste alternativene er oppskalering, ikke native generering i den oppløsningen. Det er greit, men verdt å ha klart for seg før «4K» får gjøre all markedsføringen alene.
Hva kan du bygge med den nye kontrollen?
Den opplagte bruken er verktøy der brukeren styrer et klipp gjennom flere genereringer. Det kan være en enkel sceneeditor med første og siste bilde, et system for produktvideoer eller et storyboard-verktøy der utkastene ligger side om side. Kontrollene er tilgjengelige i API-et, så de trenger ikke være låst til Googles eget grensesnitt.
For en arbeidsflyt med mange klipp ville jeg skilt tydelig mellom idé og levering. Lag tre eller fire 360p-utkast. Varier bare én faktor om gangen – kamerabevegelse, handling eller miljø – slik at du faktisk ser hva som hjelper. Velg beste retning, gjør redigeringene gjennom samme interaksjon og bestill høyere oppløsning til slutt.
Tilgjengeligheten er langt bedre enn ved den første Omni-lanseringen. Utviklere kan bruke modellen i Google AI Studio og via Gemini API. Bedrifter får den gjennom Gemini Enterprise Agent Platform, mens Google AI Plus-, Pro- og Ultra-abonnenter får tilgang i Flow. Sceneforlengelse kommer også til de samme abonnementsnivåene i Gemini-appen.
Dette er viktig fordi en god videomodell uten et ordentlig API fort blir en demo du ikke kan bygge noe stabilt rundt. Nå finnes både modell-ID, dokumentasjon, kodeeksempler, prising og en definert Interactions API-flyt. Google kaller den produksjonsklar. Jeg ville fortsatt testet egen arbeidsflyt grundig før en kundeleveranse, men byggeklossene er i det minste på plass.
Begrensningene du må vite om
Omni 1.1 løser ikke alt. Opplastede videoer for redigering eller forlengelse må være 10 sekunder eller kortere, med unntak for modellgenerert video som forlenges over flere runder. En forlengelse kan bare legges til på slutten; modellen kan ikke sette inn nytt innhold i midten eller før begynnelsen av klippet.
Stemmeredigering støttes ikke. Det er en viktig detalj, særlig fordi min tidligere test av Omni via KIE ga svært god engelsk lipsync, men byttet ut stemmen. Den varianten var derfor ubrukelig når poenget var å beholde en bestemt persons egen stemme. Den nye dokumentasjonen gir ingen grunn til å anta at Omni 1.1 har løst dette.
Modellen støtter tale når den forlenger sin egen genererte video gjennom previous_interaction_id. Den kan derimot ikke forlenge en opplastet video der noen allerede snakker og samtidig legge til ny dialog. Opplastede lydreferanser støttes heller ikke, og engelsk er det eneste språket Google sier er fullt evaluert.
Filtrene er også reelle. I tidligere tester av Omni via KIE ble gjenkjennelig film- og TV-materiale konsekvent avvist med PUBLIC_ERROR_UNSAFE_GENERATION (400). Det var fire forsøk med samme resultat. Google oppgir nå at både innhold og generering filtreres etter region, så du bør ikke legge en arbeidsflyt rundt beskyttet materiale og håpe at det ordner seg.
Omni 1.1 er blitt et verktøy, ikke bare en effekt
Gemini Omni 1.1 Flash ser ut som en av de mer gjennomtenkte videooppdateringene i år. Ikke fordi Google har satt «4K» på en produktside, men fordi hele kjeden henger bedre sammen: raske utkast, lavere utkastskostnad, tydelige endepunkter, lengre kontekst og et offisielt API for videre redigering.
Det er fortsatt haker. Norske utviklere får ikke redigere eller forlenge opplastet video ennå, stemmeredigering mangler, og sikkerhetsfiltrene kan stoppe materiale som ellers ser uskyldig ut i arbeidsflyten. De begrensningene må bygges inn i forventningene fra starten.
Likevel er dommen min klar: Dette er et skikkelig steg framover for kontrollert AI-video. Bruk 360p til å lete, lås første og siste bilde når kameraet må treffe et bestemt punkt, og betal for høy oppløsning først når klippet sitter. Det er mindre lotteri og mer regi. Endelig.
Ofte stilte spørsmål
Er Gemini Omni 1.1 Flash tilgjengelig i Norge?
Ja, modellen er tilgjengelig gjennom Google AI Studio og Gemini API der tjenesten støttes. Norske brukere må likevel merke seg at redigering og forlengelse av opplastet video foreløpig ikke er tilgjengelig i EØS. Modellgenerert video kan forlenges over flere runder.
Hva koster et 10-sekunders klipp med Omni 1.1?
Googles pris tilsvarer omtrent 0,10 dollar per sekund i 720p. Med dollarkursen 27. august 2026 er det cirka 9,34 kroner for 10 sekunder. Et 360p-utkast koster rundt en tredel, altså omtrent 3,11 kroner for samme lengde.
Kan Omni 1.1 lage stående video til TikTok og Reels?
Ja. Du kan velge 9:16 i aspect_ratio for stående video. Standardformatet er 16:9. Oppløsningen velges separat i response_format, med støtte for 360p, 720p, oppskalert 1080p og oppskalert 4K.
Kan Gemini Omni 1.1 beholde stemmen i en opplastet video?
Ikke som en dokumentert funksjon. Google oppgir at stemmeredigering ikke støttes, og opplastet video med tale kan ikke forlenges med ny dialog. Bruk derfor ikke Omni 1.1 som eneste løsning når en bestemt stemmeidentitet må bevares.