H3 Max Live lager AI-video raskere enn du rekker å se den. En fem sekunder lang video kan være ferdig på omtrent tre sekunder. Dermed kan neste klipp genereres mens du fremdeles ser på det forrige.

Det høres ut som enda et imponerende fartstall fra en modell-lansering. Denne gangen endrer tallet selve bruken. Når videogenereringen går raskere enn avspillingen, trenger ikke AI-video lenger være en jobb der du bestiller et klipp, venter og kommer tilbake senere. Den kan bli en kontinuerlig strøm som publikum påvirker mens den går.

De første demonstrasjonene er rare, rotete og tidvis ren AI-grøt. Det spiller nesten ingen rolle. De viser at en teknisk grense er passert: God nok video med lyd kan produseres fortløpende, uten at avspilleren må stå og vente på neste scene. Det er et ekte terskelskifte.

Hva er H3 Max Live?

H3 Max Live er et eksperiment med kontinuerlig AI-video bygget på fal sin H3 Max-modell. Publikum skriver forslag i en chat, systemet lager neste scene på få sekunder og sender klippene videre som én løpende sending. Latent Space samlet de første demonstrasjonene fra slutten av august 2026.

Vanlige videogeneratorer lager et avgrenset klipp fra tekst eller et startbilde. Live-varianten bruker den samme fartsmarginen til å holde en sending i gang. Mens ett klipp spilles av, produseres det neste. Chatten kan samtidig endre retning, sted eller handling. Resultatet ligner mer på improvisasjon mellom TV, spill og et svært merkelig kommentarfelt enn på en ferdig film.

Her er et viktig skille: H3 Max er modellen som er tilgjengelig gjennom fal sitt vanlige API. H3 Max Live, også omtalt som Director i demonstrasjonene, er det eksperimentelle systemet for kontinuitet og direktesending. Du bør ikke lese en Live-demo som et løfte om at det vanlige API-endepunktet automatisk lager en endeløs, sammenhengende historie.

Kontinuerlig H3 Max Live-kø genererer neste videoklipp før avspillingen stopper
Mens ett klipp spilles av, genererer H3 Max Live det neste og legger det i kø. Chatinnspill kan påvirke kommende scener uten å stoppe sendingen.

Hvordan ble videogenerering raskere enn sanntid?

fal startet med den åpne MiniMax H3-modellen, trente den videre på nye data og utviklet serveringen sammen med modellen. Selskapet oppgir at H3 Max lager fem sekunder video på under tre sekunder, omtrent 35 ganger gjennomstrømningen til det offisielle MiniMax H3-endepunktet. fal beskriver arbeidet som en kombinasjon av post-training og en spesialtilpasset inference-motor.

Det siste er viktig. Mange raske modellvarianter oppnår fine tall ved å kutte samplingsteg, senke presisjonen eller godta svakere kvalitet. fal sier at optimaliseringer bare ble beholdt dersom modellen holdt plasseringen i selskapets egne kvalitetstester. Det er selvfølgelig fal sine egne målinger, så de skal leses som leverandørtall – ikke som en naturlov.

Samtidig er påstanden lett å forstå i praksis. Hvis fem sekunder innhold tar rundt 2,5 til 3 sekunder å lage, sitter systemet igjen med omtrent to sekunder i reserve før avspillingen tar det igjen. Den marginen kan brukes til kø, promptbehandling, overgang og levering. Det er ikke uendelig video i én enkelt generering. Det er en produksjonslinje som rekker å fylle på før båndet blir tomt.

Dette skiller seg også fra FastVideo og live-redigering med 4,5 sekunders latens. Lav ventetid ved redigering er nyttig, men kontinuerlig generering stiller et ekstra krav: Systemet må levere neste bit raskere enn publikum bruker opp den forrige.

Hvor god er H3 Max?

H3 Max er god nok til at farten faktisk betyr noe. fal testet modellen mot 12 andre videogeneratorer og oppgir førsteplass i egne menneskevurderinger av helhetsinntrykk, promptforståelse og estetikk. Selskapet viser også til topplasseringer hos Artificial Analysis og Design Arena. Dette er langt mer interessant enn en turbomodell som bare produserer ubrukelige bilder fort.

Men «god nok» er ikke det samme som ferdig TV. De kontinuerlige demonstrasjonene hopper mellom ideer, mister fortellingstråden og kan se ut som et febermareritt som har funnet fjernkontrollen. Det er morsomt i noen minutter. Jeg tviler på at mange vil følge en slik sending gjennom en hel kveld.

Poenget er at svakheten nå har flyttet seg. Ventetiden var tidligere en fysisk sperre for en interaktiv AI-sending. Nå er de vanskeligste problemene regi, hukommelse, karakterer, fortelling og kontroll. Det er problemer som kan angripes med bedre modeller, lengre kontekst, mer strukturert state og smartere orkestrering. Klokken har sluttet å være den første fienden.

Hva kan H3 Max brukes til i dag?

Den vanlige H3 Max-modellen kan brukes til tekst-til-video og bilde-til-video i 480p eller 768p, med generert lyd i samme leveranse. fal tilbyr klipp på 5 til 15 sekunder. Det passer til raske utkast, annonser, sosiale klipp, animatics og produksjoner der du trenger mange varianter uten å vente i flere minutter på hver runde.

For utviklere er API-et den konkrete inngangen. fal sitt H3 Max-endepunkt tar blant annet prompt, varighet, oppløsning, sideforhold og valg for promptutvidelse. Det betyr ikke at du får hele Live-systemet i én API-request, men det gir byggeklossen som gjør raske, købaserte videoflyter mulige.

Da jeg kontrollerte produktsiden 1. september, viste fal fortsatt introduksjonsprisen på 0,025 dollar per videosekund i 480p og 0,04 dollar i 768p. Siden opplyser samtidig at rabatten avsluttes 1. september, og at ordinær pris deretter blir 0,05 og 0,08 dollar. Med dollarkursen 9,3412 kroner 31. august koster fem sekunder cirka 1,17 kroner i 480p eller 1,87 kroner i 768p mens tilbudet gjelder. Etterpå blir det omtrent 2,34 eller 3,74 kroner.

Det er billig nok til eksperimenter, men kontinuerlig video spiser sekunder hele tiden. Med ordinær pris blir en time i 768p rundt 288 dollar, altså omtrent 2 690 kroner, før du regner inn resten av systemet. Introduksjonsprisen halverer beløpet så lenge den gjelder. «Uendelig» er et morsomt produktnavn. Regningen har heldigvis fremdeles en slutt.

Tidslinje viser fem sekunder AI-video generert på omtrent tre sekunder
Fem sekunder video kan produseres på omtrent tre sekunder og gir systemet en tidsbuffer. Ved kontinuerlig sending fortsetter kostnaden å løpe for hvert genererte sekund.

Hva krever en kontinuerlig AI-sending?

En praktisk løsning trenger mer enn en rask modell. Chatmeldinger må samles inn og modereres, et språkmodell-lag må gjøre korte ønsker om til brukbare scener, klipp må legges i kø, og en videoklient må sende resultatet videre i riktig tempo. Hvis én del stopper, tar avspillingen igjen produksjonen og illusjonen ryker.

H3 Max Live og Director er demonstrasjoner av denne typen system, mens fal sitt dokumenterte H3 Max-endepunkt leverer avgrensede klipp. Det er en viktig forskjell. Du får byggeklossen gjennom API-et, men kø, kontinuitet, styring og selve direktesendingen må fortsatt håndteres rundt modellen.

Skal du bygge rundt dette nå, ville jeg startet med en buffer på minst ett ferdig klipp og målt hele kjeden – ikke bare inference-tiden. Promptutvidelse, kø, nedlasting, overgang og RTMP-levering teller også. Når leverandøren sier tre sekunder, betyr det ikke automatisk at seeren ser neste scene tre sekunder etter at meldingen ble skrevet.

Hvorfor dette er mer enn en raskere videogenerator

Raskere videogenerering gir ikke bare kortere kaffepause. Den endrer mediet fra forhåndslaget innhold til innhold som kan svare mens du ser på. Et barn kan be en figur åpne døren til månen. En kunde kan endre farge og kameravinkel i en produktvisning. Et spill kan lage mellomsekvenser som følger valgene spilleren faktisk tok.

Det betyr også at AI-video begynner å ligne programvare. Innholdet blir en funksjon av input, tilstand og regler, ikke bare en ferdig MP4-fil. Da blir logging, moderering, kostnadskontroll, forsinkelse og konsistens like viktige som en pen prompt. Folk som allerede bygger med API-er vil kjenne igjen tankegangen.

For vanlige skapere betyr terskelen først og fremst raskere prøving og mindre venting. For utviklere betyr den at video kan bli en del av en responsiv applikasjon. Det er to forskjellige gevinster, men begge kommer fra det samme enkle regnestykket: Produksjonen må holde høyere fart enn avspillingen.

Jeg har tidligere sammenlignet fal.ai, kie.ai og Runware for bilde- og video-API-er. H3 Max viser hvorfor infrastrukturen rundt modellen betyr stadig mer. To tilbydere kan starte med beslektede modellvekter og ende med helt forskjellig opplevelse når servering, kø og optimalisering ikke er den samme.

Det er fremdeles tidlig. H3 Max Live er en demonstrasjon av muligheten, ikke et bevis på at tradisjonell TV, film eller spill er ferdig. Men grensen er passert. Fra nå av er spørsmålet ikke bare hvor fort AI kan lage et klipp. Det er hva som skjer når videoen aldri trenger å stoppe og publikum kan ta tak i rattet.

Ofte stilte spørsmål

Er H3 Max Live tilgjengelig som et vanlig API?

H3 Max er tilgjengelig hos fal for tekst-til-video og bilde-til-video. Live/Director er et eksperimentelt lag for kontinuerlig, chatstyrt video. Det vanlige endepunktet gir raske klipp, men ikke automatisk en endeløs sending med kontinuitet.

Kan H3 Max virkelig lage video raskere enn sanntid?

Ja, for de dokumenterte korte klippene. fal oppgir omtrent tre sekunders genereringstid for fem sekunder video, og API-eksempler viser inference rundt 2,5 til 2,8 sekunder. Hele brukeropplevelsen kan ta lenger tid når kø, promptbehandling og levering regnes med.

Hva koster fem sekunder video med H3 Max?

Introduksjonsprisen som fortsatt sto på fal sin produktside 1. september gir cirka 1,17 kroner i 480p eller 1,87 kroner i 768p. Siden opplyser at ordinær pris deretter dobles til omtrent 2,34 eller 3,74 kroner for fem sekunder.

Kan H3 Max kjøres lokalt på et vanlig skjermkort?

Ikke med den dokumenterte fal-farten. H3 Max bygger på MiniMax H3 med åpne vekter, men fal knytter den målte ytelsen til sin egen videre trening og spesialtilpassede inference-motor. Selskapet dokumenterer ikke en tilsvarende lokal kjøring på et vanlig skjermkort.

Legg igjen en kommentar

Din e-postadresse vil ikke bli publisert. Obligatoriske felt er merket med *

Meld deg på nyhetsbrevet

Få oppdateringer om AI nyhetene rett i inboxen!

Du liker kanskje denne også
Jan Sverre ser på en skjerm med Claude Code og er overrasket over påstanden om $5 000 kostnad per bruker

Claude Code Pris 2026 – Hva Koster Det Egentlig?

Forbes hevdet at Anthropic taper $5 000 per Claude Code Max-bruker. Men beregningen forveksler API-priser med faktiske produksjonskostnader. Gjennomsnittlig bruker koster Anthropic rundt $18 per måned — ikke $5 000.
Jan Sverre surfer på en bølge av ChatGPT-meldinger - komplett norsk guide til ChatGPT i 2026

ChatGPT Norsk Guide – Slik Kommer Du i Gang (2026)

Komplett norsk guide til ChatGPT i 2026. Slik kommer du i gang, hva det koster i norske kroner, beste tips, og ærlig sammenligning med Claude og Gemini.
Gpt53 codex

OpenAI svarer med GPT-5.3 Codex — selvforbedrende AI som bygget seg selv

Innhold Vis Hva er GPT-5.3 Codex?Fra kodeskriver til digital arbeiderKappløpet intensiveresMer drama…
Jan Sverre i et mørkt videoredigeringsstudio med flere skjermer som viser LTX Video 2.3 frames fra en kafé-POV-scene

LTX Video 2.3 – 481 frames og 20 sekunder video på 2,5 minutt lokalt

LTX Video 2.3 (versjon 0.9.8) genererer 20 sekunder vertikal POV-video med 481 frames på 2 minutter og 26 sekunder på RTX 4090. Her er hva som er nytt, hva modellen krever, og hvorfor dette er den sterkeste lokale video-AI-modellen akkurat nå.