Jan Sverre utforsker Muse Voice Transcribe som samler tre voice-systemer i én modell

Muse Voice Transcribe samler tre talefunksjoner i én modell

Muse Voice Transcribe samler transkripsjon, talermerking og endpointing i én sanntidsmodell. Se faktisk pris, fart, språkstøtte og hvorfor API-only er haken.
Jan Sverre vurderer hvordan Claude Fable 5.1 kutter kostnaden for lange AI-agenter

Claude Fable 5.1 kan kutte agentkostnaden med opptil 45 prosent

Claude Fable 5.1 får 75 prosent billigere cache-lesing. Anthropic anslår opptil 45 prosent lavere kostnad for lange, konteksttunge AI-agentjobber i praksis.
Jan Sverre i en kontinuerlig strøm av H3 Max Live-generert AI-video

H3 Max Live lager AI-video raskere enn du rekker å se den

H3 Max lager fem sekunder AI-video på rundt tre sekunder. H3 Max Live viser hvorfor raskere enn sanntid kan endre video, spill og direktesendinger.
Jan Sverre vurderer DeepSeek V4 Flash Vision og et checkpoint på 168 GB

DeepSeek V4 Flash Vision kan lastes ned, men veier 168 GB

DeepSeek V4 Flash Vision har fått nedlastbare vekter og MIT-lisens på Hugging Face. Checkpointet er 167,8 GB, så dette er et svært tungt fler-GPU-prosjekt.
Jan Sverre med Gemini Omni 1.1 Flash og kontrollert AI-videoproduksjon

Gemini Omni 1.1 Flash gir deg langt bedre kontroll på AI-video

Gemini Omni 1.1 Flash gir bedre kontroll på AI-video med 360p-utkast, sceneforlengelse og 4K, men har en viktig EØS-begrensning.
Jan Sverre utforsker GLM-5.3-Flash med én million tokens og multimodal AI

GLM-5.3-Flash gir deg én million tokens til småpenger

GLM-5.3-Flash gir én million tokens, multimodal agentbruk og åpne vekter til lav API-pris. Se hva modellen koster, krever og egner seg til i praksis nå.
Jan Sverre i en visuell fremstilling av Qwen3.8-Flash-Next og modellens parameterforskjell

Qwen3.8-Flash-Next viser Qwen4-arkitekturen – men dette er ingen liten 6B-modell

Qwen3.8-Flash-Next gir en åpen forhåndsvisning av Qwen4-arkitekturen. Her er hva 6B aktive parametere, QSA og 262 144 token betyr for lokal kjøring i praksis.
Jan Sverre utforsker Ox Alpha fra Z.AI og løftet om åpne modellvekter

Z.AI bekrefter Ox Alpha – åpne modellvekter kommer

Ox Alpha fra Z.AI får åpne modellvekter. Se hva som er bekreftet om lokal kjøring, databruk, GLM-5.3 og påstanden om at modellen faktisk utfordrer DeepSeek.
Jan Sverre med IBM Granite 4.2 som lokal AI-agent på egen maskin

IBM Granite 4.2 gjør lokale AI-agenter mer praktiske

IBM Granite 4.2 har 3B-, 8B- og 30B-modeller for lokale AI-agenter, med justerbar reasoning og agenttrening. Se hvorfor 8B er det naturlige startpunktet.
Jan Sverre sammen med Faraday som orkestrerer kodeagenter i digitalt forskningslaboratorium

Faraday lar en 27B-modell styre GPT-5.5 Codex som forsker

Faraday er en AI-forsker på 27 milliarder parametere som styrer GPT-5.5 Codex. Inherents test viser lovende spesialisering, men trenger uavhengig kontroll.
Jan Sverre utforsker MiniMax-Music3 og komplette femminutters AI-sanger lokalt

MiniMax-Music3 lager komplette sanger på opptil fem minutter

MiniMax-Music3 lager komplette sanger på opptil fem minutter. Se kravene til maskinvare, lokale kjøreveier og lisensen du må lese før kommersiell bruk.
Jan Sverre illustrerer Qwens ledelse blant åpne AI-modeller med tre milliarder nedlastinger

Qwen passerer 3 milliarder nedlastinger – slår Meta og Google

Qwen har passert 3 milliarder nedlastinger på seks måneder og gått forbi Meta og Google. Slik ble Alibaba størst blant åpne AI-modeller på Hugging Face.
Jan Sverre foran GLM-5.3 som forbedres gjennom avansert post-training uten ny grunnmodell

GLM-5.3 får stort agentløft uten ny grunnmodell

GLM-5.3 bruker samme grunnmodell som GLM-5.2, men får et stort løft i koding og langvarige agentoppgaver gjennom post-training alene.
Jan Sverre med Needle 2 som kjører lokal tool calling på svak maskinvare

Needle 2 kjører tool calling lokalt med bare 28 MB RAM

Needle 2 gjør lokal tool calling mulig i en binærfil på 14 MB. Modellen bruker rundt 28 MB RAM uten GPU eller NPU. Se hva den kan brukes til i praksis.