Jan Sverre analyserer et dokument med Zamba2-VL vision-language-modell

Zamba2-VL er en rask vision-language-modell du kan kjøre lokalt – her er hva den faktisk gjør

Zyphra har sluppet Zamba2-VL, en hybrid Mamba2/Transformer-modell som analyserer bilder og tekst. Praktisk guide til hva den gjør og om den er verdt å kjøre lokalt.
Jan Sverre ser på kode på en terminal i et serverrom, belyst av LED-lys fra rackmonterte servere

North Mini Code kjører på én GPU – det er hele poenget

Coheres nye kodingsmodell North Mini Code er en 30B MoE-modell med bare 3B aktive parametre – laget for å kjøre på én H100 og håndtere agentic coding.
Jan Sverre ser på DiffusionGemma, Googles eksperimentelle text diffusion-modell

DiffusionGemma er raskere enn Gemma 4 – men ikke klar for produksjon

DiffusionGemma er Googles 26B eksperimentelle modell som genererer tekst 4x raskere enn Gemma 4 – men med lavere kvalitet. Her er hva du bør vite.
Jan Sverre med laptop der AI forstår bilder, lyd og tekst lokalt

Gemma 4 12B – nå kan du kjøre multimodal AI gratis på din egen laptop

Gemma 4 12B er Googles nye open weights-modell som forstår bilder, lyd og tekst – og kjører på en vanlig 16GB laptop. Apache 2.0, gratis, ingen skytjeneste.
Mellum2 jetbrains featured v2

Mellum2 fra JetBrains – hva er det og trenger du det som utvikler?

JetBrains har sluppet Mellum2 – en 12B MoE-modell laget for rask kodeassistanse og multi-modell workflows. Her er det du trenger å vite.
Jan Sverre i robotikklaboratorium med NVIDIA Cosmos 3 AI-modell

Hva er NVIDIA Cosmos 3 – og hva betyr det for robotikk?

NVIDIA Cosmos 3 er den første åpne omni-modellen for Physical AI. Her er hva den faktisk kan gjøre for robotikk og autonome systemer – og hvorfor det er interessant.
Jan Sverre undersøker MiniCPM5-1B som kjører lokalt på en liten ARM-enhet

MiniCPM5-1B – reasoning og tool use på 1 milliard parametere

MiniCPM5-1B er en 1B-modell med hybrid reasoning, 131 000 tokens kontekst og tool use – og kjører lokalt via Ollama. Her er hva den faktisk kan.
Jan Sverre studerer bildegenerering-benchmark med fem AI-modeller på skjermvegg

Klein-4B, SANA 1.5, Qwen Image og Z-Image Turbo – hvem vinner bildeduellen?

Detaljert sammenligning av fem bildegenererings-modeller på 192 prompts: Klein-4B, Nucleus-Image, Z-Image Turbo, SANA 1.5 og Qwen Image. Hvem leverer best kvalitet, hastighet og verdi i 2026?
Jan Sverre undersøker Orange Pi AIPro single-board computer med Ascend 310B NPU på arbeidsbenk

MiniCPM-V 4.6 på Orange Pi – C++ inferensmotor til 1 500 kr

En utvikler bygde en C++ inferensmotor fra bunnen for å kjøre MiniCPM-V 4.6 på Orange Pi AIPro med Ascend 310B NPU. Resultatet: 5,90 tokens per sekund, ingen PyTorch, åpen kildekode – for 1 500 kroner.
Jan Sverre undersøker GPU-brikker på et laboratoriebenk med skjermer som viser Z-Image 6B bildegenerering

Z-Image 6B – Tencents VAE-frie bildegenerator med 1K oppløsning

Z-Image 6B fra Tencent genererer bilder direkte i pikselrom uten VAE. L2P-metoden gir 97% raskere 4K-generering og støtter 8K zero-shot.
Jan Sverre peker på ett glødende nevron i et holografisk nevralt nettverk - illustrasjon av CNA-metoden

CNA – Nous Research finner hjernecellene som styrer LLM-atferd

Nous Research lanserer CNA – en metode som finner og slår av eksakte nevroner i LLM-er for å styre atferd. Ingen SAE-trening, ingen vektmodifisering, full benchmark-ytelse beholdt.
Jan Sverre ser på en stor lysende Apple Silicon-chip med nevrale nettverksforbindelser - Command A+ 218B MoE

Command A+ 218B – Coheres kraftigste modell kjører nå på Apple Silicon

Command A+ (218B MoE, 25B aktive) kjører nå på Apple Silicon via MLX. Apache 2.0, 128K kontekst, cohere2_moe-implementasjon. Her er hva du trenger å vite.
NuExtract3 - Jan Sverre ved skrivebordet med dokumenter og holografisk JSON-ekstraksjon

NuExtract3 – open source 4B VLM for OCR og strukturert dokumentekstraksjon

NuExtract3 er en 4B open-weight VLM fra Numind som slår Qwen3.5-9B på strukturert dokumentekstraksjon. Apache 2.0-lisens, gratis demo på HuggingFace.
SANA-WM NVIDIAs open source videomodell - kamerakontroll og 720p video generering

SANA-WM – NVIDIAs open source videomodell lager 60 sekunder 720p på én GPU

NVIDIA slipper SANA-WM – en 2,6 milliarder parameter open source videomodell som genererer 60 sekunder 720p-video med presis kamerakontroll på én GPU. Det er 36 ganger raskere enn konkurrentene.