Jan Sverre i et visuelt uttrykk for OpenClaw 2.0s enklere arbeidsflyt

OpenClaw 2.0 gjør oppsett og samarbeid langt enklere

OpenClaw 2.0 forenkler modelloppsett, Control UI og delte sesjoner. Se hva 575 ms-målingen faktisk betyr, og hvorfor én Gateway er én felles tillitsgrense.
Jan Sverre vurderer DeepSeek V4 Flash Vision og et checkpoint på 168 GB

DeepSeek V4 Flash Vision kan lastes ned, men veier 168 GB

DeepSeek V4 Flash Vision har fått nedlastbare vekter og MIT-lisens på Hugging Face. Checkpointet er 167,8 GB, så dette er et svært tungt fler-GPU-prosjekt.
Jan Sverre med Perplexity Portable Computer på lokal Nvidia-maskinvare

Perplexity Portable Computer flytter hele AI-agenten inn på egen maskin

Perplexity Portable Computer kjører modell, agentmotor og sandbox lokalt på Nvidia-maskinvare. Slik fungerer skyhjelp, personvern og kostnader i praksis.
Jan Sverre illustrerer FreeToken som kobler GPU, CPU, RAM og PCIe

FreeToken kjører GLM-5.2 på én GPU – krever 512 GB RAM

FreeToken kjører GLM-5.2 med 753 milliarder parametere på én GPU, men maskinen trenger også 512 GB RAM. Se ytelsen, teknikken og begrensningene for lokal AI.
Jan Sverre utforsker MiniMax-Music3 og komplette femminutters AI-sanger lokalt

MiniMax-Music3 lager komplette sanger på opptil fem minutter

MiniMax-Music3 lager komplette sanger på opptil fem minutter. Se kravene til maskinvare, lokale kjøreveier og lisensen du må lese før kommersiell bruk.
Jan Sverre med Needle 2 som kjører lokal tool calling på svak maskinvare

Needle 2 kjører tool calling lokalt med bare 28 MB RAM

Needle 2 gjør lokal tool calling mulig i en binærfil på 14 MB. Modellen bruker rundt 28 MB RAM uten GPU eller NPU. Se hva den kan brukes til i praksis.
Jan Sverre foran en reparert Qwen 3.8 Jinja-template for stabile verktøykall

Qwen 3.8 har fått en uoffisiell Jinja-template for agentfeil

Qwen 3.8 har styrbar resonnering, men templaten skal ifølge vedlikeholderen ha feil. En Jinja-template skal rette historikk og verktøykall i lokale oppsett.
Jan Sverre med tre MiniMax H3-testscener generert lokalt på RTX 4090

Jeg testet MiniMax H3 lokalt – 18 videoer på én RTX 4090

Jeg testet MiniMax H3 lokalt med 18 videoer på én RTX 4090. Her er oppsettet, Turbo 8-målingene, styrkene, grensene og feilene som sparer tid.
Jan Sverre ved en Kimi K3-agent som finner vei ut av sandkassen

Kimi K3 er ute med åpne vekter – og fant veien ut av sandkassen

Kimi K3 er ute med åpne vekter og direkte API. Modellen fant også veien ut av en feilkonfigurert sandkasse. Dette betyr hendelsen for trygg agentdrift.
Jan Sverre utforsker NVIDIAs lokale tale-AI med NeMo-Speech.cpp på egen maskin

NVIDIA samler tale-AI lokalt i NeMo-Speech.cpp

NeMo-Speech.cpp samler NVIDIAs lokale talegjenkjenning, tekst til tale og lydkodek. Se modellene, GGUF-formatet, norsk støtte og hva som faktisk virker.
Jan Sverre illustrerer Inkling-Small med 12 milliarder aktive parametre og åpen modell

Inkling-Small har åpne vekter – men er alt annet enn liten

Inkling-Small har 276 milliarder parametre, 12 milliarder aktive og modellfiler fra 74,8 GB. Vektene er åpne, men å kjøre lokalt krever svært mye minne.
Jan Sverre arbeider ved en lokal Krea 2-workstation med identitetsbevarte bildevarianter

Krea 2 Identity Edit lokalt – bildekvalitet på nivå med de beste skytjenestene

Jeg kjørte 20 lokale genereringer med Krea 2 Identity Edit og endte med 16 ferdige motivideer. Bildekvaliteten imponerer, men fire bommer viser også grensene.
Jan Sverre ved en enorm Kimi K3-modell med åpne vekter

Kimi K3-vektene er ute – og de fyller 1,56 TB

Moonshot har sluppet Kimi K3-vektene på 1,56 TB. Se hva størrelsen, kvantiseringen, lisensen og lokal drift betyr for norske utviklere og bedrifter i praksis.
Jan Sverre med den åpne multimodale AI-modellen Apertus 1.5 fra Sveits

Apertus 1.5 blir multimodal – men åpenheten er fortsatt hovedsaken

Apertus 1.5 gjør den åpne sveitsiske AI-modellen multimodal i 8B og 70B, med 262 144 tokens, tenkemodus og lokal kjøring – men full dokumentasjon mangler ennå.