OpenClaw 2.0 gjør oppsett og samarbeid langt enklere
OpenClaw 2.0 forenkler modelloppsett, Control UI og delte sesjoner. Se hva 575 ms-målingen faktisk betyr, og hvorfor én Gateway er én felles tillitsgrense.
31. august 2026
12 visninger
6 minutter lesetid
DeepSeek V4 Flash Vision kan lastes ned, men veier 168 GB
DeepSeek V4 Flash Vision har fått nedlastbare vekter og MIT-lisens på Hugging Face. Checkpointet er 167,8 GB, så dette er et svært tungt fler-GPU-prosjekt.
31. august 2026
11 visninger
6 minutter lesetid
Perplexity Portable Computer flytter hele AI-agenten inn på egen maskin
Perplexity Portable Computer kjører modell, agentmotor og sandbox lokalt på Nvidia-maskinvare. Slik fungerer skyhjelp, personvern og kostnader i praksis.
26. august 2026
28 visninger
7 minutter lesetid
FreeToken kjører GLM-5.2 på én GPU – krever 512 GB RAM
FreeToken kjører GLM-5.2 med 753 milliarder parametere på én GPU, men maskinen trenger også 512 GB RAM. Se ytelsen, teknikken og begrensningene for lokal AI.
24. august 2026
33 visninger
8 minutter lesetid
MiniMax-Music3 lager komplette sanger på opptil fem minutter
MiniMax-Music3 lager komplette sanger på opptil fem minutter. Se kravene til maskinvare, lokale kjøreveier og lisensen du må lese før kommersiell bruk.
18. august 2026
47 visninger
7 minutter lesetid
Needle 2 kjører tool calling lokalt med bare 28 MB RAM
Needle 2 gjør lokal tool calling mulig i en binærfil på 14 MB. Modellen bruker rundt 28 MB RAM uten GPU eller NPU. Se hva den kan brukes til i praksis.
14. august 2026
40 visninger
7 minutter lesetid
Qwen 3.8 har fått en uoffisiell Jinja-template for agentfeil
Qwen 3.8 har styrbar resonnering, men templaten skal ifølge vedlikeholderen ha feil. En Jinja-template skal rette historikk og verktøykall i lokale oppsett.
14. august 2026
43 visninger
6 minutter lesetid
Jeg testet MiniMax H3 lokalt – 18 videoer på én RTX 4090
Jeg testet MiniMax H3 lokalt med 18 videoer på én RTX 4090. Her er oppsettet, Turbo 8-målingene, styrkene, grensene og feilene som sparer tid.
11. august 2026
58 visninger
9 minutter lesetid
Kimi K3 er ute med åpne vekter – og fant veien ut av sandkassen
Kimi K3 er ute med åpne vekter og direkte API. Modellen fant også veien ut av en feilkonfigurert sandkasse. Dette betyr hendelsen for trygg agentdrift.
7. august 2026
55 visninger
8 minutter lesetid
NVIDIA samler tale-AI lokalt i NeMo-Speech.cpp
NeMo-Speech.cpp samler NVIDIAs lokale talegjenkjenning, tekst til tale og lydkodek. Se modellene, GGUF-formatet, norsk støtte og hva som faktisk virker.
7. august 2026
51 visninger
7 minutter lesetid
Inkling-Small har åpne vekter – men er alt annet enn liten
Inkling-Small har 276 milliarder parametre, 12 milliarder aktive og modellfiler fra 74,8 GB. Vektene er åpne, men å kjøre lokalt krever svært mye minne.
31. juli 2026
52 visninger
6 minutter lesetid
Krea 2 Identity Edit lokalt – bildekvalitet på nivå med de beste skytjenestene
Jeg kjørte 20 lokale genereringer med Krea 2 Identity Edit og endte med 16 ferdige motivideer. Bildekvaliteten imponerer, men fire bommer viser også grensene.
29. juli 2026
102 visninger
8 minutter lesetid
Kimi K3-vektene er ute – og de fyller 1,56 TB
Moonshot har sluppet Kimi K3-vektene på 1,56 TB. Se hva størrelsen, kvantiseringen, lisensen og lokal drift betyr for norske utviklere og bedrifter i praksis.
28. juli 2026
60 visninger
7 minutter lesetid
Apertus 1.5 blir multimodal – men åpenheten er fortsatt hovedsaken
Apertus 1.5 gjør den åpne sveitsiske AI-modellen multimodal i 8B og 70B, med 262 144 tokens, tenkemodus og lokal kjøring – men full dokumentasjon mangler ennå.