Jan Sverre integrert i visualisering av Laguna S 2.1 på lokal maskin

Laguna S 2.1 gjør avansert AI-koding mulig på én maskin

Laguna S 2.1 er en open-weight kodemodell for langvarig agentarbeid. Den kan kjøre på én kraftig 128 GB-maskin, men krever både minne og tålmodighet.
Ternary Bonsai 27B illustrert som kompakt lokal AI på kraftig GPU

Test av Ternary Bonsai 27B lokalt på RTX 4090

Jeg testet Ternary Bonsai 27B på RTX 4090. Modellen er 7,2 GB, leverte 83-85 token/s og klarte JSON, dokumentarbeid, tool calling og vision.
Jan Sverre Bauge som kaptein ved roret på et teknologi-fartøy i åpent hav

PewDiePie brukte et år på sitt eget AI-arbeidsrom – her er hva Odysseus faktisk er

PewDiePie har laget et selv-hostet AI-arbeidsrom kalt Odysseus. Det er ikke et ChatGPT-alternativ – det er cockpiten rundt modellen du selv velger. Her er hva det faktisk er.
Jan Sverre undersøker MiniCPM5-1B som kjører lokalt på en liten ARM-enhet

MiniCPM5-1B – reasoning og tool use på 1 milliard parametere

MiniCPM5-1B er en 1B-modell med hybrid reasoning, 131 000 tokens kontekst og tool use – og kjører lokalt via Ollama. Her er hva den faktisk kan.
Jan Sverre studerer distribuert AI-inferens med to maskiner koblet via nettverk på hjemmekontoret

LARQL – kjør Gemma 4 26B på to billige maskiner med decoupled attention

LARQL er et open source Rust-prosjekt som lar deg kjøre Gemma 4 26B spredt over to billige maskiner ved å koble attention-mekanismen fra modellvektene. Distribuert lokal AI-inferens uten dyr GPU-rigg – her er hva det betyr i praksis.
Jan Sverre utforsker Gemma-4-31B-it-DFlash og spekulativ dekoding med DFlash-teknikken

Gemma-4-31B-it-DFlash – spekulativ dekoding for Googles åpne modell

Gemma-4-31B-it-DFlash er en ny variant av Googles Gemma 4 31B utgitt av Z Lab, med DFlash spekulativ dekoding som kan gi opptil 8x raskere inferens. Llama.cpp-støtte er under utvikling via PR #22105.
Mann i hettegenser studerer ytelsessammenligning mellom Ollama og llama.cpp på terminal-skjerm i mørkt hjemmekontor

Trenger lokal LLM-økosystemet Ollama? Kanskje ikke

Ollama er populært, men er det det beste verktøyet for lokal AI-kjøring? llama.cpp er 1,8x raskere, og alternativer som LM Studio, Jan og ramalama er modnet. Her er hva debatten handler om.
Jan Sverre holder to kraftige energistrømmer fra øst og vest fra hverandre - symboliserer dragkampen mellom kinesisk og vestlig AI

DeepSeek – den kinesiske AI-utfordreren forklart (2026)

DeepSeek er det kinesiske AI-selskapet som sjokkerte Silicon Valley og senket Nvidia-aksjen 18 % på én dag. Her er alt du trenger å vite om modellene, prisene, sensureringen og personvernproblemene – og hvem som faktisk bør bruke det.
Jan Sverre dirigerer et nettverk av open source AI-modeller som Llama, Qwen og Mistral lokalt på egen maskin

Open source AI – komplett guide (2026)

Alt du trenger å vite om open source AI i 2026: hva open weights faktisk betyr, de beste modellene (Llama, Qwen, Mistral, DeepSeek), verktøy for lokal kjøring, og når open source slår lukkede alternativ.
Jan Sverre utforsker Ollama og lokal AI på sin egen PC

Hva er Ollama? Slik kjører du lokal AI gratis på egen PC

Hva er Ollama og hva trenger du for å kjøre lokal AI? Norsk guide til installasjon, modellvalg, RAM, VRAM, personvern og lokalt API i 2026 for norske brukere.