Jan Sverre visualiserer Ternary Bonsai 2 27B og lokal AI i nettleseren

Ternary Bonsai 2 – 27B-modell på 5,95 GB i nettleseren

Ternary Bonsai 2 presser en Qwen3.8-basert 27B-modell ned til 5,95 GB. Hele modellen kan nå kjøre lokalt i nettleseren med WebGPU. Se hva som kreves her.
Jan Sverre med Gemini 3.8 Live som arbeider mens talesamtalen fortsetter

Gemini 3.8 Live lar taleagenten jobbe mens samtalen fortsetter

Gemini 3.8 Live kjører verktøy i bakgrunnen uten å stoppe samtalen. Se forskjellen på modellene, prisene og hva du må endre for taleagenter i produksjon.
Jan Sverre illustrerer Salesforce Koa som spesialisert AI-modell for moderne CRM-arbeid

Salesforce Koa kan ta CRM-oppgaver fra Claude og ChatGPT

Salesforce Koa er en spesialisert CRM-modell bygget på Nvidia Nemotron. Den kan flytte betalt arbeid fra Claude og ChatGPT til Salesforce.
Jan Sverre i visuell framstilling av Fugu Max og AI-orkestrering

Fugu Max kutter prisen på AI-orkestrering – men ikke for Norge ennå

Fugu Max koster cirka 19/56 kroner per million input-/output-tokens, mens Ultra v2 går for toppytelse. Men Sakana tilbyr dem ikke i Norge eller EØS ennå.
Jan Sverre i en visuell verden for oversettelse mellom 50 språk

Cohere North Small Translate oversetter 50 språk med åpne vekter

Cohere North Small Translate oversetter mer enn 50 språk, inkludert norsk bokmål. Se maskinvarekrav, lisens og hva du bør teste i praksis før produksjon.
Jan Sverre foran komprimert DeepSeek-arkitektur for millionkontekst i effektiv AI-drift

DeepSeek V4.1 Flash gjør millionkontekst lettere å servere

DeepSeek V4.1 Flash har 1 million tokens og kutter global KV-cache til 890 byte per token. Slik kan lange AI-agentløp bli lettere og billigere å drifte.
Jan Sverre i møte med Suno v6 og lisensiert AI-musikk

Suno v6 er trent på lisensiert musikk – gamle modeller skal bort

Suno v6 er trent på lisensiert musikk og erstatter v5.5 og eldre modeller. Se hva som er nytt, hva som er usikkert og hva du bør sikre før overgangen.
Jan Sverre med Reducto r-1 som samler dokumentparsing i ett modellpass

Reducto r-1 parser dokumenter i ett pass for ni øre per side

Reducto r-1 samler OCR, layout og tabeller i ett pass til rundt ni øre per side. Her er prisgevinsten, forbeholdene og migrasjonsrådene.
Jan Sverre med MiniCPM5-2B som kompakt lokal AI-agent for kode og verktøy

MiniCPM5-2B retter små lokale modeller mot ekte agentarbeid

MiniCPM5-2B er en lokal AI-modell med 2,52 milliarder parametere, 131K kontekst og verktøykall. Styrken er lokale agenter og kode – ikke faktakunnskap.
Jan Sverre utforsker K2 Horizon-familien med seks åpne AI-modeller

K2 Horizon samler seks åpne AI-modeller fra 0,9B til 375B

K2 Horizon samler seks åpne AI-modeller med Apache 2.0-lisens. Se størrelser, MoVA-arkitektur, maskinvarekrav og haken ved benchmarkene før du velger.
Jan Sverre med paraply foran et detaljert AI-generert værkart fra Google

WeatherNext 3 gir værvarsler hver time i Maps og Gemini

WeatherNext 3 lager nye globale værprognoser hver time, med opptil 5 kilometers oppløsning og bedre nedbørsvarsler i Google Search, Maps og Gemini.
Jan Sverre vurderer GPT-6 Astra som rask AI-agent og mulig AGI-start

GPT-6 Astra setter fart på AI-agentene – OpenAI snakker allerede om AGI

GPT-6 Astra bruker PC-er raskere og mer presist enn før. OpenAI snakker om AGI, men virkelige agentoppgaver blir den avgjørende testen.
Jan Sverre vurderer Muse Spark 1.3 som Metas nye frontier-utfordrer

Muse Spark 1.3 gjør Meta til en reell frontier-utfordrer

Muse Spark 1.3 gjør Meta til en reell frontier-utfordrer med mer effektive AI-agenter og en Contributor-pris som kutter tokenkostnaden med over 90 prosent.
Jan Sverre møter Gemini 3.8 Flash og regningen for mer resonnering

Gemini 3.8 Flash tenker mer – og kan koste mer enn prislappen lover

Gemini 3.8 Flash har samme tokenpris som 3.7 Flash, men kan bruke flere resonneringstoken. Dette betyr det for agenter, API-kostnad og modellvalg i praksis.