Jan Sverre foran Apples delte AI-modell for Kina og resten av verden

Apple skal ha trent egen AI-modell for Kina med hjelp fra Alibaba

Apple trener en egen AI-modell for Kina med hjelp fra Alibaba. Det avslører nå hvor avhengig Apple Intelligence er av partnere og myndighetsgodkjenning.
Jan Sverre foran en reparert Qwen 3.8 Jinja-template for stabile verktøykall

Qwen 3.8 har fått en uoffisiell Jinja-template for agentfeil

Qwen 3.8 har styrbar resonnering, men templaten skal ifølge vedlikeholderen ha feil. En Jinja-template skal rette historikk og verktøykall i lokale oppsett.
Jan Sverre vurderer friheten og avhengigheten i kinesiske åpne AI-modeller

Kinas åpne AI-modeller kan bli den nye avhengigheten

Kinesiske AI-modeller gir lavere priser, selvhosting og mer frihet. Se hvordan norske bedrifter kan unngå ny leverandørlås i modell, sky og maskinvare.
Jan Sverre mellom Qwen3.8-Max i datasenteret og en praktisk 27B-modell

Qwen3.8-Max får åpne vekter – men 27B kan bli viktigst

Alibaba lover åpne vekter for Qwen3.8-Max og en ny 27B-modell. Max sikter mot datasentre, mens 27B kan bli utgaven langt flere faktisk kan bruke i praksis.
Jan Sverre møter Qwen3.8-Max i konkurransen mot Claude og GPT

Qwen3.8-Max utfordrer Claude og GPT – åpne vekter kommer neste uke

Alibaba gjør Qwen3.8-Max bredt tilgjengelig og lover åpne vekter neste uke. Modellen utfordrer Claude og GPT på ytelse, pris og kontroll.
Jan Sverre mellom raske og detaljerte lydbølger fra Qwen-Audio-3.0-TTS-modellene

Qwen-Audio-3.0-TTS deler talejobben mellom fart og kvalitet

Qwen-Audio-3.0-TTS kommer som rask Flash og kvalitetsrettet Plus i 16 språk. Se pris, API-tilgang, stemmekloning og hva som mangler for norske brukere.
Jan Sverre utfordrer Alibabas udokumenterte påstander om Qwen3.8-Max og 2,4 billioner parametere

Qwen3.8-Max kan prøves nå – men de viktigste tallene mangler

Qwen3.8-Max kan prøves nå med 2,4 billioner oppgitte parametere. Men modellkort, benchmark, lisens, aktiv størrelse og vanlig API-pris mangler fortsatt.
Jan Sverre trekker Qwen-data gjennom kinesisk eksportkontroll og modelltilgang

Kinesiske AI-modeller kan bli vanskeligere å bruke utenfor Kina

Kinesiske AI-modeller fra Alibaba, ByteDance og Z.ai kan få strengere tilgang utenfor Kina. Det kan gjøre billig AI dyrere for små bedrifter og utviklere.
NuExtract3 - Jan Sverre ved skrivebordet med dokumenter og holografisk JSON-ekstraksjon

NuExtract3 – open source 4B VLM for OCR og strukturert dokumentekstraksjon

NuExtract3 er en 4B open-weight VLM fra Numind som slår Qwen3.5-9B på strukturert dokumentekstraksjon. Apache 2.0-lisens, gratis demo på HuggingFace.
Jan Sverre i tolkeboks med sanntidsoversettelse på skjerm - Qwen3.5-LiveTranslate-Flash

Qwen3.5-LiveTranslate-Flash – sanntidsoversettelse på 2,8 sekunder

Alibabas Qwen3.5-LiveTranslate-Flash oversetter tale og video på 2,8 sekunder på tvers av 60 språk – med stemmekloning, leppeavlesning og domenespesifikk terminologi.
Jan Sverre jobber i hjemmelaben om natten med llama.cpp og Qwen 3.6 27B MTP på RTX 3090

llama.cpp b9200 + Qwen 3.6 27B MTP – slik får du Hermes Agent til å fly på RTX 3090

llama.cpp b9200 fikser MTP memory traffic overhead. Med riktig konfig på Qwen 3.6 27B mtp doblet draft acceptance rate for Hermes Agent på RTX 3090.
Jan Sverre ved skrivebordet med llama.cpp-terminaler som viser MTP-aktivert inferens

MTP merget inn i llama.cpp – nå kan alle kjøre det

PR 22673 er merget inn i llama.cpp master. MTP-støtte gir 1,9x til 2,5x raskere inferens lokalt – her er hva du trenger å vite og hvordan du aktiverer det.
Jan Sverre Bauge sitter med MacBook Pro og ser på terminalen som viser MTP-ytelse på 34 tokens per sekund

MTP + TurboQuant på LLaMA.cpp – Qwen 27B til 34 tokens per sekund på MacBook

Multi-Token Prediction kombinert med TurboQuant gir Qwen 27B 34 tokens per sekund på MacBook Pro M5 Max – en økning på 40% uten ekstra kostnad.
Jan Sverre holder et glødende kinesisk AI-øye og studerer Qwen 3.6 Plus Preview med skeptisk nysgjerrighet

Qwen 3.6 på OpenRouter – 1 million token kontekst og gratis preview

Qwen 3.6 Plus Preview dukket opp på OpenRouter 30. mars 2026 uten noen offisiell kunngjøring fra Alibaba. Modellen har 1 million token kontekstvindu, innebygd reasoning og er gratis tilgjengelig akkurat nå – men med forbehold om kinesisk datainnsamling.