Jan Sverre bryter gjennom et 30 år gammelt optimeringsgap med GPT-5.6

GPT-5.6 fant beviset som lukker et 30 år gammelt hull i konveks optimering

GPT-5.6 fant hovedargumentet i et bevis som lukker et 30 år gammelt hull i konveks optimering. Lean bekrefter kjernen, men fagfellevurdering gjenstår.
Mann i hettegenser ved grensen mellom en server-hall og en videospillverden, som illustrerer General Intuitions metode for å trene AI på spilldata

General Intuition er verdsatt til 21 milliarder kroner – fordi de trener AI på videospill

General Intuition hentet 320 millioner dollar og er nå verdsatt til 2,3 milliarder dollar. Satsen: at videospilldata er nøkkelen til AI-agenter som faktisk forstår den fysiske verden.
Mann i hettegenser studerer skjermer med data fra massivt AI-kloningsangrep

Alibaba kopierte Claude i 28,8 millioner utvekslinger – Anthropic krever straff

Alibaba brukte 25 000 falske kontoer til å gjennomføre 28,8 millioner Claude-utvekslinger i det største kjente kloningsangrepet mot Anthropic. Selskapet ber nå Kongressen om sanksjoner.
Jan Sverre utforsker DFlash spekulativ dekoding - parallell token-generering visualisert som lysstrømmer i et serverrom

DFlash: slik kan spekulativ dekoding gi deg opptil 6x raskere AI-inferens

DFlash fra UC San Diego bruker block diffusion og KV injection for å generere hele token-blokker parallelt – og rapporterer opptil 6x lossless speedup på Qwen3-8B. Her er hva det betyr i praksis.
Mann i hettegenser ser på holografisk display med åpen kildekode og Europa-kart - illustrasjon for Apertus AI

Apertus: den åpne AI-modellen Europa faktisk kontrollerer selv

Apertus er en fullt åpen AI-modell fra sveitsiske forskningsinstitusjoner. Her er hva det betyr i praksis – og hvorfor det er annerledes enn Llama og Mistral.
Jan Sverre ser skeptisk på holografisk display med AI-modell hallusinasjonsrater

GPT-5.5 hallusinerer tre ganger mer enn GLM-5.2 – og det er et problem

Ny benchmark viser at GPT-5.5 hallusinerer med 86 % på AA-Omniscience-testen, mot GLM-5.2 sine 28 %. Hva betyr det for deg som bruker AI i praksis?
Jan Sverre ser inn i et AI-speil som reflekterer en forvrengt idealisert versjon av ham selv

AI-sycophancy: når AI sier deg det du vil høre – og hvorfor det er farligere enn hallusinasjoner

AI hallusinerer – det vet alle. Det farlige er noe annet: at AI validerer deg i stedet for å si deg imot. Forstå sycophancy-problemet og lær promptene som motvirker selvbedrag.
Jan Sverre ser på holografiske skjermer som viser AI-simulering av den fysiske verden - world models

Odyssey fikk 16 milliarder kroner og Amazon som backer – hva er egentlig en world model?

Odyssey ble verdsatt til 1,45 milliarder dollar med Amazon som backer. Men hva er egentlig en world model – og hvorfor er det neste steg etter LLM-er?
Jan Sverre ser på dramaet der USA stengte tilgangen til Claude Fable 5 og Mythos 5 for alle utenlandske brukere

Claude Fable 5 og Mythos stengt tre dager etter lansering – hele historien om statens inngrep

Du fikk Anthropics kraftigste modell i tre dager. Så var den borte. Her er hele historien om hvorfor USA stoppet Fable 5 og Mythos 5 – hvem som dyttet, hva som egentlig skjedde, og hva det betyr for oss nordmenn.
Jan Sverre analyserer et dokument med Zamba2-VL vision-language-modell

Zamba2-VL er en rask vision-language-modell du kan kjøre lokalt – her er hva den faktisk gjør

Zyphra har sluppet Zamba2-VL, en hybrid Mamba2/Transformer-modell som analyserer bilder og tekst. Praktisk guide til hva den gjør og om den er verdt å kjøre lokalt.
Jan Sverre ser forvirret og amuset på en skjerm med tekst om en fyrvokter

AI-chatboter er besatt av én mann – og ingen vet helt hvorfor

ChatGPT, Gemini og Claude forteller igjen og igjen historier om fyrvokteren Elias Thorne. Forskere ved Cornell har funnet ut hvorfor – og svaret er litt ubehagelig.
Jan Sverre ser på DiffusionGemma, Googles eksperimentelle text diffusion-modell

DiffusionGemma er raskere enn Gemma 4 – men ikke klar for produksjon

DiffusionGemma er Googles 26B eksperimentelle modell som genererer tekst 4x raskere enn Gemma 4 – men med lavere kvalitet. Her er hva du bør vite.
Jan Sverre studerer et nettverk av datanoder som viser agentic RAG og iterativ søking på tvers av datakilder

Hva er agentic RAG – og hvorfor er Google Geminis nye tilnærming annerledes?

Google Research har lagt til en Sufficient Context Agent i Gemini Enterprise som iterativt re-søker til svaret er godt nok. Opp til 34% bedre faktanøyaktighet enn vanlig RAG.
Jan Sverre foran NVIDIAs GPU-racker med grønt lys - Nemotron Ultra 550B MoE-modell

Nemotron Ultra – NVIDIAs åpne 550B-modell med 1 million tokens kontekst

NVIDIA slipper Nemotron Ultra – en åpen 550B MoE-modell med 1 million tokens kontekst og opptil 6x raskere inferens enn sammenlignbare modeller. Her er hva det betyr i praksis.