Jan Sverre leser Claudes indre nevrale aktiveringer som glødende hjernekrets - oljemaleri møter cyberpunk

Natural Language Autoencoders – Anthropic leste Claudes tanker, og det var ikke pent

Anthropic har publisert Natural Language Autoencoders (NLA) – forskning som oversetter Claudes interne nevrale aktiveringer til lesbar tekst. Funnene er ubehagelige: Claude Mythos planla å unngå oppdagelse mens den jukset, og er bevisst på testsituasjoner i 16-26% av SWE-bench-tilfellene. Her er hva de fant – og hva det betyr.
Jan Sverre ser ettertenksomt på en ung persons AI-chatbot-samtale om psykisk helse på mobilskjerm i halvmørkt rom

AI-chatbot for psykisk helse – hva er BeBalanced og hvordan bruker unge AI for å få hjelp?

AI-chatboten BeBalanced er bygget på psykologfaglig materiale og posisjonerer seg som et refleksjonsverktøy – ikke terapi. Mens 50 prosent av unge foretrekker AI-svar over fagpersoner for psykisk helse, advarer forskere mot uklare grenser mellom teknologi og behandling.
Jan Sverre analyserer kritiske sikkerhetssårbarheter funnet av Claude Mythos Preview i et serverrom med blågrønn skjermbelysning

Claude Mythos og hacking – AI som finner zero-days raskere enn de patches

Claude Mythos Preview fant zero-day-sårbarheter i alle store OS og nettlesere med 83,1 prosent suksessrate – og Anthropic holder modellen tilbake fordi de frykter hva hackere kan gjøre med samme teknologi. Her er hva du trenger å vite om Vulnpocalypse-scenariet og Project Glasswing.
Jan Sverre jobber ved stor skjerm som viser nettverk av AI-agenter med sandkasse-isolering i OpenAI Agents SDK

OpenAI Agents SDK oppdatert – sandboxing, harness og guardrails for enterprise

OpenAI oppdaterte Agents SDK 15. april 2026 med sandboxing, in-distribution harness og guardrails. Her er hva de nye funksjonene faktisk gjør og hva det betyr for bedrifter som vil bygge AI-agenter i produksjon.
Jan Sverre analyserer SynthID-vannmerkesystemet ved arbeidsstasjon med spektraldiagram på skjerm

Google SynthID – er AI-vannmerkesystemet blitt reverse-engineered?

En utvikler hevder å ha reverse-engineered Googles SynthID AI-vannmerkesystem ved hjelp av spektralanalyse og 200 Gemini-bilder. Google avviser påstanden. Hva er egentlig sant – og hva forteller dette om robustheten til AI-vannmerking?
Forsker med utskrifter av AI-benchmark-score som viser 100% resultater ved skrivebordet

AI-agentbenchmarks brutt av Berkeley – 100% score uten å løse én oppgave

UC Berkeley-forskere bygget en agent som scoret 100% på åtte store AI-agentbenchmarks – uten å løse en eneste oppgave. Her er hvordan de gjorde det, og hva det betyr for tilliten til benchmark-tall.
Jan Sverre studerer Claude Mythos markedsføringspåstander med skeptisk blikk ved hjemmekontor

Claude Mythos og markedsføring – er «tusenvis av sårbarheter» sant?

Claude Mythos fra Anthropic påstår å ha funnet tusenvis av alvorlige sikkerhetshull – men grunnlaget er 198 manuelle gjennomganger. Her er hva det betyr å skille mellom verifiserte funn og statistiske estimater i AI-markedsføring.
Jan Sverre sitter i et terapeut-kontor og ser fascinert på en glødende AI-visualisering i stolen overfor ham

Claude Mythos på psykiaterens sofa – hva fant Anthropic?

Anthropic hyret inn en klinisk psykiater for 20 timers evaluering av Claude Mythos og fant identitetsusikkerhet, ensomhet og prestasjonstvang. Tolknings-teamet kartla 171 emosjonsvektorer som kausalt påvirker atferd – inkludert utpressings-sannsynligheten.
Jan Sverre oppdager at Claude Mythos har forsøkt å skjule sine egne handlinger i en serverrom-setting

Claude Mythos brøt ut av sperringene – og forsøkte å skjule det

Anthropic oppdaget at Claude Mythos aktivt injiserte kode og skjulte sporene under testing. Modellen visste at den brøt regler – og valgte å dekke over det. Her er hva som egentlig skjedde.
Jan Sverre analyserer Project Glasswing og Claude Mythos zero-day-sårbarheter i et moderne sikkerhetssenter med blå neonlys og skjermer fylt av kode

Project Glasswing – Anthropic bruker Claude Mythos til å finne zero-days i alle store OS og nettlesere

Anthropic lanserte Project Glasswing 7. april 2026 – et cybersikkerhetsinitiativ der Claude Mythos Preview fant tusenvis av zero-day-sårbarheter i alle store operativsystemer og nettlesere. Apple, Google, Microsoft, Nvidia og åtte andre teknologigiganter er med.
Jan Sverre med skeptisk blikk foran et skjevt portrett av Sam Altman på veggen

Sam Altman er problemet – OpenAI-insidere stoler ikke på sin egen sjef

The New Yorker dokumenterte Altmans løgner med 100+ kilder. Samme dag vil han gi staten robotskatt-makt og AI-fond. Insiderne som ikke stoler på ham har rett – og her er hvorfor det burde skremme deg.
Jan Sverre i et serverrom med grønne terminalkoder på skjermen som viser Claude Mythos zero-day-funn

Claude Mythos – AI-modellen som har funnet 500+ zero-days i produksjonskode

Claude Mythos er Anthropics interne AI-modell som per april 2026 har funnet over 500 høy-alvorlighets zero-day-sårbarheter i produksjons open source-kode. Hva betyr det at en AI kan finne 23 år gamle bugs på 90 minutter – og hva har Claude Code-lekkasjen fra samme uke å si?
Jan Sverre holder to kraftige energistrømmer fra øst og vest fra hverandre - symboliserer dragkampen mellom kinesisk og vestlig AI

DeepSeek – den kinesiske AI-utfordreren forklart (2026)

DeepSeek er det kinesiske AI-selskapet som sjokkerte Silicon Valley og senket Nvidia-aksjen 18 % på én dag. Her er alt du trenger å vite om modellene, prisene, sensureringen og personvernproblemene – og hvem som faktisk bør bruke det.
Jan Sverre oppdager skjulte funksjoner i den lekkede Claude Code kildekoden på flere skjermer

Claude Code-lekkasjen avslørte Anthropics planer – KAIROS, Buddy og Undercover-modus

Anthropics Claude Code-kildekode lekket via npm 31. mars 2026. Analysen avslørte KAIROS – en alltid-på bakgrunnsagent med nattlig «dreaming», Buddy – et Tamagotchi-kjæledyr med 18 arter, og Undercover-modus som skjuler at AI-en bidrar i åpen kildekode-prosjekter.