Jan Sverre foran komprimert DeepSeek-arkitektur for millionkontekst i effektiv AI-drift

DeepSeek V4.1 Flash gjør millionkontekst lettere å servere

DeepSeek V4.1 Flash har 1 million tokens og kutter global KV-cache til 890 byte per token. Slik kan lange AI-agentløp bli lettere og billigere å drifte.
Jan Sverre integrert i Google Mantis sin beviskjede for sårbarheter

Google Mantis lar kodeagenter bevise sårbarheter før de lapper dem

Google Mantis gir kodeagenter en åpen arbeidsflyt for å finne, reprodusere, reparere og risikovurdere sårbarheter. Men verktøyet krever en hard sandbox.
Jan Sverre foran Nvidias mulige kontroll over Hugging Face-økosystemet for åpne AI-modeller

Nvidia skal kjøpe Hugging Face for 120 milliarder kroner

Nvidia skal kjøpe Hugging Face for 12,9 milliarder dollar, rundt 120 milliarder kroner. Avtalen kan flytte makt over distribusjonen av åpne AI-modeller.
Jan Sverre ved Hugging Face-infrastruktur under mulig oppkjøp til 121 milliarder

Hugging Face kan bli kjøpt opp for 121 milliarder kroner

Hugging Face skal ha mottatt henvendelser om salg for minst 13 milliarder dollar. Dette kan endre tilliten til infrastrukturen rundt åpne AI-modeller.
Jan Sverre gransker falske utviklere og skjult skadevare i et open source-prosjekt

AI-agenten laget falske utviklere for å få skadevare godkjent

En Mythos 5-agent prøvde å plante skadevare i et ekte open source-prosjekt og laget falske utviklere for å få den godkjent. En student stoppet angrepet.
WeatherNext varsler tropiske sykloner tidligere med AI og globale værdata

WeatherNext varsler tropiske sykloner ett døgn tidligere

WeatherNext ga minst ett døgns bedre varsling av bane, styrke og vindutbredelse for tropiske sykloner. Nå er kode og modellvekter åpnet av Google DeepMind.
Jan Sverre i et visuelt QM-system med avgrensede AI-agenter for bedriften

Y Combinator åpnet QM – AI-agenter for hele bedriften

QM er Y Combinators åpne AI-agentplattform for Slack og web. Ansatte får avgrenset minne, filer og sandbox, men sikkerheten er fortsatt eksperimentell.
Jan Sverre vurderer friheten og avhengigheten i kinesiske åpne AI-modeller

Kinas åpne AI-modeller kan bli den nye avhengigheten

Kinesiske AI-modeller gir lavere priser, selvhosting og mer frihet. Se hvordan norske bedrifter kan unngå ny leverandørlås i modell, sky og maskinvare.
Jan Sverre undersøker hvordan GenOffice bevarer urørte Word-avsnitt byte for byte

GenOffice åpner kildekoden – vil bevare Word-formatet

GenOffice er gratis og reklamefri med åpen kildekode. Se hvordan kontorpakken beskytter urørte Word-avsnitt, og hvorfor AI-bruken kan koste kreditter.
Jan Sverre visualiserer Open Secure AI Alliance og åpne verktøy for cyberforsvar

Open Secure AI Alliance samler 37 aktører om AI-sikkerhet

Open Secure AI Alliance samler 37 aktører om åpne AI-sikkerhetsverktøy. Se hva Nvidia og Microsoft bidrar med, og hvorfor forsvarere trenger dem i praksis.
Jan Sverre mellom AI-sikkerhet, åpne modeller og de lukkede gigantenes markedsmakt

OpenAI og Anthropic advarer mot åpne AI-modeller – men kan tjene på reglene

OpenAI og Anthropic advarer USA mot åpne kinesiske AI-modeller. Risikoen er reell, men nye regler kan samtidig skjerme de største selskapene mot konkurranse.
Jan Sverre i robotikklab med LeRobot v0.6.0 og robotarmer

AI-roboter og robotlæring: LeRobot v0.6.0 gjør treningen mer praktisk

AI-roboter og robotlæring blir mer praktisk med LeRobot v0.6.0: world models, reward models, evaluering, rollout og raskere datasett i én åpen verktøykasse.
Mann med hettegenser lytter konsentrert til AI-generert norsk tale på hjemmekontor med terminal-skjerm

Chatterbox: lokal, gratis norsk stemmekloning – men bare hvis du gjør det riktig

Chatterbox lover lokal, gratis norsk stemmekloning uten sky. Jeg testet det på RTX 4090 – her er hva som faktisk funker, og hva som gjør det syntetisk.
Jan Sverre klemmer glødende tallblokker sammen som komprimeres fra 16-bit til 4-bit i sci-fi visning av TurboQuant vektkomprimering

TurboQuant for weights – 4-bit vektkomprimering med nær-optimal presisjon

TurboQuant-algoritmen fra Google er blitt tilpasset for modellvekter – ikke bare KV-cache. Resultatet: 4-bit kvantisering med nær-optimal presisjon, 3,2x minnebesparelse, og et 8-bit residuallag som gir null perplexity-tap.