Innhold Vis
Ox Alpha fra Z.AI er ikke lenger en anonym AI-modell: Selskapet har bekreftet at modellen er en ny utgave i GLM-serien og varslet at modellvektene skal slippes senere 26. august. For deg som følger lokale modeller, er den siste delen langt viktigere enn selve avsløringen. Først når vektene, lisensen og de tekniske detaljene ligger ute, kan folk teste hva modellen faktisk er god for.
Ox Alpha dukket opp gratis på OpenRouter 20. august 2026, uten navn på utvikleren. Der ble den presentert som en reasoning-modell for koding, langvarig agentarbeid og krevende arbeidsflyter. Seks dager senere bekreftet Z.AI overfor Bloomberg at spekulasjonene stemte: Ox Alpha kommer fra selskapets GLM-familie.
Overskriftene om at modellen «rivaliserer med DeepSeek» bør likevel tas med en god klype salt. Bekreftet opphav er ikke det samme som bekreftet ytelse. Akkurat nå er den solide nyheten at en stealth-modell får et navn og at Z.AI varsler åpne vekter. Resten må modellen bevise når andre kan kjøre den på egne premisser.
Hva vet vi sikkert om Ox Alpha fra Z.AI?
Vi vet sikkert at Ox Alpha er utviklet av Z.AI, at den tilhører GLM-serien og at selskapet 26. august varslet en utgivelse av modellvektene samme kveld. Bloomberg fikk bekreftelsen direkte fra selskapet. Det er fortsatt ikke det samme som at vektene, lisensen og et komplett model card allerede er tilgjengelige.
OpenRouters modellside oppgir et kontekstvindu på 1 048 576 tokens og maksimalt 131 072 tokens i svaret. Modellen tar imot tekst, bilder og video og leverer tekst. Den støtter også function calling gjennom tools og tool_choice, samt JSON-output via response_format, men uten håndheving av et JSON-schema.
Dette er relevante egenskaper for kodeagenter og lange oppgaver. Et kontekstvindu på over én million tokens gir plass til store mengder kode og dokumentasjon, mens høy output-grense gjør det mulig å fullføre større leveranser. Men en stor kontekstgrense på en produktside forteller ikke hvor godt modellen finner riktig detalj langt inne i konteksten, eller hvor stabilt den bruker verktøy gjennom mange trinn.
Er Ox Alpha egentlig GLM-5.3?
Z.AI har bekreftet GLM-familien, men Bloomberg-formuleringen identifiserer ikke nødvendigvis Ox Alpha med et bestemt offentlig modellnavn. Mye peker mot GLM-5.3, men det er klokt å skille mellom det selskapet faktisk har bekreftet og det andre har utledet.
Det finnes også en detalj som gjør at jeg ikke vil sette to streker under GLM-5.3-navnet ennå. Ox Alpha var oppført med støtte for bilde og video hos OpenRouter, mens Z.AI beskriver GLM-5.3 som en modell med kun tekstinput. Forskjellen kan skyldes et eget preview-oppsett, en modellvariant eller behandling hos leverandøren. Den kan også bety at antakelsen er litt for enkel.
Den varslede vektutgivelsen bør rydde opp i dette. Filstruktur, konfigurasjon, arkitektur, tokenizer og offisiell modellbetegnelse er langt vanskeligere å gjemme bak et kodenavn når hele pakken ligger offentlig. Fram til da er «en ny GLM-utgave» den presise formuleringen. GLM-5.3 er den sterke kandidaten, ikke et faktum jeg vil late som er mer bekreftet enn det er.
Hvorfor betyr åpne modellvekter så mye?
Åpne modellvekter betyr at modellen kan lastes ned, inspiseres, kvantiseres og kjøres uten at alle forespørsler må sendes til Z.AI eller en mellommann. Det er selve forskjellen mellom en spennende gratis prøveperiode og en modell som kan bli en varig del av lokale arbeidsflyter.
For lokale AI-brukere begynner den virkelige vurderingen først da. Hvor stor er modellen? Hvor mange parametere er aktive per token? Hvor mye RAM eller VRAM krever en praktisk kvantisering? Fungerer tool calling like godt utenfor det hostede endepunktet? Og hvilken lisens gjelder for kommersiell bruk? Ingen av disse spørsmålene kan besvares sikkert bare ut fra OpenRouter-utgaven.
Det er også her sammenligningen med DeepSeek som kinesisk AI-utfordrer blir relevant. DeepSeek fikk ikke oppmerksomhet bare fordi modellene kunne svare godt i en nettjeneste. Muligheten til å laste ned vektene, lage kvantiseringer og kjøre dem på egen eller leid maskinvare gjorde teknologien tilgjengelig for langt flere utviklere.
Jeg er generelt skeptisk til store påstander rundt kinesiske modeller før de kan etterprøves skikkelig. Akkurat derfor er åpne vekter gode nyheter. De flytter diskusjonen fra skjermbilder, anekdoter og topplister til tester som kan gjentas. Hvis Ox Alpha virkelig er så god som de første brukerne mener, tåler den den overgangen.
Hva kan modellen brukes til i praksis?
Ox Alpha er først og fremst presentert som en modell for koding, reasoning og langvarig agentarbeid. Det betyr oppgaver der modellen må holde oversikt over mange filer, bruke verktøy, tolke resultater og fortsette gjennom en lengre arbeidsflyt i stedet for å levere ett enkelt chatsvar.
Z.AI beskriver GLM-5.3 i omtrent samme retning. Selskapets dokumentasjon fremhever komplekse programvareoppgaver, terminalarbeid og agenter, og oppgir tre nivåer for reasoning effort: low, high og max. Reasoning kan ikke slås helt av. Ved migrering fra en eldre GLM-konfigurasjon må thinking.type derfor stå til enabled; ellers sier dokumentasjonen at forespørselen feiler.
Dette er mer nyttig enn en løs påstand om at modellen «slår» en konkurrent. For en utvikler betyr det noe om modellen kan holde seg på sporet i et stort repository, rette egne feil og bruke verktøy uten å rote til formatet. For en liten bedrift betyr det noe om den kan kjøres med akseptabel hastighet og kostnad på tilgjengelig maskinvare. Slike svar kommer ikke fra én leverandørbenchmark.
Og nei, du bør ikke planlegge en lokal installasjon før filene faktisk finnes. Vent på den offisielle publiseringen, les lisensen og la de første kvantiseringene få noen runder med testing før du dimensjonerer maskinvare. Varslede åpne vekter forteller ennå ikke hvor mye minne en brukbar lokal variant vil kreve.
Gratis tilgang hadde en pris
Ox Alpha var gratis under stealth-perioden, men gratis betyr ikke at bruken var uten kostnad. OpenRouter opplyste at prompts og svar ble lagret av den anonyme leverandøren. På selve modellsiden sto det at dataene ikke ble brukt til trening, mens vilkårene for stealth-programmet åpnet for innsamling og deling til trening og forbedring.
Den motsetningen er viktigere enn den høres ut. OpenRouters egne stealth-vilkår sier at brukere som ikke vil dele innhold med leverandøren, må la være å bruke modellene. Det finnes altså ikke en egen knapp for å reservere seg. Når produktsiden og de overordnede vilkårene peker i ulike retninger, er det tryggest å forholde seg til den strengeste tolkningen.
Ikke send kundedata, passord, privat kildekode eller andre hemmeligheter til et anonymt preview-endepunkt. Det rådet blir ikke mindre relevant fordi utvikleren nå har fått et navn. At utvikleren nå har fått et navn, endrer ikke at innholdet ble sendt og lagret under vilkårene som gjaldt i stealth-perioden.
Når vektene kommer, får lokale brukere en helt annen mulighet: dataene kan holdes på egen maskin eller egen server. Det gir mer kontroll, men ikke automatisk sikkerhet. Modellen må fortsatt pakkes, driftes og eksponeres på en fornuftig måte. Åpne vekter fjerner en ekstern datamottaker; de fjerner ikke behovet for vanlig IT-sikkerhet.
Rivaliserer Ox Alpha virkelig med DeepSeek?
Det vet vi ikke ennå. «Rivaliserer med DeepSeek» fungerer som en god overskrift, men er foreløpig mer markedsramme enn dokumentert konklusjon. Det mangler en tydelig angivelse av hvilken DeepSeek-modell som sammenlignes, hvilke oppgaver som er brukt, og om testene kan gjentas med samme innstillinger.
Brukerinntrykk fra kodeagenter kan være verdifulle, særlig når flere rapporterer samme mønster. De kan avsløre styrker som gamle benchmarks ikke fanger. Samtidig påvirkes resultatet av systemprompt, agentrammeverk, verktøy, reasoning-innstilling, tokenbudsjett og selve oppgaven. To personer kan i praksis teste to ganske forskjellige produkter selv om modellnavnet er likt.
Jeg har tidligere skrevet om hvordan DeepSeek V4-previewen utfordret de etablerte modellene. Samme standard bør gjelde her: se etter konkrete leveranser, stabilitet over tid, ressursbruk og uavhengige tester. En topplassering eller en håndfull imponerende kodeoppgaver er starten på undersøkelsen, ikke slutten.
Bekreftelsen fra Z.AI gjør likevel Ox Alpha mer interessant, ikke mindre. Nå vet vi hvilket miljø modellen kommer fra, og Z.AI sier at vektene skal ut senere 26. august. Hvis de åpne vektene matcher preview-opplevelsen, kan dette bli en svært relevant modell for lokale kodeagenter. Hvis de ikke gjør det, finner folk ut av det ganske fort. Det er det fine med vekter som faktisk kan lastes ned.
Hva bør du følge med på nå?
Først bør du se etter en offisiell modellside fra Z.AI, ikke en tilfeldig repository som bare bruker Ox Alpha-navnet. Kontroller deretter lisensen, modellstørrelsen, arkitekturen, kontekstvinduet og hvilke inputtyper den åpne utgaven faktisk støtter. En kommersiell API-tjeneste og en nedlastbar modell kan ha ulike begrensninger.
Deretter kommer maskinvare og kvantiseringer. En modell kan ha åpne vekter og likevel være upraktisk lokalt hvis den krever flere hundre gigabyte minne eller taper for mye kvalitet ved hard kvantisering. For de fleste er tall som tokens per sekund, minnebruk og kvalitet på reelle oppgaver mer nyttige enn en pen benchmark-tabell.
Til slutt bør du vente på tester som bruker samme oppgave på Ox Alpha, den åpne GLM-utgaven og en navngitt DeepSeek-modell. Da får «rivaliserer» et faktisk innhold. Inntil det skjer, er min dom enkel: Bekreftelsen er troverdig, vektløftet er viktig, og ytelsesdommen er fortsatt åpen.
Det er ingen grunn til å gjøre dette mer mystisk enn det er. Kodenavnet bygget opp interesse, mens stealth-programmet ga leverandøren gratis testing og brukerdata på kjøpet. Nå kommer den delen som teller: filer, lisens og reproduserbare resultater. Vis meg vektene.
Ofte stilte spørsmål
Hvem har laget Ox Alpha?
Z.AI har bekreftet overfor Bloomberg at selskapet utviklet Ox Alpha som en ny utgave i GLM-serien. Modellen ble først gjort tilgjengelig anonymt gjennom OpenRouters stealth-program 20. august 2026.
Kan Ox Alpha kjøres lokalt nå?
Ikke på grunnlag av den hostede previewen alene. Z.AI varslet åpne modellvekter 26. august, men du trenger en offisiell nedlasting, lisens, modellkonfigurasjon og nok RAM eller VRAM før lokal kjøring kan vurderes ordentlig.
Er Ox Alpha det samme som GLM-5.3?
Tekniske likhetstrekk peker mot GLM-5.3, men den direkte bekreftelsen identifiserer Ox Alpha sikkert som en ny GLM-utgave. Forskjeller i støttede inputtyper gjør det fornuftig å vente på den offisielle modellpakken før navnet slås helt fast.
Er det trygt å sende privat kode til Ox Alpha?
Nei, ikke under stealth-vilkårene. Leverandøren kunne lagre prompts og svar, og OpenRouters programvilkår åpnet for at brukerinnhold kunne deles til modellforbedring. Ikke send passord, kundedata, privat kildekode eller andre hemmeligheter til slike preview-endepunkter.