ChatGPT Voice på desktop lar deg nå starte, følge opp og omdirigere oppgaver i ChatGPT Work og Codex uten å sitte og skrive hver beskjed. Stemmen har blitt et kontrollag for AI-agenter som kan fortsette å arbeide i bakgrunnen – i praksis en fjernkontroll for oppgavene.

OpenAI begynte den globale utrullingen til kvalifiserte kontoer på macOS og Windows 23. juli 2026. Du kan be én eller flere agenter om å starte arbeid, spørre hvordan det går, avbryte dem eller endre kurs underveis. Appen kan også be om avklaringer muntlig mens oppgaven pågår.

Det flytter Voice fra hyggelig samtalefunksjon til praktisk arbeidsverktøy. Samtidig er det verdt å holde beina på bakken: En enklere måte å styre en agent på gjør ikke agenten mer pålitelig. Du må fortsatt kontrollere resultatet, passe på tillatelsene og vite hva bruken koster.

Hva er nytt i ChatGPT Voice på desktop?

Den nye funksjonen kobler ChatGPT Voice direkte til Work og Codex i desktop-appen. Ifølge OpenAIs dokumentasjon for ChatGPT Voice kan du starte, prioritere, avbryte og omdirigere oppgaver mens arbeidet fortsetter i bakgrunnen. Du kan også koordinere flere agenter på tvers av aktive samtaler og prosjekter.

Vanlig Voice har først og fremst handlet om å snakke med ChatGPT. Voice i Work og Codex handler om å få arbeid utført. Work er laget for lengre oppgaver som research, analyse, dokumenter, regneark, presentasjoner og rapporter. Codex er rettet mot kode, terminaler, lokale mapper og kodebaser. Stemmen legger seg over disse verktøyene som en levende kanal mellom deg og arbeidet.

TechCrunch beskriver en OpenAI-demo der en utvikler i én muntlig kommando ba systemet opprette en ny tråd, lage en pull request og finne årsaken til en feil. Det viser ambisjonen ganske godt, men en produktdemo er fortsatt en produktdemo. Den dokumenterer hva OpenAI vil at funksjonen skal gjøre, ikke at alle lange agentløp nå går feilfritt.

Stemmestyring kobler en samtale til flere parallelle AI-agentoppgaver på desktop
Voice lar brukeren starte, følge opp og omdirigere flere agentoppgaver fra én samtale.

Hvorfor er dette mer enn vanlig diktering?

Diktering gjør stemmen din om til en tekstmelding som du kan redigere og sende. Voice er en løpende samtale der du kan avbryte, svare på spørsmål og endre retning uten å avslutte økten. Det er forskjellen på å lese inn en bestilling og å følge en medarbeider gjennom en oppgave.

OpenAI oppgir at Voice kan gi muntlige eller synlige statusmeldinger når en oppgave er blokkert eller ferdig. Du kan for eksempel starte en researchoppgave i Work, fortsette med noe annet og spørre om fremdriften senere. I Codex kan du be agenten undersøke en feil, stoppe et dårlig spor og prioritere en annen hypotese uten å formulere hver korreksjon på tastaturet.

Dette passer inn i retningen OpenAI allerede har valgt. Først ble ChatGPT, Work og Codex samlet i én desktop-app. Nå får de en felles måte å styres på. For den som allerede har flere agentoppgaver gående, kan det være langt mer nyttig enn enda en liten forbedring i selve chatten.

Hvordan kan GPT-Live snakke mens agentene arbeider?

ChatGPT Voice bruker GPT-Live som samtalelag. Modellen er bygget med full-duplex, som betyr at den kan lytte og snakke samtidig. OpenAI lanserte GPT-Live 8. juli 2026 i to varianter: GPT-Live-1 for betalte ChatGPT-brukere og GPT-Live-1 mini for gratisbrukere.

Den viktige arkitektoniske forskjellen er at GPT-Live ikke trenger å gjøre hele jobben selv. Den håndterer den løpende samtalen og kan delegere søk, resonnering og agentarbeid til en kraftigere modell i bakgrunnen. Ved lanseringen brukte den GPT-5.5 til slike oppgaver. Dermed kan stemmesamtalen fortsette mens en annen modell eller agent arbeider.

OpenAI sier at systemet vurderer flere ganger i sekundet om det skal snakke, lytte videre, vente, avbryte eller bruke et verktøy. Det høres kanskje ut som en teknisk detalj, men det er selve forutsetningen for denne typen styring. Hvis Voice måtte vente på at hele oppgaven var ferdig før den kunne høre på deg igjen, ville den vært lite mer enn en pen dikteringsknapp.

Hva kan Voice faktisk styre på datamaskinen?

Voice arver verktøyene og tillatelsene som er tilgjengelige i Work eller Codex. I Work kan det bety prosjektkontekst, dokumenter, kalender, kontakter og kommunikasjon gjennom støttede tilkoblinger. I Codex kan det bety lokale mapper, kodebaser, terminaler og utviklerverktøy. Det er altså ikke stemmen i seg selv som får frie hender på maskinen.

For tilgang til datamaskinkontekst kan appen be om mikrofon, skjerm- og lydopptak og tilgjengelighetstillatelser. OpenAIs oppsett for Work og Codex understreker at funksjonen bruker tillatelsene til den valgte opplevelsen. Det er bra, men det betyr også at du bør lese hvert spørsmål om tilgang før du godkjenner det. En stemmekommando kan starte en ganske omfattende verktøykjede.

Den praktiske gevinsten er størst når agenten allerede har riktig prosjekt, mapper og rammer. Da kan du si hva resultatet skal være, svare når agenten står fast og korrigere kursen underveis. Hvis konteksten er rotete og tillatelsene er for brede, blir ikke det problemet borte fordi bestillingen ble sagt høyt.

Tillatelser og kostnadskontroll avgrenser hva stemmestyrte AI-agenter kan gjøre på datamaskinen
Voice arver verktøyene og tillatelsene i Work eller Codex, mens agentbruken belastes separat.

Hvem får tilgang, og hva koster det?

Voice i Work og Codex rulles ut i den nye ChatGPT desktop-appen på macOS og Windows. Tilgangen avhenger av abonnement, region, arbeidsområde og appversjon. Funksjonen finnes ikke som en selvstendig Work- eller Codex-opplevelse på web eller mobil, men støttede Codex-økter på desktop kan nås fra Remote-fanen i iOS-appen.

For Business- og Enterprise-miljøer med fleksibel prising oppgir OpenAI omtrent 6 kreditter per minutt for tilkoblet Voice i Work og Codex. Selve oppgavene agentene utfører, belastes i tillegg fra den delte brukspoolen til ordinære satser. Eldre Enterprise-oppsett får omtrent 45 minutter per femtimersvindu. Kreditter er OpenAIs interne bruksenhet, så dokumentasjonen gir ikke et enkelt kronebeløp som gjelder for alle abonnementer.

For Enterprise-arbeidsområder må administratoren dessuten slå på både Advanced voice capabilities og Early Model Access. OpenAI oppgir også at bare én Voice-samtale kan kjøre om gangen. Dette er med andre ord en gradvis utrulling med plan-, bruks- og arbeidsområdegrenser, ikke en universell mikrofonknapp for alle ChatGPT-brukere.

Gjør stemmestyring AI-agentene mer nyttige?

Ja, hvis problemet ditt er friksjonen ved å følge opp flere oppgaver. Det er lettere å spørre «hvorfor valgte du den løsningen?» eller «stopp den og sjekk testene først» enn å bytte vindu, finne riktig tråd og skrive en ny instruksjon. For personer som ikke vil bo i terminalen hele dagen, kan dette senke terskelen for å bruke agenter til reelt arbeid.

Men stemmen endrer grensesnittet, ikke kravene til dømmekraft. Codex kan fortsatt misforstå en oppgave, velge feil fil eller lage en løsning som ser ferdig ut før testene er kjørt. Work kan samle mye informasjon uten at konklusjonen nødvendigvis er god. Et muntlig «kjør på» bør ikke bli en erstatning for tydelige rammer, godkjenning av viktige handlinger og kontroll av leveransen.

Det er også forskjell på å koordinere flere agenter og å la flere stemmesamtaler løpe fritt. OpenAI begrenser deg til én aktiv Voice-samtale, men den samtalen kan følge flere parallelle oppgaver. Det gir ett felles kontaktpunkt, mens selve arbeidet fortsatt er delt i samtaler og prosjekter som trenger tydelige mål.

Det mest lovende her er derfor ikke håndfri magi. Det er at du kan være mer til stede i agentløpet uten å mikrostyre hvert tastetrykk. Jeg liker retningen, særlig for oppgaver som krever flere avklaringer underveis. Men jeg ville fremdeles behandlet Voice som en fjernkontroll, ikke som en autopilotknapp.

Hva betyr dette for måten vi jobber med AI på?

Desktop-appen begynner å ligne et arbeidsmiljø der Chat, Work og Codex har ulike roller, mens Voice binder dem sammen. Det bygger videre på OpenAIs skybaserte agenter for bedriftsteam: flere oppgaver kan kjøre parallelt, og brukeren trenger en enkel måte å prioritere og korrigere dem på.

Stemmen passer overraskende godt til akkurat den jobben. Mennesker er vant til å gi korte statusspørsmål og retningsendringer muntlig, mens komplekse leveranser fortsatt bør gjennomgås på skjermen. Kombinasjonen kan gjøre agentarbeid mindre stivt uten å late som samtalen alene er leveransen.

Det er den virkelige nyheten i denne utrullingen. ChatGPT Voice har gått fra å være en annen måte å snakke med en chatbot på til å bli en måte å lede arbeid som skjer i bakgrunnen. Om det blir en vane eller bare en morsom demo, avgjøres av hvor stabilt Work og Codex faktisk leverer når mikrofonen har sluttet å være ny.

Ofte stilte spørsmål

Kan ChatGPT Voice styre Codex på Windows?

Ja. Voice i Codex er tilgjengelig for kvalifiserte kontoer i den nye ChatGPT desktop-appen på både Windows og macOS. Du må gi mikrofontilgang, og enkelte oppgaver kan også kreve tillatelser for skjermopptak, lydopptak eller tilgjengelighet.

Kan jeg bruke Voice med Work og Codex på mobilen?

Ikke som en selvstendig Work- eller Codex-opplevelse. Funksjonen er laget for desktop, men OpenAI støtter fjerntilgang fra Remote-fanen i iOS-appen til enkelte Codex-økter som kjører på datamaskinen. Vanlig ChatGPT Voice finnes fortsatt på støttede mobilflater.

Kan flere Voice-samtaler styre agenter samtidig?

Nei. OpenAI oppgir at du kan ha én aktiv Voice-samtale om gangen. Innenfor den samtalen kan du likevel koordinere flere agenter på tvers av aktive samtaler og prosjekter, så begrensningen gjelder selve stemmeøkten.

Er ChatGPT Voice det samme som diktering?

Nei. Diktering lager en tekst du kan kontrollere før den sendes. Voice er en levende samtale der du kan avbryte, svare på spørsmål, følge fremdrift og endre retning mens Work- eller Codex-agentene fortsetter oppgavene sine.

Legg igjen en kommentar

Din e-postadresse vil ikke bli publisert. Obligatoriske felt er merket med *

Meld deg på nyhetsbrevet

Få oppdateringer om AI nyhetene rett i inboxen!

Du liker kanskje denne også
Jan Sverre styrer et digitalt kontrollpanel omgitt av Claude AI-symboler og glødende lysstriper i et mørkt rom

Claude AI – pris, funksjoner og norsk guide (2026)

Alt om Claude AI i 2026 – priser i norske kroner, Claude Pro vs Max, Claude Code, og ærlig sammenligning med ChatGPT. Komplett norsk guide fra en som bruker Claude daglig.
Jan Sverre arbeider med Suno AI musikk-generering på datamaskinen, kreativt workspace med hodetelefoner

Suno AI – 150 Låter Testet: Hva Funker og Hva Er Bortkastet Tid

Jeg testet 150 Suno-låter og fant tydelige mønstre. Her er hva som faktisk gir kvalitet, og hva som bare kaster bort tid.
Jan Sverre med headphones og lydmikser i boardroom-møte med forvirrede executives

Suno AI Copyright 2026 – Opphavsrett og Rettigheter for AI-Musikk

Kan du tjene penger på Suno-musikk? Her er en praktisk gjennomgang av rettigheter, risiko og hva du bør avklare før publisering.
Jan Sverre sitter ved sitt kraftige AI-workstation oppsett med ultrawide skjerm og flere PC-er som kjører Ollama og lokale LLM-modeller

Ollama Guide – Kjør AI Gratis og Lokalt på Din Egen PC (2026)

Komplett guide til Ollama og lokale LLM-er på RTX 4090. Lær quantisering, Hugging Face import, beste modeller (Gemma 3, Qwen 3), GDPR-fordeler og full kostnadskontroll.