Jan Sverre i en lydbevisst Dialog-RSN-1-samtale før taleagenten velger å svare

Dialog-RSN-1 lar taleagenten høre før den svarer

Dialog-RSN-1 tolker rå lyd, turtaking og verktøykall i én modell. PolyAI oppgir under 300 ms responstid, men tilgang og språkstøtte er foreløpig begrenset.
Jan Sverre viser NVIDIA Audex med lydanalyse og AI-modell i studio

NVIDIA Audex samler tale og lyd i én AI-modell

NVIDIA Audex samler talegjenkjenning, oversettelse, TTS og lydgenerering i én lyd-LLM – med åpne vekter, men ikke-kommersiell lisens for testing lokalt.
Jan Sverre lytter til GPT-Realtime-2 stemme-API på smartphone ved blåtime i Stavanger

GPT-Realtime-2: slik bruker du OpenAIs nye stemme-API

OpenAI lanserte tre nye modeller for Realtime API i mai 2026 – GPT-Realtime-2, GPT-Realtime-Translate og GPT-Realtime-Whisper. Her er hva de faktisk kan, hva de koster, og når du bør bruke hvilken.