GPT-Live verandert hoe je met ChatGPT praat: het model luistert en spreekt tegelijk, je kunt onderbreken, en complexe vragen worden op de achtergrond door GPT-5.5 beantwoord. OpenAI noemde het op X het slimste spraakmodel tot nu toe. Voor vibe coders en prompt-coaches betekent dat: spraak wordt een serieuze werkinterface — niet alleen een gimmick voor onderweg.
Wat is GPT-Live in één minuut?
- Full-duplex — geen turn-based wachten; onderbreken zoals bij een mens
- GPT-Live-1 (betaald) en GPT-Live-1 mini (gratis) vervangen Advanced Voice Mode
- Delegatie — zoeken en redeneren gaat naar GPT-5.5 terwijl het gesprek doorloopt
- Visuele kaarten tijdens het gesprek (weer, data, sport)
OpenAI ziet spraak als toekomstige primaire interface voor langdurig agentisch werk — vergelijkbaar met Codex, maar hands-free.
Waarom dit ertoe doet voor prompting
Tekst-prompts zijn gecontroleerd: je ziet wat je typte. Spraak is rommeliger — aarzelingen, halve zinnen, onderbrekingen. GPT-Live is gebouwd voor die realiteit. Dat verandert hoe je instructies geeft:
- Begin met context in één adem — “Ik zit in project X, Python, ik wil functie Y — wacht even, ik bedoel Z” — het model volgt mee
- Gebruik onderbreken als sturing — “stop, andere aanpak” werkt nu echt
- Vraag om zichtbare output — “laat me een kaart zien” triggert visuele cards
- Stel een stopregel — “Als je iets niet weet, zeg het hardop en zoek dan” past bij delegatie naar GPT-5.5
Test je gespreksopbouw eerst in tekst via de prompt-coach; spreek daarna dezelfde structuur in.
Sol vs Live: twee launches, één week
Donderdag kwam GPT-5.6 Sol voor developers (API/Codex). GPT-Live zit nu in ChatGPT voor consumenten. Als coach: leer klanten het verschil — Live voor gesprekken en uitleg, Sol voor code en agents zodra ze API-toegang hebben.
Companion is nu een hardwaredoel, geen relatiebelofte
Bloomberg-journalist Mark Gurman meldde op 14 juli 2026 dat OpenAI’s eerste apparaat een verplaatsbare speaker zonder scherm wordt. De gebruiker zou er een band mee moeten opbouwen als met een AI-companion. Dat is bronrapportage, geen productaankondiging van OpenAI.
Voor prompting verandert er wel iets. Als je niets terugleest, moet je opdracht zelf een controlelus bevatten:
- Context: “Ik werk aan project X. Gebruik alleen de planning van vandaag.”
- Opdracht: “Maak drie opties en kies er nog geen.”
- Teruglezing: “Herhaal wat je gaat doen en welke informatie je bewaart.”
- Stopregel: “Voer niets externs uit zonder mijn aparte ja.”
Een warme stem is geen toestemming. Geheugen, toolrechten en emotionele afhankelijkheid blijven aparte onderwerpen. Bij coaching zou ik voice voor werk en uitleg gebruiken, met schriftelijke controle voor bedragen, berichten, publicaties en andere acties die je niet makkelijk terugdraait.
Wat een schermloze interface van je prompt vraagt
| Risico | Zeg dit hardop |
|---|---|
| Verkeerde context | “Noem eerst welke context je gebruikt.” |
| Te snelle actie | “Maak een voorstel, voer nog niets uit.” |
| Onduidelijk geheugen | “Gebruik dit alleen in dit gesprek en onthoud het niet.” |
| Misverstaan commando | “Herhaal ontvanger, bedrag en actie vóór bevestiging.” |
Dat is minder soepel dan “regel het even”, maar veel bruikbaarder. Een goede voiceprompt maakt de ontbrekende visuele preview deels goed. Voor de laatste controle blijft een scherm of auditlog nodig.
Praktische use cases
| Taak | Voice-tip |
|---|---|
| Code-uitleg tijdens wandeling | Vraag om stap-voor-stap; onderbreek bij onduidelijkheid |
| Brainstorm feature | Laat het model “mhmm” doen terwijl jij nadenkt |
| Research met bronnen | Vraag expliciet om web search; wacht op visuele card |
| Prompt verbeteren | Lees je prompt hardop; vraag “wat mist hier?” |
