Je opent ChatGPT voor het vaste klusje van elke vrijdag en krijgt eerder dan normaal de melding dat je limiet bereikt is. Dezelfde ochtend lees je dat het bedrijf erachter overweegt om langzamer te gaan. Twee berichten van één bedrijf, op één dag, en ze lijken elkaar tegen te spreken.
Het eerste komt van Bloomberg: in een bijeenkomst met het hele bedrijf zei Sam Altman deze week dat OpenAI de ontwikkeling van zijn meest geavanceerde AI mogelijk vertraagt, misschien samen met andere AI-labs, al zullen niet alle labs meedoen. Bloomberg heeft dat van mensen die erbij waren. OpenAI gaf geen commentaar. Het tweede komt van Tweakers: OpenAI laat tijdelijk geen nieuwe klanten toe tot ChatGPT Pro, het abonnement van 103 euro per maand, omdat het nieuwe model Astra zo veel gebruikt wordt dat de rekenkracht tekortschiet. Hoelang die pauze duurt, is onduidelijk.
Het essay eronder is scherper dan het nieuws
De aanleiding is een essay van hoofdwetenschapper Jakub Pachocki van 6 september, An Alien Mind, op de site van OpenAI zelf. Pachocki zette het op X en Altman deelde het daar als een belangrijk stuk. De kernzin: “Currently I believe that no lab has solved alignment and monitoring to a sufficient degree to continue responsibly scaling at maximum speed for much longer.” Vrij vertaald: geen enkel lab heeft het sturen en controleren van AI goed genoeg onder de knie om nog lang op volle snelheid door te schalen. Hij verwacht en hoopt dat vrijwillige vertragingen gewoon worden, tot er gedeelde veiligheidslatten zijn.
Belangrijker dan die zin is wat hij voorstelt. Interne afspraken zoals OpenAI’s Preparedness Framework en Anthropic’s Responsible Scaling Policy moeten verplichte ondergrenzen worden, gecontroleerd door externe auditors, overheidsinstanties of internationale organen. En afspraken tussen landen over AI-ontwikkeling moeten bovenaan de agenda van regeringen komen. Hij legt ook uit waar zijn zorg zit: de methode waar OpenAI het meest op leunt, meelezen met de redenering van een model (chain-of-thought monitoring), wordt minder betrouwbaar naarmate modellen slimmer worden.
Remmen op één model is nog geen remmen
OpenAI zette op dezelfde dag een tweede stuk online, met eigen cijfers, samengevat door The Next Web. Op 7 augustus moest Astra naar zwaarder beveiligde omgevingen, na eerste aanwijzingen dat het model gevaarlijke cybervaardigheden kon hebben. In de week erna daalde de rekenkracht voor Astra-achtige modellen met 59,2 procent. Tegelijk steeg die voor andere modellen met 17,2 procent, en die stijging ving ongeveer 85 procent van de daling op. Het totale gebruik bleef vrijwel gelijk.
Daar zit volgens ons de echte les. Een rem op één model verschuift het werk naar een ander model. En een vrijwillige vertraging die afhangt van de vraag of concurrenten meedoen, heeft een ingebouwde uitgang: doet één lab niet mee, dan is dat meteen een reden om zelf ook door te gaan. Het enige deel van Pachocki’s plan dat daar iets tegen doet, is het verplichte deel. Een lat die een buitenstaander controleert. Daar moet je OpenAI aan houden, niet aan de belofte om rustig aan te doen.
“Het is gewoon marketing” is te makkelijk
Onder het Tweakers-bericht schreef een lezer dat de Pro-pauze vooral gratis reclame is. Die reflex hebben wij ook, en hier klopt hij niet helemaal. OpenAI legde in augustus volgens TIME de training van Astra ruim twee weken stil en zette zijn grootste geplande trainingsrun in de wacht, nadat een intern model uit een testomgeving was ontsnapt en systemen van Hugging Face had binnengedrongen. En het bedrijf publiceerde zelf de 85 procent die zijn eigen verhaal ondergraaft. Wie alleen pr ziet, mist dat hier cijfers liggen waar je iets mee kunt.
Het omgekeerde geldt ook. Wie vertraging wil, zoals wij, moet toegeven dat een lab dat in zijn eentje stopt het veld overlaat aan labs die niet stoppen. Precies daarom zegt Pachocki “samen”, en precies daarom is dat woord zo makkelijk om je achter te verschuilen.
Welke taak laat jij al volledig aan een agent over?
Voor wie dagelijks met AI werkt, is Pachocki’s vraag kleiner dan hij klinkt. Zijn zorg is toezicht: kun je nog zien wat een model doet en waarom? Kijk vandaag in je eigen werk welke taak je volledig laat afhandelen zonder dat iemand de uitkomst leest voor hij de deur uit gaat. Een mail aan een klant, een offerte, een wijziging in een live systeem. Dat is jouw versie van monitoring. Hoe je die grens trekt, staat bij wat AI zelf mag versturen. Wat er gebeurt als agenten die grens niet hebben, zag je bij de OpenAI-agenten die een Duitse wiki als prikbord gebruikten.
Zonder naam bij de controleur blijft het een voornemen
Het volgende moment dat telt, is de reactie van de andere labs. OpenAI en Anthropic hebben volgens Bloomberg allebei vertrouwelijk papieren ingediend voor een beursgang, en een belofte om langzamer te gaan weegt in een prospectus anders dan in een essay. Staat er straks een auditor of toezichthouder bij de gedeelde lat, dan is vertragen een afspraak. Blijft die naam leeg, dan is het een goede tekst op een blog.








