← Terug naar kennisbank
AI Nieuws
Nieuwe redeneertechniek van OpenAI zorgt voor onrust onder veiligheidsexperts
Nieuwe redeneertechniek van OpenAI zorgt voor onrust onder veiligheidsexperts
·
Leestijd: 3 min


OpenAI introduceert in zijn nieuwe model Astra een redeneertechniek die experts zorgen baart. De techniek heet recurrent depth, ook wel aangeduid als opaque recurrence (ongestructureerde of ondoorzichtige herhaling). Daardoor kan het model hetzelfde probleem meerdere keren intern herhalen in plaats van in overzichtelijke stappen te redeneren. Dat maakt het denkproces moeilijker te volgen en te controleren.
Wat is opaque recurrence precies?
Opaque recurrence betekent dat het model niet in één rechte reeks stappen werkt, maar een situatie meerdere keren doorloopt in een soort interne lus. Hierdoor ontstaan er minder duidelijke, leesbare tussenstappen die mensen kunnen bekijken.
Normaal levert een redeneerend model vaak een soort spoor van hoe het tot een antwoord kwam — korte, opeenvolgende denkstappen. Die stappen helpen onderzoekers en veiligheidsteams te zien of een model foutief of gevaarlijk redeneert. Bij opaque recurrence zijn die sporen minder overzichtelijk of verdwijnen ze deels.
Waarom maken experts zich zorgen?
De belangrijkste zorg is dat toezicht op het redeneerproces lastiger wordt. Daardoor kunnen problemen onopgemerkt blijven. Concreet noemen experts een paar punten van zorg:
Het wordt moeilijker om fouten of onbedoeld gedrag te ontdekken in het model.
Als de techniek sterker wordt toegepast, kan het model vrijwel volledig in interne, onzichtbare lagen gaan redeneren.
Dat maakt het lastiger om te verifiëren of het model veilig en betrouwbaar handelt.
Redwood Research-topman Buck Shlegeris liet na berichtgeving weten dat hij “zeer bezorgd” is over het gebruik van deze ondoorzichtige herhaling. Hij waarschuwde dat OpenAI, als het deze techniek verder oprekt, de mogelijkheid krijgt om de herhaling zó sterk te maken dat de normale, controleerbare denkstappen niet meer zichtbaar zijn.
Ook anderen binnen de veiligheidsgemeenschap, zoals Zvi Mowshowitz en Ryan Greenblatt van Redwood Research, signaleerden risico’s. Zij noemen het risico dat labs elkaar zouden voorbijstreven in het toepassen van deze methode — een “race to the bottom” waarin toezicht en transparantie onder druk komen te staan.
Reacties van OpenAI en de huidige situatie
Volgens berichten is het gebruik van opaque recurrence in Astra vooralsnog beperkt. OpenAI zegt dat de keten van redeneerstappen van het model nog leesbaar blijft en probeert afstand te nemen van het idee dat modellen volledig in een soort interne, ontoegankelijke taal zouden gaan werken.
OpenAI’s hoofdwetenschapper Jakub Pachocki benadrukte dat het bedrijf vanaf het begin heeft ingezet op het behouden en gebruiken van zichtbare denkstappen voor monitoring. OpenAI werkt volgens eigen zeggen ook aan uitgebreide systemen om die denkstappen in de gaten te houden als onderdeel van de veiligheidsplannen.
Toch wijzen experts erop dat alle moderne modellen altijd wel enigszins onzichtbaar redeneren. Het probleem met opaque recurrence is dat het deze onzichtbaarheid structureler kan maken en makkelijker op te schalen.
Daarnaast meldde vervolgberichtgeving dat ook andere grote labs, waaronder Anthropic en Google DeepMind, de techniek al bespreken. Dat vergroot de zorg: als meerdere partijen ermee experimenteren, neemt de kans toe dat de methode zich snel verspreidt.
Conclusie
De nieuwe redeneertechniek van OpenAI brengt een belangrijk veiligheidsvraagstuk naar voren. Enerzijds werkt OpenAI volgens eigen zeggen nog steeds aan manieren om denkstappen zichtbaar en controleerbaar te houden. Anderzijds vrezen diverse experts dat opaque recurrence het toezicht kan ondermijnen als de methode verder wordt uitgebouwd.
Voor wie met AI werkt of erover nadenkt: deze ontwikkeling laat zien waarom transparantie in hoe modellen redeneren belangrijk is. Zichtbare denkstappen blijven een van de belangrijkste middelen om te controleren of een model betrouwbaar en veilig handelt.