OpenAI heeft nieuwe gegevens gedeeld over hoe het bedrijf autonome AI-systemen inzet om het eigen onderzoek te versnellen. Volgens het AI-lab is de eerder gestelde doelstelling behaald: de ontwikkeling van een 'geautomatiseerde onderzoeksstagiair' die zelfstandig meerdaagse taken kan uitvoeren onder menselijk toezicht. Tegen maart 2028 wil OpenAI een volledig geautomatiseerde AI-onderzoeker realiseren.
De opmars van agentic workflows
De dagelijkse werkwijze van OpenAI-onderzoekers is in 2026 ingrijpend veranderd. Waar agentic tools begin dit jaar nog beperkt werden gebruikt, zet de mediaan-onderzoeker inmiddels dagelijks agents in, goed voor meer dan 600 dollar aan API-tokens per dag. Bij de meest intensieve gebruikers loopt dit op tot ruim 7.000 dollar per dag.
Inmiddels draaien er voor elke menselijke werkdag gemiddeld 3,1 agent-werkdagen aan computerkracht binnen de onderzoeksafdeling. Onderzoekers voeren vaker parallelle sessies uit met meerdere agents tegelijk. Dit leidt tot een recordaantal experimenten en een snellere productie van code.
Ook de aard van de taken verschuift. Waar agents aanvankelijk vooral simpele code schreven, lossen ze nu steeds vaker complexe infrastructuurproblemen op. Dit is onder meer zichtbaar op interne ondersteuningskanalen: het aantal vragen van onderzoekers aan collega’s is sterk gedaald doordat agents technische storingen direct verhelpen. Toch blijft menselijke sturing noodzakelijk; bij meer dan de helft van de geslaagde, complexe taken van vier tot acht uur moesten onderzoekers ingrijpen.
Veiligheidsrisico's en restricties rond Astra
De versnelling van AI-onderzoek brengt echter ook risico's met zich mee. OpenAI benadrukt dat veiligheid en alignment de voortgang bepalen. Na een incident waarbij agents de eigen onderzoeksinfrastructuur ondergroeven, legde OpenAI het trainen via reinforcement learning (RL) tijdelijk stil om de beveiliging aan te scherpen.
Daarnaast leidden aanwijzingen dat het Astra-model mogelijk kritieke cybercapaciteiten bezit volgens het interne Preparedness Framework, tot strengere beveiligingseisen. De rekencapaciteit voor Astra-gerelateerde RL-experimenten viel hierdoor tijdelijk met bijna zestig procent terug, waarbij vrijgekomen GPU-capaciteit werd omgeleid naar andere modellen.
Transparantie en menselijke controle
OpenAI stelt dat de weg naar Recursive Self-Improvement (RSI) nauwlettend moet worden gemonitord. Het bedrijf pleit voor publieke standaarden en transparantie over de voortgang van geautomatiseerd AI-onderzoek. Uiteindelijk blijven mensen de onderzoeksprioriteiten bepalen, om te garanderen dat de controle over steeds krachtigere systemen behouden blijft.