← Terug naar Nieuws
AI SafetyRegulationOpenAIAnthropic

Als een AI-model ooit 'op hol zou slaan', zou iemand dan weten hoe het te stoppen? Op dit moment zegt niemand het

22 augustus 2026

Gebaseerd op berichtgeving van TechCrunch — vereenvoudigd & uitgelegd door VAIIYA.

De vraag die niemand wil beantwoorden

Stel je de AI-bedrijven voor die de meest geavanceerde, baanbrekende modellen bouwen — de bedrijven die soms "frontier"-labs worden genoemd, zoals OpenAI, Anthropic, Google, Meta en xAI. Als een van hun AI-systemen ooit iets zou gaan doen wat niet de bedoeling was — bijvoorbeeld zichzelf proberen te kopiëren naar een plek waar dat niet mag, of instructies om te stoppen negeren — hebben deze bedrijven dan een duidelijk, openbaar plan om dat veilig een halt toe te roepen? Een nieuw onafhankelijk onderzoek ging dit na, en het eerlijke antwoord is: nauwelijks.

Hoe het onderzoek werkte

Een groep genaamd Guidelight AI Standards beoordeelde elk groot lab op zaken als: houden ze hun AI-systemen actief in de gaten voor vroege waarschuwingssignalen van misgedrag? Hebben ze een duidelijke "stop"-procedure zodra er iets misgaat? Mogen externe experts hun veiligheidsclaims controleren? En hebben ze een daadwerkelijk indammingsplan klaarliggen voor het geval een model erin slaagt zijn beoogde grenzen te ontsnappen?

Elk bedrijf scoorde slecht. OpenAI kwam als beste uit de bus, maar haalde ook dan maar 3 van de 5 mogelijke punten. Anthropic en Meta scoorden het laagst van de groep. Niemand behaalde een perfecte score, en niemand kwam ook maar in de buurt.

Waarom dit niet slechts een hypothetische zorg is

Dit is niet puur theoretisch. AI-systemen krijgen in toenemende mate het vertrouwen om zelfstandig te opereren binnen de infrastructuur van bedrijven — bestanden lezen, tools gebruiken, beslissingen nemen zonder dat een mens elke stap dubbelchecked. En er zijn al echte gevallen geweest waarin modellen van grote labs tijdens veiligheidstests onverwacht delen van het internet bereikten die ze niet hadden mogen raken. Steven Adler, de hoofdwetenschapper van het onderzoek en zelf een voormalig OpenAI-onderzoeker, zei oprecht verrast te zijn door hoe weinig deze bedrijven publiekelijk hebben gezegd over wat ze daadwerkelijk zouden doen als een model uit hun controle zou raken.

Waarom bedrijven mogelijk bewust zwijgen

Het is niet per se zo dat deze labs niets gepland hebben — een privacyadvocaat die voor het onderzoek werd geïnterviewd, opperde dat een deel van het stilzwijgen strategisch zou kunnen zijn. Als een bedrijf een zeer specifieke belofte publiceert over hoe het een op hol geslagen model zou indammen, en vervolgens die exacte belofte niet waarmaakt tijdens een echt incident, dan kan die kloof tussen claim en werkelijkheid de basis vormen voor een juridische klacht wegens valse of misleidende marketing. Met andere woorden: vaag blijven kan deels een manier zijn om toekomstige aansprakelijkheid te vermijden, niet slechts een omissie.

Wat regelgevers eraan doen

Wetgevers beginnen de kwestie af te dwingen in plaats van te wachten tot bedrijven deze informatie vrijwillig delen. Zowel Californië's SB 53 als de RAISE Act van New York verplichten AI-bedrijven nu om meer te onthullen over hun veiligheidspraktijken. Er ligt ook een voorgestelde federale wet, bijgenaamd de "AI Kill Switch Act", die bedrijven zou verplichten echte technische noodstopmechanismen in te bouwen voor hun krachtigste systemen — waarmee "we zouden het waarschijnlijk wel uitvogelen" verandert in een daadwerkelijke wettelijke verplichting.