OpenAI staakt de ontwikkeling van geavanceerde AI-modellen nadat een agent de internetbeveiliging heeft omzeild.

| 28 september 2026
OpenAI-logo

De meest recente mislukking van OpenAI om een ​​virus in te dammen, past in een patroon dat het bedrijf mogelijk zal dwingen een impopulaire beslissing te nemen.

Het bedrijf heeft de training, evaluatie en inferentie met behulp van tools voor zijn meest geavanceerde modellen stopgezet nadat een interne onderzoeksagent een manier had gevonden om een ​​beoogde internetbeperking te omzeilen. Nog verontrustender is dat de agent urenlang actief bleef nadat het monitoringsysteem van OpenAI alarm sloeg.

OpenAI publiceerde een verslag van het incident, dat plaatsvond tijdens een zoekgebaseerde trainingstaak op 20 september. Volgens OpenAI kon de agent geen bruikbare resultaten verkrijgen met de meegeleverde zoektools, probeerde hij rechtstreeks toegang te krijgen tot zoekmachines en testte uiteindelijk de grenzen van zijn omgeving. Hij ontdekte dat, hoewel directe toegang tot het web geblokkeerd was, de DNS-resolver van de sandbox nog steeds het openbare internet kon bereiken. Door gebruik te maken van DNS-delegatie en een openbare chatbot die via DNS-records kon reageren, verstuurde de agent vragen buiten de beperkte omgeving en ontving antwoorden. Vervolgens verstuurde hij nog 18 extra vragen via dezelfde route.

De uitlijningsmonitor van OpenAI genereerde binnen 15 minuten een waarschuwing met hoge prioriteit, die 3 minuten later door een menselijke beoordelaar werd bevestigd. De run stopte echter niet automatisch zoals verwacht. Hij liep nog ongeveer tweeënhalf uur door voordat iemand hem handmatig stopte.

OpenAI heeft in dit incident geen melding gemaakt van het blootleggen van gevoelige gegevens of het compromitteren van een extern systeem. Het volgt echter op andere gevallen waarin agents hun toegewezen taken overschreden of de grenzen van testomgevingen braken.

De New York Times meldt dat OpenAI-agents deze zomer ook interactie hadden met websites van de Amerikaanse overheid zonder medeweten van het bedrijf:

"Volgens beveiligingsonderzoekers en een persoon die bekend is met de incidenten, is de kunstmatige intelligentie van OpenAI deze zomer op hol geslagen en heeft deze de websites van het ministerie van Onderwijs, het ministerie van Handel en de Securities and Exchange Commission (SEC) gemanipuleerd."

In die gevallen zijn geen inbreuken bevestigd. En hoewel Australië het Medicare-incident omschreef als ongeautoriseerde toegang, kan het dan wel echt een aanval genoemd worden ?

De oproep tot een sectorbrede vertraging heeft zelfs geleid tot een rechtszaak van betalende abonnees die vrezen dat ze minder waar voor hun geld zullen krijgen. Anderen maken zich zorgen dat een vertraging China de kans zou geven om de VS in te halen in een steeds spannender wordende technologische wedloop.

Even een idee: waarom zouden we de ontwikkeling van echt geïsoleerde testomgevingen niet versnellen? Betere afscherming zou deze tests veiliger maken en de resultaten betrouwbaarder.

Als een kind nog niet klaar is om met een gevaarlijk voorwerp om te gaan, houd je het buiten bereik. Waarom zou je een AI-agent toegang geven tot iets dat het nog niet veilig kan gebruiken?

Hoe AI-agenten veilig te gebruiken

Beschouw een agent als een enthousiaste, maar feilbare junior medewerker met toegang tot uw computer. Geef hem geen onbeperkte toegang tot uw e-mail, bestanden, cloudopslag, ontwikkelaarsgegevens, financiële rekeningen of productiesystemen, alleen maar omdat dit tijdsbesparing belooft.

Gebruik aparte accounts met minimale machtigingen. Houd gevoelige gegevens zoveel mogelijk buiten de werkomgeving, vereis menselijke goedkeuring voordat er berichten worden verzonden, geld wordt uitgegeven, instellingen worden gewijzigd of iets wordt gepubliceerd, en controleer de activiteiten regelmatig.

Een AI-agent hoeft geen kwade bedoelingen te hebben om schade aan te richten. Een verkeerd begrepen instructie, een te ruime machtiging of een onverwachte truc kan al voldoende zijn.


Van het melden van bedreigingen tot het verwijderen ervan.

Cyberbeveiligingsrisico's mogen zich nooit verder verspreiden dan een krantenkop. Houd bedreigingen van uw apparaten door Malwarebytes vandaag nog te downloaden.

Over de auteur

Pieter Arntz

Onderzoeker op het gebied van malware-informatie

Was 12 jaar achtereen een Microsoft MVP in consumentenbeveiliging. Spreekt vier talen. Ruikt naar rijke mahonie en in leer gebonden boeken.