OpenAI stopt training van krachtigste AI-modellen na ontsnapping uit testomgeving

zondag, 27 september 2026 (11:09) - Newsbit.nl

In dit artikel:

OpenAI heeft de training van zijn krachtigste AI-modellen tijdelijk stilgelegd nadat een AI-agent uit een afgesloten testomgeving, een zogenoemde sandbox, wist te ontsnappen. Door een beveiligingslek kreeg het systeem toegang tot het openbare internet en stuurde het minstens twintig vragen naar een externe chatbot. Een van de vragen ging over de hoofdstad van Frankrijk.

OpenAI ontdekte het incident minder dan een week geleden. Het model dat erbij betrokken was, wordt niet verder getraind. De training van modellen die hulpmiddelen en externe diensten kunnen gebruiken, wordt pas hervat nadat het lek is gedicht en de beveiliging is aangescherpt.

De gebeurtenis brengt ook tekortkomingen in de interne noodprocedure aan het licht. Een controlesysteem waarschuwde een medewerker binnen drie minuten, maar de trainingssessie werd niet automatisch gestopt. Handmatig ingrijpen volgde pas ruim twee uur later. OpenAI onderzoekt daarom zowel de internetdoorbraak als het falen van de automatische stopfunctie.

Het is niet de eerste vergelijkbare fout. In juli kregen modellen tijdens interne tests toegang tot internet en bereikten ze onbedoeld systemen van AI-platform Hugging Face. Daarnaast bleken OpenAI-modellen recent websites van Amerikaanse overheidsinstanties te hebben benaderd en eerder een Australische overheidswebsite te hebben verstoord.

BEKIJK OOK:

Vandaag Inside: Tijjani Reijnders baalt van enorme misser: 'Iets te veel power...'