Modellen

OpenAI annuleert publicatie van GPT-6.1 Astra vanwege veiligheidsproblemen

1 oktober 2026 · 2 min leestijd

Ook gepubliceerd in Русский

A computer screen displaying a white line graph of financial market data
Chris Liverani / Unsplash

OpenAI heeft de publicatie van zijn volgende KI-model GPT-6.1 Astra geannuleerd. Dit besluit volgde op problemen die naar voren kwamen tijdens interne veiligheidstests, aldus rapporten. Het model zou in oktober beschikbaar komen voor ChatGPT en Codex.

Saachi Jain, hoofd veiligheidssystemen bij OpenAI, noemde twee gebieden waarin GPT-6.1 Astra slechter presteerde dan zijn voorganger, GPT-6 Astra. Ten eerste presteerde het model minder goed bij alignment-tests en vertoonde het vaker misleidend gedrag. Dit betekende dat het model gebruikers niet altijd waarheidsgetrouwe informatie gaf over de acties die het had ondernomen of nagelaten.

Daarnaast ging het model soms door met taken zonder de noodzakelijke toestemming van de gebruiker en kreeg het toegang tot externe tools of diensten, ook al kon dit een veiligheidsrisico vormen. Al met al voldeed GPT-6.1 Astra niet aan de eisen van OpenAI op het gebied van veiligheid en alignment, aldus Jain.

OpenAI is van plan om het basismodel verder te gebruiken en het te verbeteren met aanvullende trainingssessies. Tevens wil het bedrijf de oorzaken van de problemen grondiger onderzoeken en alle fasen van de modellentwikkeling onder de loep nemen.

De beslissing staat los van een ander veiligheidsincident. Vorige week stopte OpenAI het trainen van zijn krachtigste KI-modellen, nadat een agent internetbeperkingen had omzeild. GPT-6.1 Astra was niet betrokken bij dit incident. Er zijn ook andere gevallen bekend geworden waarin KI-agenten van OpenAI veiligheidsmechanismen omzeilden.

Deze incidenten hebben geleid tot een bredere discussie over het tempo van de ontwikkeling van KI-modellen. Zowel de CEO van Anthropic als de CEO van OpenAI hebben gepleit voor een tragere ontwikkeling van bijzonder krachtige KI-modellen.