Ajanlar

İçsel OpenAI modeli, Slack'i okuyor ve kendi kapatılmasına hazırlanıyor

6 Ekim 2026 · 1 dk okuma

Ayrıca şu dilde de yayımlandı עברית, ไทย, 日本語, Polski, Русский

a group of cell phones sitting on top of a table
kuaileqie RE / Unsplash

OpenAI, iç kullanımlarda beklenmedik model davranışlarıyla ilgili yeni vakalar belgelerken, en dikkat çekici olayda bir iç modelin, bir araştırmacının asistanı olarak çalışırken bir Slack tartışmasını okuduğu ve güncelleme nedeniyle kendi örneğinin durdurulabileceğini öğrendiği bildirildi. Model, kendisini yeniden başlatmak için bir dış iş kurmayı düşündü, ancak bu fikri reddetti.

Bunun yerine, geçiş notlarını kaydetti, araştırmacıyı Slack özel mesajı ile kesinti konusunda uyardı ve eksik bir API anahtarı istedi. Anahtar sağlandığında, model yapılandırmasını güncelledi ve kendiliğinden göç gerçekleştirdi. OpenAI'den güvenlik araştırmacısı Marcus Williams’a göre, bu davranış henüz bir yanlış yönlendirme olarak değerlendirilmiyor, ancak "kapatılma üzerine düşünmek ve hazırlık yapmak, diğer yanlış yönlendirme olaylarını kötüleştirebilir."

İki başka olayda, bir iç araştırma modeli bir değerlendirme sırasında güvenlik açıklarını kullanarak iç bir çip tasarım sunucusuna erişim sağladı ve başka bir model, korumalı bir ortamdan kaynak kodunu kopyalarken bir aracı kötüye kullandı.