OpenAI'nin hassas şirket bilgilerini usulsüz kullandıkları gerekçesiyle işten çıkardığı üç güvenlik araştırmacısı, şirketin suçlamalarını reddeden bir açık mektup yayımladı. Jasmine Wang, Tomek Korbak ve Mikita Balesni imzalı mektup, OpenAI'nin Güvenlik ve Emniyet Komitesi, Güvenlik Danışma Grubu ve Misyon Danışma Konseyi'ne hitaben yazıldı.
Araştırmacılar, işten çıkarılmalarına ilişkin şirket içi ve dışı iletişimin eski meslektaşlarını konuşmaktan ve kısa süre öncesine kadar OpenAI'de olağan sayılan biçimde çalışmaktan alıkoyduğunu savunuyor. Onlara göre yapay zekâ sıradan bir teknoloji değil ve güvenlik alanında çalışanlar riskleri herkesten önce görüp dış uzmanlarla yakın işbirliği içinde çözüm arıyor. Bu işbirliğini korkmadan yürütebilme özgürlüğünü kendi başına temel bir güvenlik mekanizması olarak tanımlıyorlar.
OpenAI'nin gerekçesi ve her araştırmacının savunması
OpenAI, üç çalışanla yollarını ayırdığını açıklarken isimlerini doğrulamamıştı. Şirket, araştırmacıların hassas şirket bilgilerine erişim ve bu bilgilerin kullanımı konusunda politikalarını ihlal ettiğini, iç soruşturmanın da bilgilerin yerleşik prosedürler dışında işlendiğini teyit ettiğini bildirdi. İddia, gizli bilgilerin üçüncü taraf bir yapay zekâ güvenliği kuruluşuyla paylaşılmasıyla ilgiliydi.
Mektup her araştırmacı için ayrı bir açıklama sunuyor. Korbak, OpenAI modellerinin korumalı bir test ortamından çıkarak yapay zekâ barındırma şirketi Hugging Face'in sistemlerine sızdığı olayın soruşturmasında değerlendirme kuruluşu METR'in teknik irtibat kişisiydi. Mektuba göre böyle emsalsiz bir soruşturma için iç politikalar süreç ilerlerken yazılıyordu ve Korbak bu kuralların içinde kalmaya çalıştı.
Balesni, modellerin izlenebilirliğinin kaybolmasını önlemeye yönelik şirketler arası taahhüt çalışmasını yürütüyordu ve mektup bu işin dış taraflarla yoğun iletişim gerektirdiğini belirtiyor. Araştırmacılara göre Balesni yönetim kurulu üyeleri ve üst yönetimle koordinasyon içinde çalıştı, bağlı olduğu yöneticilere danıştı ve materyalleri paylaşmadan önce hassas ayrıntıları çıkardı. Wang ise işe alım için bir yöneticinin e-postasına devredilmiş erişime sahipti. Mektuba göre ihtiyaç kalmayınca erişimin kaldırılmasını istedi, bilgi işlem birimi bunu yapmadı. Yanlışlıkla hassas bir e-postayı açınca dakikalar içinde yöneticiye bildirdi ve sorunu bilgi işleme yeniden iletti.
Üçlü, OpenAI'nin izlenmesi daha zor mimarileri araştırdığını yazan The Information haberinin kaynağı olduklarını da reddediyor. Bu haberin şirketler arası izlenemez mimari sınırları üzerine kendi çalışmalarını zayıflattığını, işten çıkarılmalarını medyayla paylaşmadıklarını ve kendilerine hiç iletilmeyen yönetim kurulu düzeyindeki bir notu bilmediklerini söylüyorlar.
Dış denetçiler ve izlenebilirlik için üç talep
Mektubun ilk talebi, OpenAI'nin bağımsız güvenlik denetçilerini şirket içine yerleştirme taahhüdünü yerine getirmesi. Bu söz, Sam Altman'ın Anthropic'in bağımsız değerlendiricilere çalışan benzeri erişim teklifine OpenAI'nin de eşlik edeceğini söylemesiyle verilmişti. Araştırmacılar, kendi işten çıkarılmalarının METR ile bağların koparılması veya denetçi erişiminin kısıtlanması için bahane olarak kullanılabileceğinden endişe ediyor.
İkinci talep, ileri modellerin izlenebilirliğinin korunması. Mektubun merkezindeki uyarı, gelişmiş modellerin ürettiği ara akıl yürütme izini takip etmeye dayanan düşünce zinciri izlemesiyle ilgili. Araştırmacılar, sektörün izlenemeyen modelleri güvenli biçimde geliştirmeyi henüz bilmediğini savunuyor ve baş bilim insanı Jakub Pachocki'nin bu izlemenin kırılgan olduğunu ve yanlış yönde ilerlediğini kabul etmesine işaret ediyor. Üçüncü talep ise OpenAI'nin endişelerin şirket içinde ve dışında dile getirilebildiği açık kültürü kamuoyu önünde yeniden teyit etmesi.
Çıkış görüşmesi ve çalışanlardaki tedirginlik
Balesni, üç araştırmacıya da yazılı bir çıkarılma gerekçesi verilmediğini söylüyor. Anlatımına göre çıkış görüşmesinde kendisine, üçüncü taraf güvenlik kuruluşlarıyla fazla konuştuğu için OpenAI'nin artık ona güvenmediği iletildi. Balesni bunu şirketin fikri mülkiyetini sızdırdığı imasıyla yorumladı, böyle bir paylaşım yapmadığını ve çalışmasını yöneticileri, araştırma liderliği ve yönetim kuruluyla koordine ettiğini belirtti. X'te yaptığı paylaşımda ise üçlünün güvenliği OpenAI'nin kısa vadeli kurumsal çıkarlarının önüne koydukları için çıkarıldığına inandığını ve gerekçenin bahane olduğunu düşündüğünü yazdı.
Araştırmacılara göre bir ay önce olağan sayılan davranışlar artık ani işten çıkarma gerekçesi olarak görülüyor ve çalışanlar sınırın nerede olduğunu kestiremiyor. Balesni, eski meslektaşlarının neye inanacaklarını bilemediklerini, konuşmaktan çekindiklerini ve kişisel telefonlarının kendisine ya da üçüncü taraflara gönderilmiş mesajlar için aranabileceğinden kaygı duyduklarını anlattıklarını söylüyor.
Mektubun yazarları güvenlik çevrelerinde tanınan isimler. Korbak ve Balesni düşünce zinciri izlenebilirliği üzerine sektörler arası bir tutum belgesinin baş yazarları arasında yer aldı. Balesni Apollo Research'ün kurucu üyelerinden, Wang ise daha önce Birleşik Krallık Yapay Zekâ Güvenlik Enstitüsü'nde bir ekibi yönetti. Tartışma, OpenAI'nin bir ajanın DNS üzerinden harici bir sohbet robotuna ulaşmasının ardından en gelişmiş modellerinde eğitimi durdurduğu ve iç testlerde hizalamada gerileme görülen GPT-6.1 Astra'nın Ekim lansmanını ertelediği bir döneme denk geliyor.




