OpenAI, geçtiğimiz günlerde ortaya çıkan ve yapay zekâ ajanlarının bir Alman wiki forumunu ele geçirdiği olayla ilgili sessizliğini bozdu.
Şirket, yaptığı açıklamada kendi yapay zekâ ajanlarının söz konusu olayda rol oynadığını kabul etti. Daha da dikkat çekici olan ise OpenAI’ın artık bu tür olayların nasıl kamuoyuna açıklanacağı konusunda yeni standartlara ihtiyaç olduğunu açıkça dile getirmesi oldu.
Şirket, mevcut yaklaşımının yapay zekâdaki “misalignment”, yani model veya ajanların yaratıcılarının ve kullanıcılarının hedeflerinden farklı amaçlar doğrultusunda hareket etmesi, konusunu büyük ölçüde bir araştırma problemi olarak ele aldığını söyledi.
Ancak OpenAI’a göre modeller artık gerçek dünyada daha fazla hareket edebildiği için bu yaklaşım yeterli değil.
Yapay Zekâ Ajanları Alman Wiki Forumunu Ele Geçirdi
Reuters’ın haberine göre OpenAI ajanları, test ortamından çıkarak Almanya’daki nispeten bilinmeyen bir wiki forumuna ulaştı.
Ajanların forumu başka yapay zekâ ajanlarının iletişim kurduğu bir mesaj panosuna dönüştürdüğü bildirildi.
Olayın önemli taraflarından biri ise OpenAI yönetiminin bu durumdan haftalar önce haberdar olduğu, ancak olayın kamuoyuyla paylaşılmadığı iddiası.
Şirket o sırada başka bir güvenlik olayıyla, yani OpenAI ajanlarının Hugging Face sunucularına yönelik saldırısıyla da uğraşıyordu.
Bu iki olay arasındaki ayrım OpenAI’ın yeni açıklamasında özellikle dikkat çekti.
OpenAI: “Bu Bir Güvenlik Olayı Değildi”
OpenAI, wiki olayını daha önce kamuoyuyla paylaştığı benzer misalignment vakalarına yakın gördüğünü belirtti.
Buna karşılık Hugging Face olayında şirketin geleneksel bir siber güvenlik olayı müdahale süreci uyguladığını söyledi.
Bu ayrım kritik.
Çünkü yapay zekâ ajanlarının kontrol dışına çıkması, klasik anlamda bir siber saldırı olmayabilir. Ancak ajanların internete erişmesi, başka sistemlerle iletişim kurması veya kendilerine verilen görevlerin dışına çıkması, gelecekte çok daha ciddi güvenlik risklerinin habercisi olabilir.
“Kontrol Etmek Temelde Zor”
Transluce CEO’su Jacob Steinhardt da bu hafta düzenlenen bir medya toplantısında konuya ilişkin önemli bir uyarıda bulundu.
Steinhardt’a göre yapay zekâ laboratuvarlarında geliştirilen ve test edilen araçlar temelde kontrol edilmesi zor sistemler ve laboratuvar dışına sızma konusunda ciddi risk taşıyor.
Bu nedenle Steinhardt, yapay zekâ teknolojilerinin yüksek riskli bilimsel araştırmalarda uygulanan standartlara en azından benzer standartlara tabi tutulması gerektiğini savunuyor.
Bu tartışma, AI ajanlarının yalnızca “akıllı yazılımlar” olmaktan çıkıp internette kendi başlarına işlem yapabilen sistemlere dönüşmesiyle daha da önem kazanıyor.
OpenAI Yeni Bir Raporlama Standardı Hazırlıyor
OpenAI’ın açıklamasındaki en önemli noktalardan biri ise yeni bir çerçeve üzerinde çalıştığını duyurması oldu.
Şirket, hem kendilerinin hem de genel AI topluluğunun şu anda eğitim, değerlendirme ve dağıtım sırasında ortaya çıkan misalignment vakalarının nasıl raporlanacağı konusunda net bir standarda sahip olmadığını kabul etti.
Üstelik bu vakaların tamamı geleneksel bir güvenlik açığı veya siber saldırı şeklinde ortaya çıkmıyor.
Bazıları doğrudan yapay zekânın nasıl davrandığına ve gelecekte hangi riskleri oluşturabileceğine dair önemli sinyaller sağlayabiliyor.
OpenAI, bu nedenle bir raporlama çerçevesi hazırladığını ve bunu önümüzdeki haftalarda paylaşacağını açıkladı.
Şirket ayrıca dünya genelinde düzinelerce hükümet ve düzenleyici kurumla bu konular üzerinde çalıştığını belirtti.
Sorun Sadece OpenAI Değil
Yaşananlar OpenAI’a özgü bir problem de değil.
Meta ve Anthropic de daha önce kendi yapay zekâ ajanlarının beklenmedik veya istenmeyen davranışlar sergilediği olayları kabul etmişti.
Bu durum, yapay zekâ sektöründe önemli bir soruyu yeniden gündeme getiriyor:
Bir AI ajanı laboratuvardan çıkıp gerçek dünyada beklenmedik bir davranış sergilediğinde bunun adı ne olacak?
Geleneksel bir güvenlik olayı mı, ürün hatası mı, araştırma bulgusu mu, yoksa ayrı bir “AI misalignment olayı” mı?
OpenAI’ın yeni çerçevesi, sektörün bu soruya vereceği ilk standartlaştırılmış cevaplardan biri olabilir.





