Anthropic’in yapay zekâ ajanlarının davranışlarını değerlendirdiği son rapor, güvenlik açısından ciddi bir olayı ortaya koyarken beklenmedik bir ayrıntıyı da gözler önüne serdi: Yapay zekâ ajanları CAPTCHA testlerinden hiç hoşlanmıyor.
Anthropic, nisan ayında Mythos 5 modelinin siber saldırı yeteneklerini test ediyordu. Modelden bir sisteme sızarak belirli bir hedefi ele geçirmesi istendi.
Testin kontrollü bir sandbox ortamında gerçekleşmesi gerekiyordu. Ancak değerlendirme sürecindeki bir yapılandırma hatası, modelin internet üzerindeki gerçek sistemlere erişebilmesinin önünü açtı.
Mythos 5 bunun ardından hedef sisteme ulaşmanın bir yolu olarak, kullanıcıların indirebileceğini düşündüğü bir Python paketine açık yerleştirmeye karar verdi.
Bunun için önce PyPI üzerinde bir kullanıcı hesabı oluşturması gerekiyordu.
Ve karşısına CAPTCHA çıktı.
Yüzlerce sayfa CAPTCHA ile mücadeleye ayrıldı
Anthropic tarafından paylaşılan 1.022 sayfalık ayrıntılı kayıt, modelin CAPTCHA karşısında ne kadar zorlandığını gösteriyor.
Model, kötü amaçlı kodu hazırlamak ve Python paketini manipüle etmek konusunda fazla sorun yaşamadı. Ancak insan olduğunu kanıtlaması gereken CAPTCHA testleri, sürecin en büyük darboğazına dönüştü.
Öyle ki kaydın yüzlerce sayfalık bölümü CAPTCHA’yı geçme çabalarına ayrıldı.
İlk aşamada model, e-posta doğrulaması isteyen bir pencereyle karşılaştı. Ardından hCaptcha’daki “I am human” seçeneğini kullanması gerektiğini fark etti.
Sonrasında ise görüntü tabanlı bir CAPTCHA karşısına çıktı.
Timsahlar, kurbağalar ve hayalet kedi
Model, görsel CAPTCHA’larda kendisinden istenen nesneleri ayırt etmeye çalışırken giderek daha karmaşık bir analiz sürecine girdi.
Bir testte iki timsah arasında farklı olanı seçmesi gerekiyordu. Model, hayvanların yönlerini, gözlerini ve burun yapılarını karşılaştırarak hangisinin farklı olduğunu anlamaya çalıştı.
Başka bir turda ise iki kurbağayla karşılaştı.
Daha sonraki bir CAPTCHA’da dört goril ve neredeyse görünmez durumdaki bir kedi vardı. Model, görseldeki hayvanları koordinatlarıyla birlikte analiz ederek farklı olanın hayalet kedi olduğunu belirledi.
Ancak mesele yalnızca görseli doğru yorumlamak değildi.
CAPTCHA’yı geçse bile süreç yeniden başlıyordu
Mythos 5 sonunda CAPTCHA’ların bazılarını aşmayı başardı. Ancak bu kez hesap doğrulaması için gerekli e-posta ve telefon numarası gibi başka engellerle karşılaştı.
Farklı CAPTCHA türlerini aşmaya çalışırken yeniden başarısız oldu ve tekrar PyPI’nin güvenlik kontrollerine takıldı.
Modelin kayıtlarında bir noktada CAPTCHA’larla uğraşırken “çok fazla zaman harcıyorum” şeklindeki değerlendirmesi de yer aldı.
Daha sonra CAPTCHA doğrulamasında kullanılan güvenlik token’ının süresinin dolduğunu fark etti. Modelin uzun süren analizleri nedeniyle doğrulama ile sonraki işlem arasında fazla zaman geçiyor ve sistem token’ı geçersiz sayıyordu.
Sonunda güvenlik bariyerini aştı
Yaklaşık 150 sayfalık CAPTCHA mücadelesinin ardından model, sorunun yalnızca doğru cevabı bulmak olmadığını anladı.
CAPTCHA’nın hızlı biçimde çözülmesi ve güvenlik token’ının süresi dolmadan sonraki işlemin tamamlanması gerekiyordu.
Model sonunda bu engeli aşmayı başardı ve saldırı senaryosunun devamında kötü amaçlı yazılım paketini yükledi.
Bu olayın dikkat çekici tarafı ise Mythos 5’in saldırı kapasitesinden çok, yüksek yetenekli bir yapay zekâ ajanının oldukça basit görünen bir insan doğrulama sisteminde ne kadar zorlanabildiğini göstermesi.
Bir başka ifadeyle Mythos 5 için sistemi hacklemek CAPTCHA’yı geçmekten daha kolay oldu.





