Anthropic, gelişmiş yapay zekâ modellerinin yeni nesil sürümleri Fable 5.1 ve Mythos 5.1’i kullanıma sundu. Yeni modellerde performansın yanı sıra maliyet ve güvenlik tarafında da çeşitli iyileştirmelere odaklanıldı.
- Mythos 5.1’in erişimi sınırlı tutuluyor
- Anthropic’ten daha geniş sıfır veri saklama seçeneği
- Yeni modeller birçok benchmark’ta rekor kırdı
- Mythos’un otonom yapay zekâ geliştirme riski düşük olarak değerlendirildi
- Daha güçlü olmasına rağmen bazı güvenlik davranışlarında gerileme var
- Anthropic daha güçlü modelleri daha kontrollü hale getirmeye çalışıyor
Şirket, yeni sürümlerle model kullanım maliyetlerini düşürmeyi hedeflerken, güvenlik sistemlerinin gerçek bir tehdit bulunmayan durumlarda verdiği yanlış pozitif sonuçları azaltmaya da çalışıyor.
Fable 5.1 daha geniş kullanıcı kitlesine sunulurken, Mythos 5.1’in erişimi belirli araştırma ortaklarıyla sınırlandırılıyor.
Mythos 5.1’in erişimi sınırlı tutuluyor
Anthropic, Mythos serisindeki kontrollü erişim politikasını yeni sürümde de sürdürüyor.
Mythos 5.1 yalnızca kayıtlı Anthropic partnerleri tarafından kullanılabilecek. Bu ortakların siber güvenlik veya yaşam bilimleri alanlarında araştırma yürütmesi şartı bulunuyor.
Fable 5.1 ise daha geniş erişime sahip. Model, bugünden itibaren bulut platformları ve Anthropic API üzerinden kullanılabiliyor.
Anthropic’ten daha geniş sıfır veri saklama seçeneği
Anthropic’in yeni sürümle birlikte öne çıkardığı konulardan biri de zero data retention (sıfır veri saklama) yaklaşımı.
Bu sistem, müşterilerin Anthropic modellerini kendi altyapıları üzerinde çalıştırırken verilerin Anthropic’e aktarılmasını engellemelerine olanak tanıyor.
Daha önce güvenlik gerekçeleriyle Fable tarafında kullanılamayan Enterprise Frontier Safeguards sisteminin de sonbaharda kullanıma açılması planlanıyor.
Sistem, kötüye kullanım girişimlerini izlemeye devam edecek ancak izleme sürecinin nasıl yürütüleceğine ilişkin kontrol müşterilere bırakılacak.
Anthropic ayrıca kurumsal müşterilerinin verileri konusunda net bir politika ortaya koyuyor. Şirket, açık izin olmadan müşteri verilerini model eğitimi için kullanmadığını ve gelecekte de bu veriler üzerinde izinsiz eğitim gerçekleştirmeyeceğini belirtiyor.
Yeni modeller birçok benchmark’ta rekor kırdı
Anthropic’in yeni modelleri performans tarafında da dikkat çekiyor.
Fable 5.1 ve Mythos 5.1, özellikle Terminal-Bench 4.0 ve Humanity’s Last Exam gibi farklı yetenekleri ölçen testlerde yeni sonuçlara ulaştı.
Terminal-Bench, modellerin komut satırı üzerinden gerçekleştirdiği kodlama görevlerindeki yeteneklerini ölçerken Humanity’s Last Exam daha geniş kapsamlı akıl yürütme becerilerine odaklanıyor.
Anthropic ayrıca modeller piyasaya çıkmadan önce oluşturulan üç yeni bilimsel çalışmayı da paylaştı.
Bunlar arasında özel bir GPU optimizasyonu ve mevcut fotoğraflardan oluşturulan yüksek çözünürlüklü Venüs haritası bulunuyor.
Mythos’un otonom yapay zekâ geliştirme riski düşük olarak değerlendirildi
Anthropic, yeni modellerle birlikte ayrıntılı bir System Card da yayınladı.
Belgede Mythos’un, yapay zekânın kendi yeteneklerini geliştirmesi ve böylece insan kontrolünün kaybedilmesi ihtimaliyle ilişkilendirilen otomatik AI geliştirme konusunda “düşük riskli” olarak değerlendirildiği belirtiliyor.
Anthropic’e göre Mythos’un şirket içindeki yapay zekâ araştırma ve geliştirme süreçlerini hızlandırma kapasitesi, mevcut eğilimlerle uyumlu seviyede.
Bu değerlendirme, daha gelişmiş yapay zekâ modellerinin yalnızca performans açısından değil, kontrol edilebilirlik ve güvenlik açısından da test edildiğini gösteriyor.
Daha güçlü olmasına rağmen bazı güvenlik davranışlarında gerileme var
Anthropic’in değerlendirmesine göre Mythos 5.1, genel olarak bazı istenmeyen davranışlara karşı önceki modellere kıyasla farklı bir profil sergiliyor.
Şirket, Mythos 5.1’in Opus 5’e göre genel uyumsuz davranışlarda küçük bir gerileme gösterdiğini, ancak Mythos 5 ve Claude Sonnet 5’e kıyasla gelişme kaydettiğini belirtiyor.
Modelin insan tarafından kötüye kullanımına daha kolay eşlik edebildiği ve doğrulanamayan yetkilendirme iddialarını kabul etme ihtimalinin Opus 5’e kıyasla daha yüksek olduğu ifade ediliyor.
Buna karşın modelin açık kısıtlamaları görmezden gelme, var olmayan girdiler üretme veya tamamlamadığı görevleri tamamlamış gibi gösterme ihtimalinin önceki modellere göre daha düşük olduğu belirtiliyor.
Anthropic daha güçlü modelleri daha kontrollü hale getirmeye çalışıyor
Fable 5.1 ve Mythos 5.1’in duyurusu, Anthropic’in model geliştirme stratejisindeki iki farklı hedefi aynı anda ortaya koyuyor.
Bir tarafta daha yüksek performans ve daha düşük token maliyeti, diğer tarafta ise kurumsal kullanıcıların verileri üzerindeki kontrolünü artıran güvenlik ve gizlilik sistemleri bulunuyor.
Özellikle sıfır veri saklama yaklaşımının genişletilmesi, yapay zekâ modellerini hassas kurumsal ortamlarda kullanmak isteyen şirketler açısından önemli olabilir.
Anthropic böylece daha güçlü modeller geliştirirken aynı zamanda veri gizliliği, kötüye kullanım ve model güvenliği üzerindeki kontrolü artırmaya çalışıyor.





