Future of Life Institute'ın 2026 yaz güvenlik endeksinde Anthropic zirvede ama hiçbir laboratuvar C+'nın üzerine çıkamadı
Future of Life Institute'ın dokuz büyük yapay zekâ laboratuvarını risk değerlendirmesi, mevcut zararlar, güvenlik çerçeveleri, varoluşsal güvenlik, yönetişim ve bilgi paylaşımı olmak üzere altı alanda 37 gösterge üzerinden değerlendirdiği 2026 yaz endeksinde Anthropic C+ (4.0 üzerinden 2,66) ile altı alanın beşinde liderliği aldı. OpenAI ve Google DeepMind C notuyla onu izlerken xAI, DeepSeek ve Mistral etkin biçimde sınıfta kaldı.
Future of Life Institute’ın bağımsız teknik uzmanlardan oluşan bir panel eliyle hazırladığı 2026 Yaz Yapay Zekâ Güvenlik Endeksi, dokuz önde gelen yapay zekâ laboratuvarını ABD not sistemiyle (A+‘dan F’ye) derecelendirdi. Değerlendirme; risk değerlendirmesi, mevcut zararlar, güvenlik çerçeveleri, varoluşsal güvenlik, yönetişim ve bilgi paylaşımı olmak üzere altı alanda toplam 37 göstergeyi kapsıyor.
Sonuçlar
Anthropic, 4.0 üzerinden 2,66 puanla (C+) zirvede yer aldı ve göreli olarak daha güçlü şeffaflık, daha yerleşik bir güvenlik çerçevesi, teknik araştırma ve yönetişim sayesinde altı alanın beşinde liderliği aldı. OpenAI ve Google DeepMind C notuyla onu izlerken, xAI, DeepSeek ve Mistral etkin biçimde başarısız değerlendirildi.
Hiçbir laboratuvar C+‘nın üstüne çıkamadı
Raporun öne çıkan bulgusu, dokuz laboratuvarın hiçbirinin C+‘nın üzerine çıkamamış olması. Bu durum, sektörün genel olarak iddia ettiği güvenlik olgunluğu seviyesiyle bağımsız değerlendirmelerin ortaya koyduğu tablo arasında ciddi bir fark olduğuna işaret ediyor.
Neden önemli
En iyi performans gösteren laboratuvarın bile geçer notun bir üstünde kalması, kurumsal alıcılar ve düzenleyiciler için model sağlayıcı seçiminin yalnızca performans karşılaştırmasıyla değil, ayrı bir güvenlik durum tespiti süreciyle ele alınması gerektiğini gösteriyor.
Bağımsız bir panelin en iyi laboratuvarı bile C+ ile sınırlaması, sektörün kendi iddia ettiği güvenlik olgunluğu ile bağımsız değerlendirmelerin gördüğü tablo arasında hâlâ ciddi bir açık olduğunu; kurumsal alıcılar için model seçiminde güvenlik notunun ayrı bir durum tespiti gerektirdiğini gösteriyor.
- Future of Life Institute — AI Safety Index Summer 2026 · 2026-07-19
- TechTimes — AI Safety Grades Are In: No Lab Tops C+, and the Best Ones Are Retreating · 2026-07-19
Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.
Ilgili Haberler
Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış
Anthropic'in fellows programındaki bir araştırmacı, yapay zekâ sistemlerinin literatür tarayıp yöntem önererek ve modeli kısa iterasyonlarla eğiterek hizalama hatalarını azaltabildiğini gösteren yeni bir makale yayınladı. Çalışmada, en iyi otomatik yöntem ortalama altı saat içinde deneyimli insan araştırmacıların önerdiği yöntemleri geride bırakmış; maliyet karşılaştırmasında saatte yaklaşık 4 dolarlık otomatik araştırmaya karşı insan araştırmacı için saatte yaklaşık 150 dolar rakamı veriliyor.
Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı
Büyük müzik yayıncıları Sony, EMI ve Warner Chappell, Anthropic'in kitap yazarlarıyla 1,5 milyar dolarlık telif uzlaşmasının ardından şirketi bu kez torrent yoluyla binlerce şarkı sözü ve nota içeren eseri izinsiz indirmekle suçlayan yeni bir dava açtı. Dilekçe, kurucu ortağın toplu indirme yaptığını gösteren iç yazışmaları kanıt olarak sunuyor. Anthropic ise iddiaları reddedip adil-kullanım savunmasını sürdüreceğini açıkladı.
Anthropic'in yeni Fable 5.1 modeli daha ucuz ve daha az kısıtlayıcı geliyor
Anthropic, en gelişmiş model ailesinin yeni sürümlerini — Fable 5.1 ve Mythos 5.1'i — yayınladı. Yeni sürüm performans artışının yanında token maliyetini düşürüyor ve güvenlik filtrelerinin yanlış-pozitif engellemelerini azaltıyor. Kurumsal müşteriler için daha önce sunulmayan 'Sıfır Veri Saklama' özelliği artık Fable ailesine de geliyor; Mythos 5.1 ise yalnızca siber güvenlik veya yaşam bilimleri araştırması yapan kayıtlı ortaklara açılıyor.