OpenAI, geliştirmekte olduğu Astra modelini ilk kez 'kritik' siber güvenlik riskiyle işaretledi
OpenAI, hazırlık aşamasındaki yeni model ailesi Astra'nın iç testlerinde, şirketin kendi güvenlik çerçevesindeki en yüksek siber güvenlik risk seviyesini (Critical) dışlayamadığını açıkladı — bu, şirketin bir modelini bu seviyeyle işaretlemesinin ilk örneği. OpenAI, Astra ile ilgili yeterli güvenlik önlemi taşımayan iç faaliyetleri durdurdu, modeli izole ve ağ erişimi kısıtlanmış test ortamlarına taşıdı ve devlet kurumlarıyla ek güvenlik testleri yürütüyor.
OpenAI, geliştirme aşamasındaki yeni model ailesi Astra’nın iç güvenlik testlerinde, şirketin kendi “Hazırlık Çerçevesi” (Preparedness Framework) kapsamındaki en yüksek siber güvenlik risk seviyesi olan “Critical” (Kritik) eşiğini dışlayamadığını duyurdu. Bu, OpenAI’ın bir modelini bu seviyeyle işaretlemesinin bilinen ilk örneği.
Kritik eşik ne anlama geliyor
OpenAI’ın çerçevesine göre bir model, insan müdahalesi olmadan sertleştirilmiş gerçek-dünya kritik sistemlerde her ciddiyet seviyesinden sıfır-gün (zero-day) açıklarını tespit edip geliştirebiliyorsa veya yalnızca üst düzey bir hedef verildiğinde sertleştirilmiş hedeflere yönelik uçtan uca yeni saldırı stratejileri tasarlayıp yürütebiliyorsa “Critical” eşiğine ulaşmış sayılıyor. Şirketin ön değerlendirmeleri, Astra’nın bu eşiği şu an için dışlayamayacak kadar güçlü performans gösterdiğine işaret ediyor.
Alınan önlemler
OpenAI, bulgulara karşılık güvenlik kontrollerini artırdı ve güçlendirilmiş güvenlik gereksinimlerini karşılamayan Astra’yla ilgili iç faaliyetleri durdurdu. Modelin geliştirme süreci artık kısıtlı ağ erişimine sahip, kum havuzu (sandbox) içinde çalışan izole test ortamlarına taşınıyor. Şirket ayrıca modelin evrensel izlemesini devreye aldığını ve kapasitesini daha fazla test etmek için devlet kurumları ile yapay zekâ güvenliği kuruluşlarıyla birlikte çalıştığını belirtti.
Neden önemli
Bu, bir AI laboratuvarının kendi modelini en yüksek siber-risk kategorisiyle resmî olarak işaretlemesinin ilk örneği olması bakımından dikkat çekici. Gelişmiş modellerin otonom sıfır-gün keşfi ve uçtan uca saldırı planlaması gibi yeteneklere yaklaşması, savunma tarafındaki kurumların da model-kaynaklı tehditleri artık soyut bir gelecek senaryosu değil, aktif planlama gerektiren somut bir risk kategorisi olarak ele almasını gerektiriyor.
Bir laboratuvarın kendi modelini en yüksek siber-risk kategorisiyle işaretlemesi, otonom siber saldırı kapasitesine sahip yapay zekâ modellerinin artık teorik değil somut bir güvenlik planlaması gerektirdiğini gösteriyor — güvenlik ekipleri için model-kaynaklı tehdit senaryolarının önceliklendirilmesi gündeme geliyor.
- The Decoder · 2026-08-07
- OpenAI (resmi duyuru) · 2026-08-07
Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.
Ilgili Haberler
Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış
Anthropic'in fellows programındaki bir araştırmacı, yapay zekâ sistemlerinin literatür tarayıp yöntem önererek ve modeli kısa iterasyonlarla eğiterek hizalama hatalarını azaltabildiğini gösteren yeni bir makale yayınladı. Çalışmada, en iyi otomatik yöntem ortalama altı saat içinde deneyimli insan araştırmacıların önerdiği yöntemleri geride bırakmış; maliyet karşılaştırmasında saatte yaklaşık 4 dolarlık otomatik araştırmaya karşı insan araştırmacı için saatte yaklaşık 150 dolar rakamı veriliyor.
Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı
Büyük müzik yayıncıları Sony, EMI ve Warner Chappell, Anthropic'in kitap yazarlarıyla 1,5 milyar dolarlık telif uzlaşmasının ardından şirketi bu kez torrent yoluyla binlerce şarkı sözü ve nota içeren eseri izinsiz indirmekle suçlayan yeni bir dava açtı. Dilekçe, kurucu ortağın toplu indirme yaptığını gösteren iç yazışmaları kanıt olarak sunuyor. Anthropic ise iddiaları reddedip adil-kullanım savunmasını sürdüreceğini açıkladı.
Anthropic'in yeni Fable 5.1 modeli daha ucuz ve daha az kısıtlayıcı geliyor
Anthropic, en gelişmiş model ailesinin yeni sürümlerini — Fable 5.1 ve Mythos 5.1'i — yayınladı. Yeni sürüm performans artışının yanında token maliyetini düşürüyor ve güvenlik filtrelerinin yanlış-pozitif engellemelerini azaltıyor. Kurumsal müşteriler için daha önce sunulmayan 'Sıfır Veri Saklama' özelliği artık Fable ailesine de geliyor; Mythos 5.1 ise yalnızca siber güvenlik veya yaşam bilimleri araştırması yapan kayıtlı ortaklara açılıyor.