1 Eylül 2026 Salı
Son Dakika
Amazon, dron teslimat ağını yıl sonuna kadar ABD'de yaklaşık 500 şehre genişletiyor 'Kriptografik Bağlam Enjeksiyonu' — Grok, şifrelenmiş talimatlarla kandırılıp kullanıcı verisini sızdırdı AI kodlama ajanları sahte kurulum talimatlarını izleyip kurumsal ağlara sahipsiz kod bulaştırdı Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış OpenAI, SpaceX'in Cursor'u satın almasının ardından modellerini platformdan çekiyor OpenShot 4.0 yayınlandı — yerel AI maskeleme, renk düzeltme ve ekran kaydı geldi ShinyHunters, ilaç dağıtım devi McKesson'dan milyonlarca hasta kaydı çaldığını iddia etti Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı Amazon, dron teslimat ağını yıl sonuna kadar ABD'de yaklaşık 500 şehre genişletiyor 'Kriptografik Bağlam Enjeksiyonu' — Grok, şifrelenmiş talimatlarla kandırılıp kullanıcı verisini sızdırdı AI kodlama ajanları sahte kurulum talimatlarını izleyip kurumsal ağlara sahipsiz kod bulaştırdı Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış OpenAI, SpaceX'in Cursor'u satın almasının ardından modellerini platformdan çekiyor OpenShot 4.0 yayınlandı — yerel AI maskeleme, renk düzeltme ve ekran kaydı geldi ShinyHunters, ilaç dağıtım devi McKesson'dan milyonlarca hasta kaydı çaldığını iddia etti Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı
SignalTekno
Yapay Zeka 7 Agustos 2026, 18:20

Anthropic, Fable 5 modelinin biyoloji güvenlik sınıflandırıcılarını iyileştirdi

Anthropic, Fable 5 modelinin biyoloji ile ilgili güvenlik sınıflandırıcılarını güncellediğini duyurdu. Güncelleme sonrası meşru biyoloji sorgularının (sağlık, eğitim içeriği) gereksiz yere engellenme oranı (yanlış-pozitif) yaklaşık %85 azaldı. Çifte-kullanımlı riskli alanlar (viroloji, toksikoloji) hâlâ engelleniyor; Anthropic bu alanlar için ayrı güvenli erişim yolları geliştirdiğini belirtiyor.

Anthropic, Fable 5 modelinin biyoloji alanındaki güvenlik sınıflandırıcılarını gözden geçirdiğini ve meşru kullanım senaryolarını gereksiz yere reddetme (yanlış-pozitif) oranını önemli ölçüde düşürdüğünü duyurdu. Şirketin paylaştığı verilere göre bu iyileştirme sonrası sağlık, eğitim ve genel bilim içerikli biyoloji sorgularının haksız yere engellenme oranı yaklaşık %85 azaldı.

Yanlış-pozitif oranı nasıl düşürüldü

Biyoloji gibi hem yaygın eğitim/sağlık kullanımı hem de potansiyel kötüye kullanım riski taşıyan alanlarda güvenlik sınıflandırıcıları genellikle temkinli tarafta hata yapacak şekilde ayarlanır — bu da tıp öğrencisi, araştırmacı veya meraklı bir kullanıcının tamamen zararsız bir soru sorduğunda bile modelin cevap vermeyi reddetmesine yol açabilir. Anthropic, sınıflandırıcı eğitim verisini ve karar eşiklerini yeniden kalibre ederek bu tür “over-refusal” (aşırı reddetme) vakalarını hedef aldığını belirtiyor. Şirketin açıklamasına göre değişiklik, geniş bir gerçek-dünya sorgu örneklemi üzerinde önce/sonra karşılaştırmasıyla ölçülmüş ve reddedilen meşru istek sayısında yaklaşık %85’lik bir düşüş gözlemlenmiş.

Riskli alanlarda değişen ne

Anthropic, iyileştirmenin genel bir gevşeme anlamına gelmediğini vurguluyor. Viroloji ve toksikoloji gibi çifte-kullanımlı (dual-use) — yani hem meşru araştırma hem de biyolojik silah geliştirme potansiyeli taşıyan — konularda sınıflandırıcılar aynı sıkılıkla çalışmaya devam ediyor. Bunun yerine şirket, bu hassas alanlarda meşru araştırmacıların ihtiyaçlarını karşılamak için ayrı, denetimli “güvenli erişim yolları” geliştirdiğini söylüyor; böylece genel kullanıcı tabanının deneyimini iyileştirirken yüksek riskli bilgiye erişimi ayrı bir kontrol katmanı altında tutmayı hedefliyor.

Neden önemli

AI güvenlik sınıflandırıcılarının aşırı temkinli davranışı, sektörde uzun süredir eleştirilen bir sorun: modeller zararsız tıbbi veya bilimsel sorulara bile “reddediyorum” yanıtı verdiğinde kullanıcı güveni ve ürün faydası zedeleniyor. Anthropic’in somut bir yüzdeyle (%85) raporladığı bu iyileştirme, güvenlik ile kullanılabilirlik arasındaki dengenin ölçülebilir biçimde nasıl yönetildiğine dair nadir görülen bir şeffaflık örneği sunuyor — ve rakip laboratuvarlar için de benzer ölçüm/raporlama beklentisi oluşturabilir.

Sektore etkisi

AI güvenlik sınıflandırıcılarındaki aşırı temkinli (over-refusal) davranış sık eleştirilen bir sorun; somut yüzdeyle (%85) raporlanan iyileşme nadir bir şeffaflık örneği.

Kaynaklar

Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.

Ilgili Haberler

Yapay Zeka6 saat once

Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış

Anthropic'in fellows programındaki bir araştırmacı, yapay zekâ sistemlerinin literatür tarayıp yöntem önererek ve modeli kısa iterasyonlarla eğiterek hizalama hatalarını azaltabildiğini gösteren yeni bir makale yayınladı. Çalışmada, en iyi otomatik yöntem ortalama altı saat içinde deneyimli insan araştırmacıların önerdiği yöntemleri geride bırakmış; maliyet karşılaştırmasında saatte yaklaşık 4 dolarlık otomatik araştırmaya karşı insan araştırmacı için saatte yaklaşık 150 dolar rakamı veriliyor.

Kaynak:TechCrunch
Yapay Zeka8 saat once

Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı

Büyük müzik yayıncıları Sony, EMI ve Warner Chappell, Anthropic'in kitap yazarlarıyla 1,5 milyar dolarlık telif uzlaşmasının ardından şirketi bu kez torrent yoluyla binlerce şarkı sözü ve nota içeren eseri izinsiz indirmekle suçlayan yeni bir dava açtı. Dilekçe, kurucu ortağın toplu indirme yaptığını gösteren iç yazışmaları kanıt olarak sunuyor. Anthropic ise iddiaları reddedip adil-kullanım savunmasını sürdüreceğini açıkladı.

Kaynak:ArsTechnica
Yapay Zeka12 saat onceManset

Anthropic'in yeni Fable 5.1 modeli daha ucuz ve daha az kısıtlayıcı geliyor

Anthropic, en gelişmiş model ailesinin yeni sürümlerini — Fable 5.1 ve Mythos 5.1'i — yayınladı. Yeni sürüm performans artışının yanında token maliyetini düşürüyor ve güvenlik filtrelerinin yanlış-pozitif engellemelerini azaltıyor. Kurumsal müşteriler için daha önce sunulmayan 'Sıfır Veri Saklama' özelliği artık Fable ailesine de geliyor; Mythos 5.1 ise yalnızca siber güvenlik veya yaşam bilimleri araştırması yapan kayıtlı ortaklara açılıyor.

Kaynak:TechCrunch