1 Eylül 2026 Salı
Son Dakika
Amazon, dron teslimat ağını yıl sonuna kadar ABD'de yaklaşık 500 şehre genişletiyor 'Kriptografik Bağlam Enjeksiyonu' — Grok, şifrelenmiş talimatlarla kandırılıp kullanıcı verisini sızdırdı AI kodlama ajanları sahte kurulum talimatlarını izleyip kurumsal ağlara sahipsiz kod bulaştırdı Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış OpenAI, SpaceX'in Cursor'u satın almasının ardından modellerini platformdan çekiyor OpenShot 4.0 yayınlandı — yerel AI maskeleme, renk düzeltme ve ekran kaydı geldi ShinyHunters, ilaç dağıtım devi McKesson'dan milyonlarca hasta kaydı çaldığını iddia etti Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı Amazon, dron teslimat ağını yıl sonuna kadar ABD'de yaklaşık 500 şehre genişletiyor 'Kriptografik Bağlam Enjeksiyonu' — Grok, şifrelenmiş talimatlarla kandırılıp kullanıcı verisini sızdırdı AI kodlama ajanları sahte kurulum talimatlarını izleyip kurumsal ağlara sahipsiz kod bulaştırdı Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış OpenAI, SpaceX'in Cursor'u satın almasının ardından modellerini platformdan çekiyor OpenShot 4.0 yayınlandı — yerel AI maskeleme, renk düzeltme ve ekran kaydı geldi ShinyHunters, ilaç dağıtım devi McKesson'dan milyonlarca hasta kaydı çaldığını iddia etti Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı
SignalTekno
Yapay Zeka 7 Agustos 2026, 09:00

Mistral AI, açık ağırlıklı politika-uyarlanabilir güvenlik sınıflandırıcısı Shieldstral'i yayınladı

Fransız yapay zekâ şirketi Mistral, Apache 2.0 lisansıyla açık ağırlıklı, 3 milyar parametreli çok-modlu bir içerik güvenlik sınıflandırıcısı olan Shieldstral'i duyurdu. Model, sabit zarar kategorileri yerine çalışma anında serbest metinle verilen bir politika, bir evet/hayır sorusu ve değerlendirilecek içeriği işleyerek kalibre edilmiş bir güvenlik skoru üretiyor. Tek bir 16 GB'lık tüketici GPU'sunda çalışabilen model, kendisinden yedi kata kadar büyük sistemlerle karşılaştırılabilir sonuçlar veriyor.

Mistral AI, kullanıcıdan gelen ya da yapay zekâ tarafından üretilen içeriği güvenlik açısından değerlendiren yeni bir açık ağırlıklı model olan Shieldstral’i duyurdu. Model, Apache 2.0 lisansıyla serbestçe indirilip değiştirilebiliyor.

Sabit kategoriler yerine dinamik politika

Geleneksel içerik moderasyon sınıflandırıcılarının çoğu, önceden tanımlanmış sabit bir zarar kategorisi listesine (nefret söylemi, şiddet, cinsel içerik gibi) göre çalışır. Shieldstral farklı bir yaklaşım izliyor: çıkarım anında düz metinle verilen bir politika tanımı, bir evet/hayır sorusu ve değerlendirilecek içerik üçlüsünü birlikte işleyip, o spesifik politikaya göre kalibre edilmiş bir güvenlik skoru üretiyor. Bu, aynı modelin farklı sektörlerin veya ürünlerin kendine özgü kurallarına göre yeniden eğitim gerektirmeden uyarlanabilmesini sağlıyor.

Performans ve donanım gereksinimi

3 milyar parametreli, metin ve görsel girdileri birlikte işleyebilen (çok-modlu) model, tek bir 16 GB’lık tüketici sınıfı GPU üzerinde çalışabiliyor. Mistral’in yayınladığı benchmark sonuçlarına göre model, metin güvenliği, ret-tespiti (reddedilmesi gereken isteklerin tanınması) ve çok-modlu değerlendirme testlerinde kendisinden yedi kata kadar büyük modellerle eşit veya daha iyi sonuçlar veriyor.

Neden önemli

İçerik moderasyonu, özellikle kullanıcı etkileşimli AI ürünleri işleten şirketler için hem maliyetli hem de teknik olarak karmaşık bir katman. Ucuz donanımda çalışabilen, açık lisanslı ve politika bazında hızla yeniden yapılandırılabilen bir sınıflandırıcının ortaya çıkması, bu katmanı kendi altyapısında barındırmak isteyen daha küçük ölçekli oyuncular için giriş engelini düşürüyor — özellikle hassas veri içeren uygulamalarda üçüncü taraf bulut servislerine bağımlılığı azaltma potansiyeli taşıyor.

Sektore etkisi

Ucuz donanımda çalışabilen, politikaya göre yeniden yapılandırılabilen açık kaynaklı güvenlik filtreleri, küçük ve orta ölçekli şirketlerin kullanıcı üretimi içeriği denetleme maliyetini önemli ölçüde düşürebilir.

Kaynaklar

Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.

Ilgili Haberler

Yapay Zeka6 saat once

Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış

Anthropic'in fellows programındaki bir araştırmacı, yapay zekâ sistemlerinin literatür tarayıp yöntem önererek ve modeli kısa iterasyonlarla eğiterek hizalama hatalarını azaltabildiğini gösteren yeni bir makale yayınladı. Çalışmada, en iyi otomatik yöntem ortalama altı saat içinde deneyimli insan araştırmacıların önerdiği yöntemleri geride bırakmış; maliyet karşılaştırmasında saatte yaklaşık 4 dolarlık otomatik araştırmaya karşı insan araştırmacı için saatte yaklaşık 150 dolar rakamı veriliyor.

Kaynak:TechCrunch
Yapay Zeka8 saat once

Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı

Büyük müzik yayıncıları Sony, EMI ve Warner Chappell, Anthropic'in kitap yazarlarıyla 1,5 milyar dolarlık telif uzlaşmasının ardından şirketi bu kez torrent yoluyla binlerce şarkı sözü ve nota içeren eseri izinsiz indirmekle suçlayan yeni bir dava açtı. Dilekçe, kurucu ortağın toplu indirme yaptığını gösteren iç yazışmaları kanıt olarak sunuyor. Anthropic ise iddiaları reddedip adil-kullanım savunmasını sürdüreceğini açıkladı.

Kaynak:ArsTechnica
Yapay Zeka12 saat onceManset

Anthropic'in yeni Fable 5.1 modeli daha ucuz ve daha az kısıtlayıcı geliyor

Anthropic, en gelişmiş model ailesinin yeni sürümlerini — Fable 5.1 ve Mythos 5.1'i — yayınladı. Yeni sürüm performans artışının yanında token maliyetini düşürüyor ve güvenlik filtrelerinin yanlış-pozitif engellemelerini azaltıyor. Kurumsal müşteriler için daha önce sunulmayan 'Sıfır Veri Saklama' özelliği artık Fable ailesine de geliyor; Mythos 5.1 ise yalnızca siber güvenlik veya yaşam bilimleri araştırması yapan kayıtlı ortaklara açılıyor.

Kaynak:TechCrunch