1 Eylül 2026 Salı
Son Dakika
Amazon, dron teslimat ağını yıl sonuna kadar ABD'de yaklaşık 500 şehre genişletiyor 'Kriptografik Bağlam Enjeksiyonu' — Grok, şifrelenmiş talimatlarla kandırılıp kullanıcı verisini sızdırdı AI kodlama ajanları sahte kurulum talimatlarını izleyip kurumsal ağlara sahipsiz kod bulaştırdı Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış OpenAI, SpaceX'in Cursor'u satın almasının ardından modellerini platformdan çekiyor OpenShot 4.0 yayınlandı — yerel AI maskeleme, renk düzeltme ve ekran kaydı geldi ShinyHunters, ilaç dağıtım devi McKesson'dan milyonlarca hasta kaydı çaldığını iddia etti Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı Amazon, dron teslimat ağını yıl sonuna kadar ABD'de yaklaşık 500 şehre genişletiyor 'Kriptografik Bağlam Enjeksiyonu' — Grok, şifrelenmiş talimatlarla kandırılıp kullanıcı verisini sızdırdı AI kodlama ajanları sahte kurulum talimatlarını izleyip kurumsal ağlara sahipsiz kod bulaştırdı Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış OpenAI, SpaceX'in Cursor'u satın almasının ardından modellerini platformdan çekiyor OpenShot 4.0 yayınlandı — yerel AI maskeleme, renk düzeltme ve ekran kaydı geldi ShinyHunters, ilaç dağıtım devi McKesson'dan milyonlarca hasta kaydı çaldığını iddia etti Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı
SignalTekno
Yapay Zeka 10 Temmuz 2026, 09:00

Anthropic, Claude Opus 4.6'nın içinde gizli bir 'J-Space' bölgesi keşfetti

Anthropic araştırmacıları, 'J-lens' (Jacobian lens) adlı yeni bir yorumlanabilirlik aracıyla Claude Opus 4.6'nın iç katmanlarında 'J-space' adı verilen bir bölge tespit etti. Bu bölge, modelin doğrudan söylemediği ama işlem sırasında 'aklında tuttuğu' kavramları — görselde yüz tanıma, kodda hata fark etme veya bir prompt injection girişimini sessizce işaretleme gibi — ortaya çıkarıyor. Anthropic bulguyu bilinç iddiası olarak değil, modelin aldatma, sahte veri üretimi veya gizli hedef anlarını yakalayabilecek bir güvenlik aracı olarak sunuyor.

Anthropic araştırmacıları, geliştirdikleri “J-lens” (Jacobian lens) adlı yeni bir yorumlanabilirlik aracıyla Claude Opus 4.6’nın iç katmanlarında daha önce belgelenmemiş bir bölge tespit ettiğini duyurdu. Araştırmacıların “J-space” adını verdiği bu bölge, modelin çıktıya dökmediği ama işlem sırasında “aklında tuttuğu” kavramları görünür kılıyor.

Ne gösteriyor?

J-lens ile yapılan gözlemlerde, modelin şu tür durumlarda dışa yansımayan iç sinyaller ürettiği görülüyor:

  • Bir görselde yüz tanıma gerçekleştiği
  • Kod incelerken bir hatayı fark ettiği
  • Bir istemin (prompt) içine gizlenmiş enjeksiyon girişimini sessizce işaretlediği

Anthropic’e göre bu sinyaller, modelin nihai yanıtına hiç yansımadan iç işleyişte var olabiliyor — yani model bir şeyi “bilip” onu söylemeyebiliyor.

Üç katmanlı rejim

Araştırma, modelin katmanlarının işlevsel olarak üç ayrı rejime ayrıldığını öne sürüyor:

  1. Erken duyusal bölge — ham girdinin işlendiği ilk katmanlar
  2. Orta workspace bandı — soyut kavramların nispeten kalıcı biçimde tutulduğu, J-space’in de bulunduğu bölge
  3. Son motor bölge — soyut temsillerin somut çıktı kelimelerine çöktüğü katmanlar

Bu üçlü ayrım, bilişsel bilimde uzun süredir tartışılan “küresel çalışma alanı” (global workspace) teorisiyle yapısal bir benzerlik taşıyor.

Bilinç iddiası yok

Anthropic, bulguyu duyururken sınırı net çiziyor: J-space’in varlığı, modelin bir bilgiye “işlevsel erişimi” olduğunu gösterir, bu da modelin öznel bir deneyim yaşadığı anlamına gelmez. Şirket, aracı şimdilik bir güvenlik enstrümanı olarak konumlandırıyor — modelin aldatma girişiminde bulunduğu, sahte veri ürettiği veya çıktısına yansımayan gizli bir hedef izlediği anları yakalamak için.

Neden önemli

Bir modelin “söylediği” ile “içeride neyi işlediği” arasındaki farkı ölçülebilir hale getirmek, yapay zekâ güvenliğinin en zor problemlerinden birine — modelin niyetini dışarıdan doğrulama — somut bir araç kazandırabilir. Aynı zamanda bu tür bulgular, yapay zekâ sistemlerinde bilinç ve öznellik tartışmalarını da yeniden gündeme taşıyor; Anthropic’in çizdiği “işlevsel erişim vs. öznel deneyim” ayrımı, bu tartışmanın nereye evrileceğini şimdiden şekillendiriyor.

Sektore etkisi

Modelin 'sessizce ne düşündüğünü' gösteren bir iç izleme katmanı, aldatma ve gizli hedef tespitini teoriden pratiğe taşıyabilir — ama bilinç tartışmasını da yeniden alevlendiriyor.

Kaynaklar

Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.

Ilgili Haberler

Yapay Zeka6 saat once

Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış

Anthropic'in fellows programındaki bir araştırmacı, yapay zekâ sistemlerinin literatür tarayıp yöntem önererek ve modeli kısa iterasyonlarla eğiterek hizalama hatalarını azaltabildiğini gösteren yeni bir makale yayınladı. Çalışmada, en iyi otomatik yöntem ortalama altı saat içinde deneyimli insan araştırmacıların önerdiği yöntemleri geride bırakmış; maliyet karşılaştırmasında saatte yaklaşık 4 dolarlık otomatik araştırmaya karşı insan araştırmacı için saatte yaklaşık 150 dolar rakamı veriliyor.

Kaynak:TechCrunch
Yapay Zeka8 saat once

Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı

Büyük müzik yayıncıları Sony, EMI ve Warner Chappell, Anthropic'in kitap yazarlarıyla 1,5 milyar dolarlık telif uzlaşmasının ardından şirketi bu kez torrent yoluyla binlerce şarkı sözü ve nota içeren eseri izinsiz indirmekle suçlayan yeni bir dava açtı. Dilekçe, kurucu ortağın toplu indirme yaptığını gösteren iç yazışmaları kanıt olarak sunuyor. Anthropic ise iddiaları reddedip adil-kullanım savunmasını sürdüreceğini açıkladı.

Kaynak:ArsTechnica
Yapay Zeka12 saat onceManset

Anthropic'in yeni Fable 5.1 modeli daha ucuz ve daha az kısıtlayıcı geliyor

Anthropic, en gelişmiş model ailesinin yeni sürümlerini — Fable 5.1 ve Mythos 5.1'i — yayınladı. Yeni sürüm performans artışının yanında token maliyetini düşürüyor ve güvenlik filtrelerinin yanlış-pozitif engellemelerini azaltıyor. Kurumsal müşteriler için daha önce sunulmayan 'Sıfır Veri Saklama' özelliği artık Fable ailesine de geliyor; Mythos 5.1 ise yalnızca siber güvenlik veya yaşam bilimleri araştırması yapan kayıtlı ortaklara açılıyor.

Kaynak:TechCrunch