BDH-CQ: Küçük modelle büyük akıl yürütme — tekrarlayan gizli hesaplama
Pathway ekibinin geliştirdiği BDH-CQ modeli, sorguyu yüksek boyutlu gizli uzayda yinelemeli hesaplamayla çözen yeni bir mimari sunuyor. Yalnızca 150 milyon parametreli yapılandırma, ARC-AGI-1 değerlendirmesinde çok daha büyük modellerle kıyaslanabilir bir başarı oranına ulaştı.
Araştırma grubu Pathway’in geliştirdiği BDH-CQ modeli, çıkarım sırasında sunulan girdilerle belleğini güncelleyip sorguyu yüksek boyutlu gizli uzayda yinelemeli hesaplama yoluyla çözen bir mimari öneriyor. Yaklaşım, geleneksel büyük dil modellerinin tek geçişli işleme mantığından farklı olarak, modelin sorgu üzerinde tekrar tekrar “düşünmesine” olanak tanıyor.
Yalnızca 150 milyon parametreli bir yapılandırma, ARC-AGI-1 değerlendirmesinde görev başına 0,0007 dolarlık çok düşük bir çıkarım maliyetiyle pass@2 metriğinde yüzde 29,5 başarı elde etti. Bu sonuç, çok daha büyük ve pahalı modellerle kıyaslanabilir seviyede.
Ekip ve yayın bilgisi
Çalışmanın yazarları arasında Björn Engdahl, Adrian Kosowski ve Jan Chorowski gibi araştırmacılar yer alıyor. Sonuçlar, model boyutunun tek başına akıl yürütme kalitesini belirleyen faktör olmadığını, mimari tasarımın ve yinelemeli hesaplama stratejilerinin de kritik rol oynayabileceğini gösteren büyüyen bir araştırma akımına katkı sunuyor.
Küçük ve ucuz modellerin büyük modellere yakın akıl yürütme performansı gösterebilmesi, mikro görevler için maliyet-etkin yapay zeka katmanlarının önünü açabilir.
Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.
Ilgili Haberler
Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış
Anthropic'in fellows programındaki bir araştırmacı, yapay zekâ sistemlerinin literatür tarayıp yöntem önererek ve modeli kısa iterasyonlarla eğiterek hizalama hatalarını azaltabildiğini gösteren yeni bir makale yayınladı. Çalışmada, en iyi otomatik yöntem ortalama altı saat içinde deneyimli insan araştırmacıların önerdiği yöntemleri geride bırakmış; maliyet karşılaştırmasında saatte yaklaşık 4 dolarlık otomatik araştırmaya karşı insan araştırmacı için saatte yaklaşık 150 dolar rakamı veriliyor.
Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı
Büyük müzik yayıncıları Sony, EMI ve Warner Chappell, Anthropic'in kitap yazarlarıyla 1,5 milyar dolarlık telif uzlaşmasının ardından şirketi bu kez torrent yoluyla binlerce şarkı sözü ve nota içeren eseri izinsiz indirmekle suçlayan yeni bir dava açtı. Dilekçe, kurucu ortağın toplu indirme yaptığını gösteren iç yazışmaları kanıt olarak sunuyor. Anthropic ise iddiaları reddedip adil-kullanım savunmasını sürdüreceğini açıkladı.
Anthropic'in yeni Fable 5.1 modeli daha ucuz ve daha az kısıtlayıcı geliyor
Anthropic, en gelişmiş model ailesinin yeni sürümlerini — Fable 5.1 ve Mythos 5.1'i — yayınladı. Yeni sürüm performans artışının yanında token maliyetini düşürüyor ve güvenlik filtrelerinin yanlış-pozitif engellemelerini azaltıyor. Kurumsal müşteriler için daha önce sunulmayan 'Sıfır Veri Saklama' özelliği artık Fable ailesine de geliyor; Mythos 5.1 ise yalnızca siber güvenlik veya yaşam bilimleri araştırması yapan kayıtlı ortaklara açılıyor.