OpenAI raporu: kodlama ajanları terk edilmiş bilim yazılımını 60 kata kadar hızlandırdı
OpenAI ve akademik ortaklarının yayınladığı saha raporu, çoğu biyoloji alanından 8 vaka çalışmasını belgeliyor: araştırma grupları Codex ve Claude Code gibi kodlama ajanlarını kullanarak ihmal edilmiş bilimsel yazılımları modernize etti. En çarpıcı sonuç RustQC projesinde görüldü — 15 ayrı kalite-kontrol aracı tek programda birleştirilerek çalışma süresi 15 saat 34 dakikadan 14 dakika 54 saniyeye indi.
OpenAI ve akademik ortaklarının yayınladığı yeni bir saha raporu, kodlama ajanlarının terk edilmiş bilimsel araştırma yazılımlarını modernize etmedeki etkisini sekiz somut vaka çalışmasıyla belgeliyor. Vakaların çoğu biyoloji alanından seçildi.
60 kattan fazla hızlanma
Rapordaki en çarpıcı kazanım RustQC adlı projede görüldü: araştırma grubu, 15 ayrı kalite-kontrol aracını Codex ve Claude Code gibi kodlama ajanları yardımıyla tek bir programda birleştirdi. Sonuç, çalışma süresinin 15 saat 34 dakikadan 14 dakika 54 saniyeye inmesi oldu — yani 60 kattan fazla bir hızlanma.
Genomik veri üretiminde de kazanım
HelixForge adlı ikinci projede ise sentetik genomik veri üreten bir araç, GPU üzerinde çalışan bir versiyonla değiştirildi ve önceki BamSurgeon aracına kıyasla 59,6 kat hızlandı.
Sınır: doğrulama hâlâ insan işi
Rapor açık bir uyarıyla bitiyor: kodlama ajanları eski ve ihmal edilmiş yazılımı hızlandırabiliyor, ancak “doğru sonucun ne olduğuna” karar vermek ve elde edilen çıktıyı doğrulamak hâlâ tamamen insan bilim insanının sorumluluğunda kalıyor. Araştırmacılar, ajan tarafından yeniden yazılan 20 binden fazla satır kodun her çıktısını manuel olarak kontrol ettiklerini belirtiyor.
Rapor, ajanların hız kazandırdığını ama 'doğru sonucun ne olduğuna' karar vermenin hâlâ tamamen insan uzmana bağlı kaldığını vurguluyor — bilimsel yazılım modernizasyonunda insan doğrulamasının vazgeçilmez kaldığını gösteren somut bir veri seti sunuyor.
- OpenAI — Scientific computing in the age of agentic AI · 2026-07-28
- The Decoder — AI coding agents can modernize research software but can't judge if the science is right · 2026-07-28
- Tech Times — AI Agents Rewrote 20,000 Lines of Dead Genomics Code · 2026-07-28
Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.
Ilgili Haberler
Anthropic araştırmacısından kendi kendini geliştiren yapay zekâya bir bakış
Anthropic'in fellows programındaki bir araştırmacı, yapay zekâ sistemlerinin literatür tarayıp yöntem önererek ve modeli kısa iterasyonlarla eğiterek hizalama hatalarını azaltabildiğini gösteren yeni bir makale yayınladı. Çalışmada, en iyi otomatik yöntem ortalama altı saat içinde deneyimli insan araştırmacıların önerdiği yöntemleri geride bırakmış; maliyet karşılaştırmasında saatte yaklaşık 4 dolarlık otomatik araştırmaya karşı insan araştırmacı için saatte yaklaşık 150 dolar rakamı veriliyor.
Sony, EMI ve Warner Chappell, Anthropic'i şarkı sözü korsanlığıyla suçlayan yeni dava açtı
Büyük müzik yayıncıları Sony, EMI ve Warner Chappell, Anthropic'in kitap yazarlarıyla 1,5 milyar dolarlık telif uzlaşmasının ardından şirketi bu kez torrent yoluyla binlerce şarkı sözü ve nota içeren eseri izinsiz indirmekle suçlayan yeni bir dava açtı. Dilekçe, kurucu ortağın toplu indirme yaptığını gösteren iç yazışmaları kanıt olarak sunuyor. Anthropic ise iddiaları reddedip adil-kullanım savunmasını sürdüreceğini açıkladı.
Anthropic'in yeni Fable 5.1 modeli daha ucuz ve daha az kısıtlayıcı geliyor
Anthropic, en gelişmiş model ailesinin yeni sürümlerini — Fable 5.1 ve Mythos 5.1'i — yayınladı. Yeni sürüm performans artışının yanında token maliyetini düşürüyor ve güvenlik filtrelerinin yanlış-pozitif engellemelerini azaltıyor. Kurumsal müşteriler için daha önce sunulmayan 'Sıfır Veri Saklama' özelliği artık Fable ailesine de geliyor; Mythos 5.1 ise yalnızca siber güvenlik veya yaşam bilimleri araştırması yapan kayıtlı ortaklara açılıyor.