vLLM v0.27.0 yayınlandı: 561 commit'lik büyük sürüm yeni model ailelerini destekliyor
Açık kaynaklı LLM sunucu/inference motoru vLLM, 242 katkıcıdan (64'ü ilk kez katkı yapan) 561 commit'i birleştiren büyük bir sürüm yayınladı. Kimi K3 için uçtan uca yığın desteği, Qwen3.5 dense/MoE varyantları ve birkaç yeni model eklendi; PyTorch 2.13.0 ile Triton 3.7.1'e yükseltme ise kırıcı (breaking) değişiklik olarak işaretlendi.
Açık kaynaklı büyük dil modeli sunucu/inference motoru vLLM, 242 katkıcının (64’ü projeye ilk kez katkı sağlayan) emeğiyle oluşan 561 commit’lik büyük bir sürümü, v0.27.0’ı yayınladı.
Yeni model desteği
Sürümle birlikte Kimi K3 modeli için uçtan uca tam yığın desteği eklendi — bu destek çekirdek model mimarisini, hesaplama kernellerini, Python/Rust arayüzlerini ve kuantalama desteğini kapsıyor. Ayrıca video token budama özellikli Qwen3.5 dense ve MoE (mixture-of-experts) varyantları, K-EXAONE-2.0-750B-A37B, VaultGemma ve jina-embeddings-v5-text-nano modelleri de desteklenen modeller listesine katıldı.
Kırıcı değişiklikler
vLLM ekibi, PyTorch 2.13.0 ve Triton 3.7.1’e yükseltmeyi kırıcı (breaking) bir değişiklik olarak işaretledi — bu, mevcut dağıtımların dikkatli bir şekilde test edilmesini gerektiriyor. Ayrıca max_num_partial_prefills gibi bazı eski parametreler tamamen kaldırıldı.
Performans tarafı
Sürüm notlarında öne çıkan diğer teknik başlıklar arasında FlashAttention 4’ün SM100 mimarisi için FP8 KV-cache desteğinin derinleştirilmesi ve DeepSeek-V4 modeli için özel bir performans paketi yer alıyor — bu geliştirmeler, büyük modellerin bellek verimliliğini ve çıkarım hızını artırmayı hedefliyor.
Neden önemli
vLLM, kendi altyapısında büyük dil modeli barındırmak isteyen kurumlar için yaygın kullanılan açık kaynaklı bir inference motoru. Bu ölçekte bir katkıcı tabanıyla düzenli olarak yeni model ailelerini desteklemesi, açık kaynaklı LLM sunma ekosisteminin ne denli hızlı geliştiğini gösteriyor; ancak kırıcı değişikliklerin sıklığı, üretim ortamlarında dikkatli sürüm yönetimini gerekli kılıyor.
Açık kaynaklı inference motorlarının model desteğini bu hızla genişletmesi, kurumların kendi altyapılarında büyük dil modeli barındırma maliyetini düşürmesine yardımcı oluyor; ancak PyTorch/Triton yükseltmesi gibi kırıcı değişiklikler mevcut dağıtımların dikkatli test edilmesini gerektiriyor.
- GitHub — vLLM Releases · 2026-08-10
Bu haber ozgun ozet olarak hazirlanmistir; telif hakki ilgili kaynaklara aittir. Tam metin icin kaynak baglantilarini ziyaret edin.
Ilgili Haberler
OpenAI, SpaceX'in Cursor'u satın almasının ardından modellerini platformdan çekiyor
OpenAI, bir uzay şirketinin AI kodlama aracı Cursor'un geliştiricisini 60 milyar dolara satın almasının ardından, Cursor'a model tedarikini 12 Kasım 2026 itibarıyla sonlandıracağını duyurdu. Gerekçe olarak, alıcı şirketin bağlı olduğu grubun geçmişte hizmet şartlarını ihlal ettiği ve platformun teknolojiyi şartlara uygun kullanacağına dair yeterli güven duyulmadığı belirtildi. Kasım'a kadar geliştiriciler mevcut modellere erişebilecek, ancak bu süreçte yayınlanacak yeni modeller Cursor üzerinden hiç sunulmayacak.
OpenShot 4.0 yayınlandı — yerel AI maskeleme, renk düzeltme ve ekran kaydı geldi
Açık kaynak video düzenleyici OpenShot, kuruluşundan bu yana en iddialı güncellemesi olarak tanıtılan 4.0 sürümünü yayınladı. Yeni Kayıt Görünümü ekran, webcam, mikrofon ve sistem sesini doğrudan projeye kaydedebiliyor; yeni Renk Görünümü renk çarkları, eğriler, LUT'lar ve canlı video skopları sunuyor. Bulut veya abonelik gerektirmeyen, kullanıcının kendi bilgisayarında çalışan yerel AI destekli maskeler ve 10 yeni efekt eklendi.
Google, Manifest V2 uzantılarını Chrome Web Store'dan kalıcı olarak kaldırdı — uBlock Origin dahil
Google, 31 Ağustos 2026'da Chrome Web Store'da kalan tüm Manifest V2 uzantılarını kaldırarak çok yıllık Manifest V3 geçişini tamamladı — bunlar arasında uBlock Origin'in tam sürümü de var. MV2 uzantıları zaten Temmuz 2025'te stabil Chrome'da çalışmayı durdurmuştu; artık mağazadan yüklenemiyor, güncellenemiyor veya yeniden yüklenemiyor. Google değişikliği güvenlik ve performans gerekçesiyle savunuyor; topluluk alternatif tarayıcıları öneriyor.