Bu haftanın en büyük haberi Anthropic’ten geldi. Şirket, 1 Eylül’de Claude Fable 5.1’i yayımladı ve bağımsız zekâ endeksinin tepesini geri aldı. Dikkat çeken nokta etiket fiyatının değişmemesi ama önbellek maliyetinin sert düşmesi oldu. Yeni model tarafında sahne yalnızca metinle sınırlı kalmadı: World Labs tek bir fotoğraftan gezilebilen 3B dünyalar üreten Atlas’ı tanıttı, Cohere ise belgeleri ucuza yapıya döken küçük bir görü modeli olan Parse 5’i çıkardı. Ortak çizgi, gücün pahalı amiral modellerden çıkıp ucuz ve özel araçlara yayılması.
Claude Fable 5.1 ve Mythos 5.1
Anthropic
Yeni modelAnthropic, 1 Eylül’de amiral ailesinin yeni sürümü Claude Fable 5.1’i genel kullanıma açtı. Model, Artificial Analysis zekâ endeksinde 65,7 puanla listenin tepesine yerleşti ve Claude Opus 5’i (63,0) geride bıraktı. Etiket fiyatı Fable 5 ile aynı kaldı: 1 milyon token için 10 dolar girdi, 50 dolar çıktı. Asıl değişiklik önbellekte: önbellekten okunan token’ın fiyatı 1 dolardan 0,25 dolara, yüzde 75 indi. Anthropic bunun tipik iş yüklerinde efektif maliyeti yaklaşık yüzde 25, önbelleğe dayanan ajan akışlarında yüzde 45’e kadar düşürdüğünü söylüyor. Model, kendi paylaştığı ölçütlerde belirgin sıçrama gösterdi: Terminal-Bench-Science 24,7’den 52,6’ya, iş akışı otomasyonunu ölçen AutomationBench ise 17,1’den 31,4’e çıktı. Aynı gün gelen Mythos 5.1 ise aynı modelin güvenlik kısıtları gevşetilmiş sürümü; yalnızca doğrulanmış siber güvenlik ve yaşam bilimleri kuruluşlarına, kayıtlı erişim programlarıyla açık.
So what? Frontier model rekabeti artık yalnızca etiket fiyatında değil, gerçek kullanım maliyetinde geçiyor. Aynı büyük bağlamı defalarca okuyan bir ajan kuruyorsanız, önbellek fiyatı toplam faturayı etiket fiyatından daha çok belirleyebilir. En yetenekli modeli değerlendirirken 1 milyon token başına listeye değil, kendi iş akışınızın önbellek ve tekrar okuma desenine bakın.
Kaynak: VentureBeat, MarkTechPost, llm-stats, Anthropic
Fei-Fei Li’nin kurucusu olduğu World Labs, 1 Eylül’de çok modlu bir dünya modeli olan Atlas’ı erken erişimle tanıttı. Model, tek bir görüntüden yola çıkarak geometrik tutarlılığını koruyan, her açıdan izlenebilen bir sahne üretiyor; bir dakikaya kadar 1440p video çıkarabiliyor ve nokta bulutu ile 3B Gaussian splat gibi gerçek üç boyutlu varlıklar veriyor. World Labs, Atlas’ı tek bir “omni” model olarak konumlandırıyor: aynı model hem görüntüden 3B sahne kuruyor hem de kamera hareketini piksel düzeyinde kontrol ediyor. Şirket, bu tek modelin uzmanlaşmış 3B modellerin işini tek başına yaptığını söylüyor.
So what? Fiziksel ve mekânsal yapay zekâ, laboratuvar demolarından ürüne doğru ilerliyor. Mimari, perakende mağaza düzeni, dijital ikiz, oyun ve robot simülasyonu gibi alanlarda tek bir fotoğraftan gezilebilir 3B ortam üretmek, pahalı tarama ve modelleme adımlarını kısaltabilir. Ürününüzde mekân, sahne ya da fiziksel ortam varsa bu sınıf modelleri gündeminize almanın vakti geldi.
Kaynak: SiliconANGLE, AI Weekly, Crypto Briefing
Cohere, 27 Ağustos’ta belgeleri yapılandırılmış metne çeviren bir görü-dil modeli olan Parse 5’i yayımladı. 2,3 milyar parametreli model; PDF’leri, sunumları ve görselleri, içindeki tablolar ve gömülü resimlerle birlikte okuyor ve Markdown olarak veriyor. Dokuz büyük dilde çalışıyor. Öne çıkan nokta fiyat ve hız: 1.000 sayfa için 1,50 dolar ve saniyede 4,5 sayfa. Cohere’in kendi ParseBench ölçütünde model 79,2 puan aldı; bu, GPT-5.5 (84,4) ve Opus 4.8 (84,3) gibi frontier modellerin altında ama çoğu özel OCR aracının üzerinde. Parse 5 ayrıca Microsoft Foundry üzerinden de erişilebilir hâle geldi.
So what? Belgeyi yapıya dökmek, birçok kurumsal yapay zekâ projesinin görünmeyen darboğazı. Sözleşmeler, formlar ve raporlar makinenin okuyamadığı biçimlerde duruyor. Sayfa başına birkaç kuruşa çalışan, tabloları ve görselleri de anlayan bir model, arşivlerinizi arama ve ajanlara açmanın maliyetini düşürebilir. Yüksek hacimli belge işleyen ekipler için bu, pahalı frontier modelleri her sayfaya koşmaktan daha ekonomik bir katman.
Kaynak: VentureBeat, MarkTechPost, Cohere