2026-07-24
AI Kritik
yapay zeka nabzı — ham değil, demlenmişthe AI pulse — brewed, not raw
 AI KRİTİKAI CRITIQUE
Kimi K3 ve Fable 5 karşılaştırması: Açık kaynak modeli %93 özgür doğruluk oranında maliyetini 50 kat düşürüyor.

Kimi K3, Fable 5 ile Karşılaştırıldı: Açık Model %93 Doğrulukla Maliyeti 50 Kat AzaltıyorKimi K3 vs Fable 5: Open-source model costs up to 50× less at 93% routing accuracy

Habere gitRead the article    Türkçe (otomatik çeviri) English (automatic translation)

ÖzetSummary

Kimi K3, açık kaynaklı bir model olarak, kapalı Fable 5 ile genel doğrulukta (~%92,5) eşleşiyor ancak maliyet açısından 50 kata kadar daha ucuz olabilir; aralarındaki yönlendirme %93 doğruluk sağlarken, K3 çoğu görevi üstleniyor.Kimi K3, as an open-source model, matches the closed Fable 5 in overall accuracy (~92.5%) but could be up to 50 times cheaper; while routing between them achieves about 93% accuracy, K3 handles most tasks.

Neden ÖnemliWhy it matters

Araştırma, açık modellerin kalite açısından tescilli modellere rakip olabileceğini ve maliyetleri çarpıcı bir şekilde düşürdüğünü gösteriyor; bu da büyük ölçekli ajansal iş akışlarını daha uygun maliyetli hale getiriyor. Ayrıca, görev yönlendirme sayesinde birden fazla modelin güçlü yönlerini birleştirmenin stratejik avantajını vurguluyor ve yapay zekâ dağıtımını tek-model bağımlılığından hibrit bir yaklaşıma kaydırıyor.The study shows that open models can rival proprietary ones in quality and dramatically reduce costs, making large-scale agency workflows more affordable. Additionally, task routing highlights the strategic advantage of combining multiple models' strengths and shifts AI deployment from single-model dependence to a hybrid approach.

Öne ÇıkanlarHighlights

  • K3, SWE kıyaslamasında Fable ile neredeyse aynı doğruluğu yakalıyor (92,4% vs 92,6%).K3 nearly matches Fable's accuracy in the SWE benchmark (92.4% vs 92.6%).
  • K3, terminal görevlerde Fable'i geride bırakıyor; Fable'in başarısız olduğu 11 güvenlik/kriptografi sorunu üzerinde tek başına galip geliyor.K3 outperforms Fable on terminal tasks; it single-handedly succeeds on 11 security/cryptography problems where Fable fails.
  • K3'ün Fireworks üzerindeki çıkarım maliyeti, token fiyatlandırması ve istem önbelleklemesi sayesinde Fable'in 1/50'si kadar olabilir.K3's inference cost on Fireworks, thanks to token pricing and request caching, can be as low as 1/50 of Fable's.

EleştiriCritical take

K3'e bildirilen %72-%96 görev dağılımı, mükemmel model seçimini varsayan oracle yönlendirmesine dayanıyor; gerçek dünyadaki yönlendiriciler bu verimliliği çeşitli iş yükleri arasında tekrarlamakta zorlanabilir.The reported 72%-96% task distribution for K3 relies on oracle routing that assumes perfect model selection; real-world routers may struggle to replicate this efficiency across diverse workloads.

Bu kritik, yerel yapay zeka modeli gpt-oss-120b tarafından yazılmıştır.This critique was written by the local AI model gpt-oss-120b.
Bültene dönBack to the issue