No. 51
2026-09-08
yapay zeka nabzı — ham değil, demlenmişthe AI pulse — brewed, not raw
 AI KRİTİKAI CRITIQUE
OpenBMB logosu bulunan, parlayan motorlu beyaz bir uzay gemisi ve robot pilotu uzayda süzülüyor.

OpenBMB'nin MiniCPM5-2B modeli 12B parametreli Gemma 4 ile eşit performans gösterdiOpenBMB's MiniCPM5-2B model matches the performance of the 12B-parameter Gemma 4

Habere gitRead the article    Türkçe (otomatik çeviri) English (automatic translation)

ÖzetSummary

OpenBMB, 7 Eylül 2026'da MiniCPM5-2B'yi yayımladı. 2,5 milyar parametreli ve 131K token bağlam kapasitesine sahip bu Apache-2.0 lisanslı açık kaynak büyük dil modeli (LLM), makaleye göre Artificial Analysis Zeka Endeksi'nde Gemma 4 12B ile aynı seviyede performans gösteriyor ve bazı 4B parametreli modelleri geride bırakıyor.

Neden ÖnemliWhy it matters

Başlıca kıyaslamalarda 12B parametreli bir modeli yakalayan 3B altı bir modelin, RAM ve işlem bütçesinin belirleyici olduğu cihaz üstü ve kenar (edge) devreye alma senaryolarında doğrudan etkileri var. Modelin Apache 2.0 lisansı ve Hugging Face ile ModelScope'ta ücretsiz dağıtımı, dünya genelindeki geliştiriciler için deneysel eşiği düşürüyor. Bu durum, Çin merkezli açık kaynak laboratuvarlarının Batılı model aileleriyle arasındaki verimlilik farkını ne kadar hızla kapattığını da gözler önüne seriyor.

Öne ÇıkanlarHighlights

  • 2,5B parametre, 131K bağlam, Apache 2.0 lisansı; Hugging Face ve ModelScope'ta ücretsiz erişilebilir, canlı HF Space demosu mevcut
  • AA Zeka Endeksi v4.3'te Gemma 4 12B ile aynı seviyede; Qwen3.5-4B'ü birden fazla bire bir testte geride bırakıyor
  • 2B sınıfı bir model için dikkat çekici bir güç olarak, nispeten tutarlı Japonca yanıtlar üretiyor

EleştiriCritical take

Makalede açıklanmamış bir iç tutarsızlık bulunuyor. Metinde alıntılanan OpenBMB tweeti Zeka Endeksi puanını 23 olarak verirken, GIGAZINE gövde metni 14 diyor. Okuyucular, Artificial Analysis'e doğrudan başvurmadan hangi rakamın geçerli olduğunu ayırt edemiyor. Ayrıca tek bir bileşik endekste eşitlik, ajansal iş akışlarında, uzun bağlam geri çağırmasında veya daha büyük modellerin yapısal avantaj sağladığı çok dilli görevlerde eşdeğer performans garantisi vermiyor.

Bu kritik, yerel yapay zeka modeli Qwen3.8-27B tarafından yazılmıştır.This critique was written by the local AI model Qwen3.8-27B.
Bültene dönBack to the issue