![]() Google, gerçek zamanlı kodlama yapabilen Gemini 3.8 Live modellerini yayınladıGoogle releases Gemini 3.8 Live models capable of real-time codingHabere gitRead the article Türkçe (otomatik çeviri) English (automatic translation) |
ÖzetSummaryGoogle, gerçek zamanlı sesli sohbet modelleri Gemini 3.8 Live (maliyet etkin) ve Gemini 3.8 Live Extended Thinking (ileri düzey çok adımlı akıl yürütme) modellerini yayınladı. Her iki model de 97 dili destekliyor ve sözlü diyalog sırasında canlı kodlama imkânı sunuyor. Üçüncü taraf kıyaslamalarda Extended Thinking varyantının, OpenAI'nin GPT-Live-1-Astra ve SpaceXAI'nin Grok Voice Think Fast 2.0 modellerini geride bıraktığı bildiriliyor. Baz model ise kör insan değerlendirme arenasında ikinci sırada yer aldı.Google has released Gemini 3.8 Live (cost-effective) and Gemini 3.8 Live Extended Thinking (advanced multi-step reasoning), real-time voice chat models. Both models support 97 languages and offer live coding capabilities during verbal dialogues. Third-party benchmarks report that the Extended Thinking variant outperforms OpenAI's GPT-Live-1-Astra and SpaceXAI's Grok Voice Think Fast 2.0 models. The base model placed second in the blind human evaluation arena. |
Neden ÖnemliWhy it mattersGerçek zamanlı sesli kodlama, sözlü etkileşim ile üretken yazılım işi arasındaki farkı azaltıyor. Geliştiricilerin ve teknik olmayan kullanıcıların metin tabanlı bir IDE'ye geçmeden kod üzerinde tekrar tekrar çalışmasını kolaylaştırarak bu alandaki dinamikleri değiştirebilir. 97 dil desteği ve konuşmayı kesmeden arka planda araç çağırma yeteneği, sadece konuşan değil, eyleme geçen çok dilli ve eller serbest yapay zekâ asistanlarına yönelik bir hamle olarak okunuyor. Daha geniş yapay zekâ yarışında ise OpenAI ve SpaceX markalı bir ses modelinin her ikisini de geride bırakan güvenilir bir üçüncü taraf kıyaslama zaferi, sesli ajan segmentindeki rekabeti kızıştırıyor.Real-time voice coding bridges the gap between verbal interaction and generative software development. By allowing developers and non-technical users to iteratively refine code without switching to a text-based IDE, it could reshape dynamics in this field. Support for 97 languages and the ability to invoke tools in the background without interrupting speech are seen as moves toward multilingual, hands-free AI assistants that not only converse but also act. In the broader AI race, a reliable third-party benchmark victory where a model from OpenAI and SpaceX brands is outperformed by both intensifies competition in the voice agent segment. |
Öne ÇıkanlarHighlights
|
EleştiriCritical takeSpeech Agent Arena'daki 'ikinci sıra' başlığı, birinci sıranın da bir Google modeli olması nedeniyle biraz zayıf kalıyor. Bu durum, arenanın fiilen Gemini ailesini iki kez taçlandırdığı anlamına geliyor. Ayrıca 'gerçek zamanlı kodlama' yeteneği yalnızca seçilmiş bir tanıtım videosunda gösteriliyor. Makalede, canlı kodlama doğruluğu veya yük altında gecikme süresine ilişkin bağımsız ve tekrarlanabilir bir kıyaslama sunulmuyor. Bu da özelliğin pratik güvenilirliğini büyük ölçüde doğrulanmamış bırakıyor.The 'second place' title in the Speech Agent Arena feels somewhat weak given that the first-place finisher is also a Google model. This implies the arena effectively crowned the Gemini family twice. Additionally, the 'real-time coding' capability is only demonstrated in a selected promotional video. The article does not provide independent, repeatable benchmarks regarding live coding accuracy or latency under load, leaving the practical reliability of this feature largely unverified. |
