![]() IEEE Spectrum: Yapay zeka yönetimi için 6 temel ilkeIEEE Spectrum: 6 Guidelines for Governing AIMakale, yapay zeka sistemlerinin otonom kararlarını denetlemek ve insan müdahalesini doğru noktada devreye almak için işletmelere yönelik altı yönetişim ilkesi sunuyor. Bu yaklaşım, yalnızca teknoloji kurulumu değil, sistemin sınırlarını ve sorumluluklarını belirleyen 'yönetici kaymasını' gerektiriyor.The article presents six governance principles for businesses to oversee the autonomous decisions of AI systems and to engage human intervention at the right point. This approach requires not just technology deployment, but a “managerial shift” that defines the system’s boundaries and responsibilities. |
AiPulse — Sayı No. 79AiPulse — Issue No. 79
KAPAKCOVER
NabızPulse
Reflection, Beam'in Çinli rakiplerle kıyaslamalarda benzer performans gösterdiğini ve çıkarım maliyetlerini önemli ölçüde düşürdüğünü iddia ediyor. Bu hamle, DeepSeek ve Qwen gibi modeller karşısında Batılı bir alternatif geliştirme yarışını kızıştırıyor.Reflection claims that Beam shows comparable performance to its Chinese rivals in benchmarks and significantly reduces inference costs. This move intensifies the race to develop a Western alternative against models like DeepSeek and Qwen. |
Yapay zeka gözlükleri ilk büyük devlet müdahalesiyle karşı karşıyaAI glasses face their first major government crackdownAI gözlüklerinin kullanımındaki yasal sınırlar, kullanıcıların ve üreticilerin dikkatini çekiyor.The legal limits on the use of AI glasses are drawing the attention of users and manufacturers. |
Yapı TaşlarıBuilding Blocks
Yerel donanımda yapılan kıyaslamada, akıl yürütme kapalıyken modelin büyük sayıları sözcükle toplama doğruluğu %23,57'de kaldı. Akıl yürütme açık olduğunda ise model, 169 denemenin 167'sinde doğru sonuç üretti.In the comparison performed on local hardware, with reasoning disabled, the model’s accuracy in adding large numbers in word form remained at 23.57%. With reasoning enabled, the model produced the correct result in 167 of 169 trials. |
Simon Willison, pwasm 0.2a0 sürümünü yayınladıSimon Willison releases pwasm 0.2a0Willison, Claude Opus 5.5 ile geliştirdiği saf Python tabanlı WebAssembly motorunun alfa sürümünü duyurdu. Bu sürüm, WASM spesifikasyonunun neredeyse tamamını destekliyor ve MicroPython ile QuickJS derlemelerini içeriyor.Willison announced the alpha version of his pure Python-based WebAssembly engine, developed with Claude Opus 5.5. This version supports nearly the entire WASM specification and includes MicroPython and QuickJS builds. |
Küresel BakışGlobal Lens
Araştırma, kendi kendini iyileştiren yapay zeka ajanlarının sınırlı test setlerini ezberleyerek yeni görevlerde başarısız olduğunu gösteriyor. RRSI yöntemi, düzenli geri bildirimle kalıcı değişiklikler yaparak ajanların genel performansını artırıyor.The research shows that self-healing AI agents fail on new tasks by memorizing limited test sets. The RRSI method improves agents' overall performance by making permanent changes through regular feedback. |
Yeni yöntem, model ve harness arasında aday komutları örnekleyip doğrulayarak TerminalBench-Lite'ta başarı oranını %50'den %68'e yükseltiyor. Çalışma, güçlü bir doğrulayıcının ek örneklemeye göre daha etkili olduğunu gösteriyor.The new method samples and validates candidate commands between the model and the harness, raising the success rate on TerminalBench-Lite from 50% to 68%. The study shows that a strong validator is more effective than additional sampling. |
Avrupa ödeme kuruluşları, Visa ve Mastercard ile rekabet edebilmek için Madrid merkezli yeni bir ortaklık kurdu. Bu ağ, kıta genelinde kesintisiz sınır ötesi ödemeleri mümkün kılacak.European payment institutions have established a new Madrid-based partnership to compete with Visa and Mastercard. This network will enable seamless cross-border payments across the continent. |
OpenAI, Avrupa Yapay Zeka Yasası'nın şeffaflık kurallarına uyum sağlamak amacıyla ChatGPT ve Codex'in ürettiği metinlere 'textGrain' adlı görünmez istatistiksel işaret ekliyor. Bu sistem, yapay zeka kaynaklı içerikleri tespit etmeyi amaçlasa da kısa metinlerde ve matematiksel içeriklerde güvenilirlik sınırlamaları taşıyor.OpenAI is adding an invisible statistical marker called 'textGrain' to the text generated by ChatGPT and Codex in order to comply with the transparency rules of the European AI Act. Although this system aims to detect AI-generated content, it has reliability limitations in short texts and mathematical content. |
Aleph Alpha, Almanya'nın kamu yönetimi ve havacılık gibi düzenlemeye tabi sektörleri için geliştirdiği açık ağırlıklı Kolibri modelini duyurdu. Model, Almanya ve Finlandiya altyapısında eğitilerek veri egemenliğini ve şeffaflığı ön plana çıkarıyor.Aleph Alpha has announced Kolibri, an open-weight model developed for regulated sectors such as public administration and aviation in Germany. The model is trained on infrastructure in Germany and Finland, highlighting data sovereignty and transparency. |
Yeni sürüm, CAE analiz sonuçlarını otomatik olarak 3D CAD tasarımlarına dönüştürerek mühendislerin tasarım ve üretim süreçlerini hızlandırıyor. Bu yenilik, özellikle kalıp tasarımında yapay zeka tahminlerinin pratik uygulamalara entegrasyonunu kolaylaştırıyor.The new version accelerates engineers' design and manufacturing processes by automatically converting CAE analysis results into 3D CAD designs. This innovation facilitates the integration of AI predictions into practical applications, particularly in mold design. |
ABD sınır modelleri, Çin açık modelleri, Avrupa ise egemen modelleri önceliklendiriyor. Bu üçlü yaklaşım, küresel yapay zeka yarışındaki farklı odak noktaları ortaya koyuyor.The US prioritizes border models, China open models, and Europe sovereign models. This tripartite approach highlights the different focal points in the global artificial intelligence race. |
Ufuk ÇizgisiFrontier
OpenAI modellerinin ünlü bir matematik problemini çözmesi, kanıt süreçlerindeki anlama eksikliği nedeniyle toplulukta endişe yarattı. Matematikçiler, yapay zekanın sadece sonuç üretmesi ve yolculuğu atlaması nedeniyle mesleklerinin geleceğinin belirsizleştiğini belirtiyor.OpenAI models solving a famous mathematical problem sparked concern in the community due to a lack of understanding in the proof processes. Mathematicians state that the future of their profession has become uncertain because the AI merely produces results and skips the journey. |
Enteresan & EğlenceliFun & Curious
Nolla Health'in geliştirdiği sistem, Utah eyaletinde rutin akne tedavileri için doktor onayı beklemeden reçete yazabiliyor. Bu uygulama, ABD'de otonom tıbbi karar mekanizmalarının denendiği ilk kontrollü pilot program olarak öne çıkıyor.The system developed by Nolla Health can prescribe medication for routine acne treatments in the state of Utah without waiting for doctor approval. This application stands out as the first controlled pilot program in the United States to test autonomous medical decision-making mechanisms. |
Ny Carlsberg Glyptotek müzesindeki bu sergi, antik Romalıların pahalı boyalar ve parfümlerle statülerini nasıl ortaya koyduğunu 171 eserle gözler önüne seriyor. Sergi, Tiberius heykelinin pembe giysisi gibi detaylar üzerinden görünüm ile siyasi otorite arasındaki bağı inceliyor.This exhibition at the Ny Carlsberg Glyptotek museum brings to light, through 171 works, how the ancient Romans displayed their status with expensive paints and perfumes. The exhibition examines the link between appearance and political authority through details such as the pink garment of the Tiberius statue. |











