No. 53
2026-09-10
yapay zeka nabzı — ham değil, demlenmişthe AI pulse — brewed, not raw
 VİDEOVIDEO
Türkçe altyazıTurkish subtitles
  1. Yapay zeka ajanınız az önce kritik bir soruyu yanıtladı.Your AI agent just answered a critical question.
  2. Ses tonu kendinden emin, akıcı, hatta belki de zarifti.It sounded confident, articulate, maybe even eloquent.
  3. Ancak tamamen yanlıştı.It also was completely wrong.
  4. Tekil yapay zeka ajanları hakkındaki rahatsız edici gerçek şu:Here's the uncomfortable truth about single AI agents.
  5. Bilmediklerini bilmiyorlar.They don't know what they don't now.
  6. Elini kaldırıp "Aslında bundan emin değilim" diyemiyorlar.They can't raise their hand and say, actually, I'm not sure about this one.
  7. Her seferinde kendinden emin bir şekilde cevap veriyorlar.They just answer confidently every single time.
  8. Düşük riskli durumlarda bu sorun değil.And that's fine when this stakes.
  9. Ama hasta bakımı, finansal işlemler veya yasal uyum gibi kararlar alırken, doğrulamasız güven bir özellik değil.But when you're making decisions about patient care, financial transactions, or legal compliance, confidence without verification isn't a feature.
  10. Bir yükümlülüktür.It's a liability.
  11. Bugün neden tek bir beyin yetmediğini ve çoklu ajan sistemlerinin tekil ajanların çözemediği bir güven sorununu nasıl çözdüğünü konuşacağız.Today we're going to talk about why one brain isn't enough and how multi-agent systems solve a trust problem that single agents can't.
  12. Gelin gerçek sorunu konuşalım.So let's talk about the real problem.
  13. Tekil bir yapay zeka ajanı, asla "Bilmiyorum" demeyen parlak bir yeni işe alınan kişi gibidir.A single AI agent is like a brilliant new hire who never says, I don't know.
  14. Her zaman bir cevabı vardır.They always have an answer.
  15. Bunu tam bir özgüvenle sunar ve bazen gece uykunuzu kaçıracak kadar sıklıkla tamamen yanlıştır.They deliver it with complete confidence and sometimes often enough to keep you up at night, they're dead wrong.
  16. Bu, halüsinasyon sorunudur.This is the hallucination problem.
  17. Ve sormadan önce hayır, bir sonraki yazılım güncellemesinde düzeltilmeyecek.And before you ask, no, it's not getting fixed in the next software update.
  18. Bu, büyük dil modellerinin çalışma biçiminin temelinde yatan bir durumdur.It's fundamental to how large language models work.
  19. Kendi bilgi sınırlarını tanımak yerine, inandırıcı görünen çıktılar üretmek üzere eğitilmişlerdir.They're trained to produce plausible sounding outputs, not to recognize the edges of their own knowledge.
  20. Ve durum daha da kötüleşiyor.And it gets worse.
  21. Tek ajanlar sadece halüsinasyon görmüyor.Single agents don't just hallucinate.
  22. Kendinden emin halüsinasyonlar üretiyorlar.They hallucinate confidence.
  23. İçsel bir belirsizlik ölçerleri yok, tereddüt etmiyorlar.There's no internal uncertainty meter, no hesitation.
  24. "Hayır, bir daha kontrol edeyim" demiyorlar.No, let me double check that.
  25. Yanlış cevabı, doğru cevapla aynı kesinlikle söylüyorlar.They'll tell you the wrong answer with the exact same conviction as the right one.
  26. Sanki asla "yön yeniden hesaplanıyor" demeyen bir GPS gibi.It's like a GPS that never says recalculating.
  27. Sadece kendinden emin bir şekilde sizi göle sürüklüyor.It just confidently drives you into a lake.
  28. Düşük riskli işlerde sorun değil.For low stakes, fine.
  29. Bu e-postayı özetle, bir tweet taslağı hazırla.Summarize this email, draft a tweet.
  30. Kimse zarar görmüyor.No one's getting hurt.
  31. Ama yüksek riskli kararlar, tıbbi öneriler, kredi onayları, uyumluluk kontrolleri.But high stakes decisions, medical recommendations, loan approvals, compliance checks.
  32. "Emin değilim" demesi yapısal olarak imkânsız olan bir sisteme şirketinizi ya da birinin sağlığını bağlar mısınız?Would you bet your company or someone's health on a system that's constitutionally incapable of saying, I'm not sure?
  33. Sağlık veya finans gibi yüksek riskli uygulamalar, kritik kararlar vermeden önce belirsizliği değerlendirebilen ve çıktıları doğrulayabilen sistemler gerektirir.High stakes applications like healthcare or finance demand systems that can assess uncertainty and verify outputs before making critical decisions.
  34. Bu, çözülemez bir sorun gibi görünebilir, ama insanlar bunu yüzyıllar önce çözdü.Now, this might sound like an unsolvable problem, but humans cracked this centuries ago.
  35. Tıpta.In medicine.
  36. İkinci görüşü icat ettik.We invented second opinions.
  37. Tek bir doktora gidip ciddi bir tanıyla yetinip en iyisini ummazsınız.You don't go to one doctor's and take a serious diagnosis and hope for the best.
  38. Uzmanlara danışarsınız, belki bir tümör panosuna, yani taramalarınız hakkında uzlaşmaya varana kadar tartışan bir odaya dolusu uzmana.You consult specialists, maybe a tumor board, which is literally a room full of experts arguing about your scans until they reach consensus.
  39. Finans dünyasında dört I ilkesi vardır.In finance, there's the four I principle.
  40. Önemli işlemlerde iki kişi imza atar; bankacıların sayı bilmediği için değil, tek onay noktasının tek arıza noktası haline geldiğini öğrendiğimiz için.Two people sign off on significant transactions, not because bankers can't count, but because we've learned that single points of approval become single points a failure.
  41. Havacılıkta pilotların yanlarında yardımcı pilotlar vardır.In aviation, pilots have co-pilots.
  42. Kontrol listeleri, en iyi uzmanların bile baskı altında bazı şeyleri gözden kaçırabileceği gerçeğinden ötürü var olmaktadır.Checklists exist because even the best experts miss things under pressure.
  43. Tüm sistem, insanların hata yapabilir olduğunu varsayar ve buna göre tasarlanır.The whole system assumes humans are fallible and designs around it.
  44. Bu, felaketler yoluyla kazanılmış kurumsal bir bilgeliktir.This is institutional wisdom earned through disasters.
  45. İnsanlar, bazen acı bir şekilde, güvenin özgüvenden değil doğrulamadan doğduğunu öğrendi.Humans learned, sometimes the hard way, that trust comes from verification, not confidence.
  46. Peki neden tüm bu bilgelere sırtını dönen yapay zeka sistemleri inşa ediyoruz?So why are we building AI systems that throw all that wisdom out the window?
  47. Sana şimdiye kadar inşa edilmiş en büyük çoklu ajan sisteminden bahsetmek istiyorum.Let me tell you about the greatest multi-agent system ever built.
  48. Ve bu sistem 1969 yılında inşa edildi.And it was built in 1969.
  49. NASA Görev Kontrol Merkezi.NASA's Mission Control.
  50. Apollo 11'in ay yüzeyine inişi sırasında, kararı veren tek bir kişi yoktu.When Apollo 11 was descending to the moon's surface, there wasn't one person making the call.
  51. Her biri belirli bir sistemde uzmanlaşmış onlarca uzman vardı ve hepsi eş zamanlı olarak izlemeyi sürdürüyordu.There were dozens of specialists, each an expert in one specific system, all monitoring simultaneously.
  52. GUIDO yönlendirme sistemlerini izlerken, FIDO uçuş dinamiklerini takip ediyor, EECOM yaşam destek sistemlerini denetliyor, CAPCOM astronotlarla konuşuyor ve uçuş direktörü Gene Kranz tüm bunları koordine ediyordu.You had GUIDO, watching the guidance systems, FIDO tracking flight dynamics, EECOM, monitoring life support, and CAPCOM talking to the astronauts, and flight director Gene Kranz orchestrating all of it.
  53. İşte asıl önemli nokta şu.And here's the key.
  54. Kritik bir karar verilmeden önce Kranz, "gitme-gitmeme" (go-no-go) denilen bir süreci yürütürdü.Before any critical decision, Kranz would run what's called a go-no-go.
  55. Odadaki herkesi dolaşırdı.He'd go around the room.
  56. Her uzman sistemlerini kontrol eder ve "git" ya da "gitme" derdi.Each specialist would check their systems and call out, go, no go.
  57. İstasyonlardan herhangi birinden gelen tek bir "gitme" kararı.One single no go from any station.
  58. Sorun çözülene kadar tüm görev duraklatılırdı.The whole mission pauses until it's resolved.
  59. Şimdi işler dramatik hale geliyor.Now here's where it gets dramatic.
  60. Apollo 11'in inişi sırasında alarm zilleri çalmaya başladı.During Apollo 11's descent, alarms started blaring.
  61. 1202, 1201.
  62. Ay modelinin bilgisayarı, simülasyonda hiç görülmemiş hatalar veriyordu.The lunar model's computer was throwing errors nobody had seen in simulation.
  63. Guido!
  64. Steve Bales'in bir karar vermesi için sadece birkaç saniyesi vardı.Steve Bales had seconds to make a call.
  65. İnişi iptal etmek ya da devam etmek.Abort the landing or press on.
  66. Stres altındaki tek bir zihin tüm misyonu iptal edebilirdi, ama Bales yalnız değildi.One brain under pressure could have scrubbed the whole mission, but Bales wasn't alone.
  67. Uzmanlarla dolu bir arka odası vardı.He had a back room full of experts.
  68. 24 yaşındaki mühendis Jack Garman, alarmı, ara sıra tekrarlıyorsa görmezden gelinebilecek bir bilgisayar aşırı yüklenmesi olarak tanıdı.Jack Garman, a 24-year-old engineer recognized the alarm as a computer overload that could be ignored if it was intermittent.
  69. Bales'e, "Bales, git, krayonlar kabul edildi" dedi.He told Bales, Bales call go, crayons accepted.
  70. 40 saniye sonra.40 seconds later.
  71. Neil Armstrong Ay'a indi.Neil Armstrong landed on the moon.
  72. Bu, tek bir ajanın karar vermesi değil.That's not a single agent making a decision.
  73. Bu, çoklu-ajan sistemi; uzmanlar, yedeklilik, doğrulama ve anlaşmazlığı çözme için net bir protokol.That's a multi-agent system, specialists, redundancy, verification, and a clear protocol for resolving disagreement.
  74. Yani çoğu insanın fark ettiğinden daha uzun süredir çoklu-ajan sistemleri yapıyoruz.So you could say we've been doing multi- agent systems longer than most people realize.
  75. Peki görev kontrolünü yapay zeka mimarisine nasıl getiririz?So how do we bring mission control into AI architecture?
  76. Tek bir ajanın cevap vermesi yerine, bir sistem tasarlıyorsunuz.Instead of one agent answering, you design a system.
  77. Bir ajan cevabı üretiyor.One agent generates the answer.
  78. Hızlı, yaratıcı ilk taslak düşünce.Fast, creative first draft thinking.
  79. Başka bir ajan doğruluyor.Another agent verifies.
  80. Olguları çapraz kontrol ediyor, halüsinasyonu yakalıyor.Cross-checks facts catches hallucination.
  81. Bu, o alarmın gerçek bir sorun olup olmadığını aslında bilen uzman Jack Garman.This is your Jack Garman, the specialist who actually knows if that alarm is a real problem.
  82. Ve rakip rolünü üstlenen üçüncü bir ajan.And a third agent that plays adversary.
  83. Görevi, sistemleri bozmak, kusurları bulmak ve nelerin ters gidebileceğini sorgulamak.Its job is to break things, find the flaws, ask what could go wrong.
  84. Güvenlikte buna kırmızı timleme diyoruz.In security, we call this red teaming.
  85. Yapay zeka sistemlerinde, bu muhtemelen inşa edeceğin en önemli ajan, çünkü sisteminin başarısız olmasını sağlamaya çalışan başka kimse yok.In AI systems, it might be the most important agent you build because nobody else is trying to make your systems fail.
  86. Amaç, kendi başına bir uzlaşı sağlamak değil.The goal isn't consensus for its own sake.
  87. Kazanılmış bir güven.It's earned confidence.
  88. Farklı bakış açılarına sahip birden fazla ajan anlaştığında, çıktıya gerçekten güvenebilirsin.When multiple agents with different perspectives agree, you can actually trust the output.
  89. Anlaşamadıklarında, bu bir sinyaldir.When they disagree, that's a signal.
  90. Daha derine in, bir insana yönlendir, sadece yayınlama.Dig deeper, escalate to a human, don't just ship it.
  91. Bu, dört I ilkesidir.This is the four I's principle.
  92. Otomatikleştir.Automate it.
  93. Bu, makine hızında çalışan tümör konseyidir.This is the tumor board at machine speed.
  94. Bu, mimariye yerleştirilmiş kurumsal bilgeliktir.This is institutional wisdom built into the architecture.
  95. Şimdi bakın, her sohbet botunun arkasında bir görev kontrol odası olması gerektiğini söylemiyorum.Now look, I'm not saying every chatbot needs a mission control room behind it.
  96. Film öneren veya makaleleri özetleyen bir şey geliştiriyorsan, tek ajan yeterli.If you're building something that recommends movies or summarizes articles, single agent.
  97. Basit tut.Keep it simple.
  98. En kötü senaryo, birinin kötü bir film izlemesidir.The worst case scenario is someone watches a bad film.
  99. Bu düşük riskli.This is low stakes.
  100. Peki, soracağım soru şu.Well, here's the question I'd ask.
  101. Yapay zekanız yanıldığında ne olur?What happens when your AI is wrong?
  102. Eğer sonuç hafif bir rahatsızlık ise, tek ajan yeterli.If the answer is mild inconvenience, single agent is fine.
  103. Ama sonuç dava, hasta zarar görmesi, düzenleyici ihlal veya CEO'nun gece 2'de araması ise, sistemin içine doğrulama mekanizması yerleştirmeniz gerekir.If the is lawsuit, patient harm, regulatory violation, or my CEO calls me at 2 a.m., you need verification built into the system.
  104. Sağlık, finans, hukuk ve güvenlik kritik operasyonlar; ekiplerin yapay zeka ajanlarını devreye almak istediği tam da bu alanlar.Healthcare, finance, legal, safety critical operations, these are exactly the domains where teams want to deploy AI agents.
  105. Ve tek ajanın güveninin bir gün manşetlere çıkacağı alanlar da bunlar.And these are the domains where single agent confidence will eventually become front page news.
  106. Sorun, çoklu ajan mimarisini karşılayıp karşılayamamanız değil; yanlış cevapta yapay zekanızın neden bu kadar emin olduğunu bir hakime nasıl açıklayacağınızı karşılayıp karşılayamamanız.The question isn't whether you can afford multi-agent architecture, it's whether you could afford to explain to a judge why your AI was so confident about the wrong answer.
  107. Yüksek riskli ortamlar için sistemler geliştirirken çoklu ajan mimarisinin uygulanma maliyeti haklı çıkar.The cost of implementing multi-agent architecture is justified when building systems for high-stakes environments.
  108. Hataların ağır sonuçları olabileceği yerlerde.Where errors can have severe consequences.
  109. Bugün öğrendiğimiz şey, bu sorunu zaten çözmüş olduğumuz.What we learned today is that we solve this problem already.
  110. 60 yıl önce NASA, ne kadar uzman olursa olsun, hiçbir tek kişinin tek başına kritik bir karar veremeyeceği bir sistem kurdu.60 years ago, NASA built a system where no single person, no matter how expert, could make a critical call alone.
  111. Her karar birden fazla uzman tarafından onaylandı.Every decision passed through multiple specialists.
  112. Her "onay" varsayılmadı, kazanıldı.Every go was earned, not assumed.
  113. Bunu hayatlar tehlikede olduğu için yaptılar ve işe yaradı.They did it because lies were on the line, and it worked.
  114. Önemli kararlar veren yapay zeka sistemleri geliştiriyorsanız, bir seçiminiz var.If you're building AI systems that make decisions that matter, you have a choice.
  115. Tek bir ajana güvenip doğru olmasını umabilirsiniz ya da tıpta, finansda, havacılıkta ve uzay keşfinde yaptığımız gibi doğrulamayı mimarinin içine inşa edebilirsiniz.You can trust one agent and hope it's right, or you can build a verification into the architecture the same way we've done for medicine, finance, aviation, and space exploration.
  116. Tek bir beynin kör noktaları vardır.One brain has blind spots.
  117. Birden fazla beyin, diğerlerinin kaçırıp göremediğini yakalar.Multiple brains catch what others miss.
  118. Bu bir gereksiz yük değil.That's not overhead.
  119. Güvenilir sistemler inşa etmenin yoludur.That's how you build systems worth trusting.
  120. Teşekkürler.Thank you.
Altyazı bilgisayarımda üretildi ve videoyla ilerler; bir satıra tıklayın, o ana atlasın.Subtitles generated on my computer; they follow the video — click a line to jump there.

Çoklu AI Ajan Sistemleri: Tek Bir AI Beyni Neden Yetersiz Kalır?Multi AI Agent Systems: When One AI Brain Isn’t Enough

Tekil AI ajanlarının halüsinasyon ve yanlış güven sorunlarını çözmek için çoklu ajan sistemlerinin neden gerekli olduğunu açıklıyor.It explains why multi-agent systems are necessary to address the hallucination and overconfidence issues of single AI agents.

Bu video youtube.com üzerinde yayımlandı; buradaki oynatıcı YouTube’undur. Türkçe özet ve altyazı AiPulse için hazırlanmıştır.This video is published on youtube.com; the player here is YouTube’s. The Turkish summary and subtitles are prepared for AiPulse.
YouTube’da izleWatch on YouTube    AI Kritik →AI Critique →
Bültene dönBack to the issue