Claude Opus 5, muhasebe görevlerinde sertifikalı muhasebecileri geride bıraktıClaude Opus 5 outperforms certified accountants in accounting tasksHabere gitRead the article Türkçe (otomatik çeviri) English (automatic translation) |
ÖzetSummaryRohan Paul, Mercor'un araştırmasına atıfta bulunarak, Claude Opus 5'in orta uzunlukta ve iyi tanımlanmış muhasebe görevlerinde dakikalar içinde 20/20 mükemmel bir sonuç aldığını bildiriyor. Buna karşılık 12 lisanslı CPA, 3 saatlik süre içinde işi bitiremeyenler dahil olmak üzere %0 ile %90 arasında değişen puanlar aldı. Kriter başına maliyet farkı da çarpıcıydı: Model için 0,21 dolar, insan muhasebeciler için ise 10,35 dolar.Rohan Paul, citing Mercor's research, reports that Claude Opus 5 achieved a perfect 20/20 score within minutes on medium-length, well-defined accounting tasks. In contrast, 12 licensed CPAs scored between 0% and 90%, with some failing to complete the work within a 3-hour timeframe. The cost difference per criterion was also striking: $0.21 for the model versus $10.35 for human accountants. |
Neden ÖnemliWhy it mattersÖncü modeller, yapılandırılmış ve kural tabanlı işlerde artık junior seviyedeki profesyonellerle yarışabiliyor veya onları geçebiliyorsa, beyaz yakalı arka ofis işlerinin büyük bir kısmını otomatize etmenin ekonomik gerekçesi spekülasyondan somut bir duruma dönüşüyor. İnsan performansının altında olmaktan üstüne çıkmaya giden 18 aylık seyir, bu açığın hızla genişlediğine işaret ediyor. Bu durum, şirketlerin personel sayısını ve eğitim süreçlerini yeniden düşünmesine yol açıyor. Ayrıca, bu sertifikaların kodladığı 'kural uygulama' katmanı giderek emtialaştıkça, profesyonel sertifikaların değer önerisini de yeniden çerçevelemesi gerekiyor.If leading models can now compete with or outperform junior-level professionals in structured, rule-based work, the economic case for automating a significant portion of white-collar back-office tasks is shifting from speculation to reality. The 18-month trajectory from underperforming to outperforming human baselines indicates that this gap is widening rapidly. This situation is prompting companies to rethink headcount and training processes. Furthermore, as the 'rule application' layer encoded in these certifications becomes increasingly commoditized, the value proposition of professional certifications needs to be reframed. |
Öne ÇıkanlarHighlights
|
EleştiriCritical takeAraştırma, kapsamı 'orta uzunlukta ve iyi tanımlanmış' görevlerle sınırlıdır ve junior muhasebecilerle kıyaslama yapar. Bu nedenle sonuçları karmaşık, yargı ağırlıklı veya belirsiz muhasebe işlerine genellemek yerinde değildir. Ayrıca Mercor, yapay zekânın üstünlüğünü göstermede ticari bir çıkarı vardır. 12 kişilik CPA örneklemi ve %0–90 aralığındaki dağılım, 'insanlar kaybetti' başlığını verilerin katı olarak desteklediğinden daha dramatik hale getiriyor.The study is limited to 'medium-length and well-defined' tasks and compares performance against junior accountants. Therefore, generalizing these results to complex, judgment-heavy, or ambiguous accounting work is inappropriate. Additionally, Mercor has a commercial interest in demonstrating AI superiority. The sample of 12 CPAs and the 0–90% distribution make the 'humans lost' headline more dramatic than the data strictly supports. |