HaiAI123

全球AI工具精選導航

新熱點事件
86
熱度指數
新上榜

研究:AI 結構化會計任務超持證 CPA,仍需人工把關

2026/10/02 — 10/02 22:01·1 個來源·1 篇報道

事件概覽

2026 年 10 月 2 日,The Decoder 報道了 Mercor 的一項研究。該研究顯示,當前 AI 模型在結構化會計任務上的速度和準確率已經超過持證 CPA;而在 18 個月前,這類模型在這類任務上還明顯落後。報道未列出參與測試的具體模型名單,也未給出任務數量或準確率數字。

研究還使用了要求更高的 APEX Benchmark。在這套基準上,沒有任何模型能夠完整完成全部任務。報道稱,如果缺少人工監督,AI 仍然無法獨立完成結賬。也就是說,AI 在結構化會計任務上的表現已超過持證 CPA,但在更復雜的會計場景中,仍需要人工把關。

目前這件事停在 Mercor 研究結果被報道的階段。The Decoder 的報道沒有說明該研究是否經過同行評審,也沒有提及是否會發布完整論文或擴大測試範圍。

AI 綜合 1 篇報道生成 · 更新於 2 小時前

最新進展Mercor 的一項研究顯示,當前 AI 模型在結構化會計任務的速度和準確率上已超過持證 CPA,而 18 個月前它們還明顯落後。但在要求更高的 APEX Benchmark 上,沒有任何模型能完整完成全部任務,缺少人工監督時 AI 仍無法獨立完成結賬。

24 小時熱度峰值 98 · 4 小時前
24 小時前現在

這件事的報道 點標題看原文

昨天
  1. Mercor 的一項研究顯示,當前 AI 模型在結構化會計任務的速度和準確率上已超過持證 CPA,而 18 個月前它們還明顯落後。但在要求更高的 APEX Benchmark 上,沒有任何模型能完整完成全部任務,缺少人工監督時 AI 仍無法獨立完成結賬。

    用具体数据说明 AI 在会计岗位上的真实能力边界

    The DecoderAI 評分 78

同時在說的其他事

熱度怎麼算的?瞭解口徑

熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。

本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。

爆
討論快速增加
新
首報 6 小時內
發酵中
討論仍在增加

回熱點事件榜 →