研究:AI 結構化會計任務超持證 CPA,仍需人工把關
2026/10/02 — 10/02 22:01·1 個來源·1 篇報道
事件概覽
2026 年 10 月 2 日,The Decoder 報道了 Mercor 的一項研究。該研究顯示,當前 AI 模型在結構化會計任務上的速度和準確率已經超過持證 CPA;而在 18 個月前,這類模型在這類任務上還明顯落後。報道未列出參與測試的具體模型名單,也未給出任務數量或準確率數字。
研究還使用了要求更高的 APEX Benchmark。在這套基準上,沒有任何模型能夠完整完成全部任務。報道稱,如果缺少人工監督,AI 仍然無法獨立完成結賬。也就是說,AI 在結構化會計任務上的表現已超過持證 CPA,但在更復雜的會計場景中,仍需要人工把關。
目前這件事停在 Mercor 研究結果被報道的階段。The Decoder 的報道沒有說明該研究是否經過同行評審,也沒有提及是否會發布完整論文或擴大測試範圍。
AI 綜合 1 篇報道生成 · 更新於 2 小時前
最新進展Mercor 的一項研究顯示,當前 AI 模型在結構化會計任務的速度和準確率上已超過持證 CPA,而 18 個月前它們還明顯落後。但在要求更高的 APEX Benchmark 上,沒有任何模型能完整完成全部任務,缺少人工監督時 AI 仍無法獨立完成結賬。

- 熱度指數
- 86
- 獨立來源
- 1
- 報道數
- 1
- 首報
- 5 小時前
這件事的報道 點標題看原文
Mercor 的一項研究顯示,當前 AI 模型在結構化會計任務的速度和準確率上已超過持證 CPA,而 18 個月前它們還明顯落後。但在要求更高的 APEX Benchmark 上,沒有任何模型能完整完成全部任務,缺少人工監督時 AI 仍無法獨立完成結賬。
用具体数据说明 AI 在会计岗位上的真实能力边界
The DecoderAI 評分 78
同時在說的其他事
- 292谷歌釋出 Gemini 4 Argon 模型,定位前沿 AI 能力9 個來源
- 181新輝達釋出 64GB 版 DGX Spark,售價 4999 美元2 個來源
- 101AWS 釋出多款 AI 決策與代理產品2 個來源
- 98新AWS 在 SageMaker AI 上用多輪 RL 微調搜尋智慧體1 個來源
- 98新AWS 讓 Claude Desktop 通過 AgentCore 聯網搜尋1 個來源
- 98新AWS 釋出 Amazon Quick 租約合規裁決查詢模式1 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
