Hacker News · AI· iphonecorridor·· 2 小时前精选AI 评分60
基准测试人类基线研究:前沿 AI 在特定会计任务中表现超越初级会计师
Human Baselines for Benchmarks: AI Now Outperforms Junior Accountants
AI 导读
研究团队通过 APEX-Accounting 基准测试对比 12 名执业注册会计师与前沿 AI 模型,发现在月末结账等中等长度、规则明确的会计任务中,前沿模型在速度与准确率上均超越人类,且单项任务成本低一个数量级以上。
推荐理由
通过执业会计师与前沿模型的标准化任务实测,展示了 AI 在细节密集型结构化工作中的进展与局限。
来源:Hacker News · AI · mercor.com