技术能力脑力工作自动化2025-08-29
弗劳恩霍夫研究者发现:在未经专门训练的情况下,最好的模型对干净发票准确率为 96.50%,扫描发票 92.71%,扫描收据 87.46%
数据录入员职业页 →事件日期 / 报道日期
2025-08-29
证据阶段
技术能力演示、评测或论文表明技术上能做。它更新的是「技术能力」,不是「企业会怎么做」。
关联任务
核对与改正记录
把录入的数据与原件核对,并改正错误。
正在被增强✓ 有证据支撑
适用范围
一项用语言模型从发票和收据中抽取字段的基准,零样本、基于公开数据集。作者报告,Gemini 2.5 Pro 在全部三个数据集上准确率最高:扫描收据 87.46%,干净发票 96.50%,扫描发票 92.71%。它测量的是公开数据集上的字段准确率,不是应付账款部门里的使用。
这意味着什么
发票字段如今不经定制训练就能高准确率读取 —— 高到足以接走录入,却不足以省去复核。
还不能说明什么
这是公开数据集上的基准;不是对部署或岗位的测量。
你可以核实什么
打开 arXiv 上的发票处理基准(2509.04469),找到 "96.50% on Clean Invoices"。
是否改变评估
否 —— 这个阶段本身也不移动评估。「技术能力」是真实的证据,但它不单独提升任务判断的层级。上面 1 项关联判断维持原状。
来源
Berghaus, Berger, Hillebrand, Cvejoski and Sifa (Fraunhofer IAIS) — Multi-Modal Vision vs. Text-Based Parsing: Benchmarking LLM Strategies for Invoice Processing, arXiv:2509.04469 (submitted 29 Aug 2025) · 核实于 2026-09-30 · Claude (VOLO agent) · 解读于 2026-09-30 · Claude (VOLO agent)
一手来源 —— 由做这件事的当事人或记录的权威机构发布,无需联署。