实际部署脑力工作自动化2026-01-28
2025 年美国联邦 AI 用例清单列出 227 套机构自评高影响且已投产的系统:测试记为已完成的 44 套、进行中 81 套、留空 102 套
算法 / 机器学习工程师职业页 →事件日期 / 报道日期
2026-01-28
证据阶段
实际部署企业已正式投入使用。可以改变基线,但要结合规模与场景相似度加权。
关联任务
决定什么才算够好
做出那套测试集、选定那个指标,并说出这东西现在能不能用在真实的人身上。
仍由人主导✓ 有证据支撑
适用范围
按本站对统计序列的处理方式,在本地从逐条上报的 CSV 算出来:整份文件拉下来,计数在这里做,读者可以复算。筛法:development_stage 为 Deployed 且 is_high_impact 为 High-impact,在 1,040 条已投产里得到 227 条。hi_testing_conducted 一栏于是是:Yes 44 条、In-progress 81 条、空 102 条。影响评估一栏:Yes 36、In-progress 90、空 101。独立复核一栏从未以「已完成」出现:31 条写的是首席 AI 官复核、4 条内部独立复核、1 条监督委员会,89 条进行中,102 条空。运行授权一栏:Yes 69、No 60、空 98。选择「高影响」这个标签、填这些栏目的是联邦机构自己,不是本站,依据是 EO 13960、《推进美国人工智能法案》与 OMB 备忘录 M-25-21。这些计数立住的,是机构就自己上线前那道闸门写下了什么;一栏留空就是留空,不是「否」,而一个「是」是自报,这里没有任何人核过。日期取 OMB 发布合并清单的那一天(仓库建于 2026-01-28);底下那些部署横跨多年,文件没有给这一批一个统一日期。
这意味着什么
这项任务描述的那道闸门 —— 说这东西现在能不能用在真人身上 —— 正是这几栏记的东西,而机构自己的申报显示,在它们自评为高影响、且已投产的系统里,大多数这道闸门还没走完。这份工作没有在消失;文件显示的是它有多经常是事后补做的,或者根本没写下来。
还不能说明什么
一栏留空不等于「否」,一个「是」是自报,这里没有人核过。这些计数不说任何一次测试的质量,也不说 227 套系统里有哪一套管用。它们描述的还是一个不寻常的雇主:美国联邦政府是极少数必须公布这类东西的雇主之一,所以这些数字之所以看得见,是因为它被要求了,不是因为这个雇主比那些什么都不公布的更差。
你可以核实什么
挑一套你或你的团队放到真人面前的系统。写下它上线前是对着什么测的、谁签的字。如果五分钟内拿不出这两样,你手里就是这些机构填的那个空栏 —— 而现在你对自己的工作知道了这一点。
是否改变评估
否。影响指数不会被单条事件改变。这条记录做到的是:上面 1 项关联任务的判断从「推断」变成了「有证据支撑」。
来源
OMB — 2025 Federal Agency AI Use Case Inventory (computed over the individually-reported CSV) · 核实于 2026-09-20 · Claude (agent) · 解读于 2026-09-20 · Claude (agent)
一手来源 —— 由做这件事的当事人或记录的权威机构发布,无需联署。