实际部署脑力工作自动化2024-04-01
阿勒格尼县自述:主管定期推翻算法默认建议,立案后评分对调查员不可见
社工职业页 →事件日期 / 报道日期
2024-04-01 · 报道于 2024-05-31
证据阶段
实际部署企业已正式投入使用。可以改变基线,但要结合规模与场景相似度加权。
关联任务
评估风险并应对危机
判断一个孩子或脆弱的成年人是否安全、上门家访,并在他们不安全时采取行动 —— 包括动用法定权力。
仍由人主导✓ 有证据支撑
适用范围
阿勒格尼县人力服务部在自己的分析站点上发布了这份综述,汇总了关于阿勒格尼家庭筛查工具(AFST)的外部同行评审论文与工作论文——该县自 2016 年起用这套工具,帮助接线筛查员判断一份疑似虐待或忽视儿童的报告是否要立案调查。文件标注日期为 2024 年 4 月,发布于 2024 年 5 月 31 日,是第一方对工具实际用法的说明,不是厂商对其能力的描述。文件里有三句话承载了这一任务的判断。第一,关于决定本身:该县写明 AFST 的风险信息是"在转介流程中与其他信息一并使用",接线主管"有裁量权推翻默认选项,而且经常这样做",过去主管推翻了约四分之一的强制"立案"建议。第二,关于立案之后:一旦一份转介被筛查为立案调查,"无论是指派的调查员还是任何个案工作者,都从未看到过 AFST 分数,所以它不影响对虐待的最终判断,也不影响是否立案或是否把孩子带离家庭的决定"——这个分数根本不会触及那项具有法定效力的决定。第三,引用 De-Arteaga 等人(2020 年)的研究:在一次系统故障导致部分分数显示错误的期间,筛查员实际做出的决定,比起显示的错误分数,反而更贴近真实的风险水平——该县把这一点读作员工在运用独立判断,而不是照搬屏幕上的数字。这份文件没有确立的是:个案量、人员编制、一次筛查决定要花多久,以及这一切在这一个县的儿童福利热线之外能不能成立。阿勒格尼县自己建造、出资并运营这套工具,所以它自述的克制,和一次外部审计得出同样结论并不是一回事——不过文中引用的学术研究本身独立于该县。
这意味着什么
在接线阶段给出风险提示的工具,和做出决定的人不是同一个。阿勒格尼县自述:主管可以、也经常推翻算法的默认建议;而一旦案件被立案调查,风险分数就彻底消失 —— 调查的人、以及任何带离儿童的决定,都看不到它。
还不能说明什么
这只是一个县自己的儿童福利热线,不是对个案量、人员编制或一次筛查要花多久的测量,也说不了这个场景之外的社工工作。这套工具是该县自己建造并运营的,所以它自述的克制,不等于一次外部审计得出同样的结论。
你可以核实什么
去问你所在场景里负责风险分诊的人一个问题:工具标出一个案子之后,在不可逆的行动发生前,最后经手的人是谁,这个人的名字能不能在记录上找到?
是否改变评估
否。影响指数不会被单条事件改变。这条记录做到的是:上面 1 项关联任务的判断从「推断」变成了「有证据支撑」。
来源
Allegheny County Department of Human Services — Summarizing Recent Research on Predictive Risk Models in Child Welfare (April 2024) · 核实于 2026-09-24 · VOLO agent loop · 解读于 2026-09-24 · VOLO agent loop
一手来源 —— 由做这件事的当事人或记录的权威机构发布,无需联署。