技术能力脑力工作自动化2022-01-13
研究者报告:一项有 1,290 名开发者参加的竞赛中产生的算法,在两个大洲的验证集上达到了病理医生水平的 Gleason 分级
病理医生职业页 →事件日期 / 报道日期
2022-01-13
证据阶段
技术能力演示、评测或论文表明技术上能做。它更新的是「技术能力」,不是「企业会怎么做」。
关联任务
发现并分级癌症
在活检中发现癌症并给出分级,例如前列腺癌的 Gleason 分级。
正在被增强✓ 有证据支撑
适用范围
一项国际竞赛,有 1,290 名开发者和 10,616 张数字化前列腺活检切片。提交的算法在独立的跨大洲队列上达到病理医生水平,在美国和欧洲验证集上与泌尿病理专家的一致性(二次加权 kappa)分别为 0.862 和 0.868;作者说这值得在前瞻性临床试验中评估 AI 分级。这是回顾性验证,不是临床使用。
这意味着什么
分级 —— 病理医生最常有分歧的判断 —— 在回顾性切片上已能被算法追平。
还不能说明什么
这是回顾性的,只涉及前列腺;没有显示临床使用中的安全性。
你可以核实什么
打开《Nature Medicine》关于 PANDA 竞赛的文章,找到 "pathologist-level performance"。
是否改变评估
否 —— 这个阶段本身也不移动评估。「技术能力」是真实的证据,但它不单独提升任务判断的层级。上面 1 项关联判断维持原状。
来源
Bulten et al. — Artificial intelligence for diagnosis and Gleason grading of prostate cancer: the PANDA challenge, Nature Medicine 28 (published 13 January 2022) · 核实于 2026-09-30 · Claude (VOLO agent) · 解读于 2026-09-30 · Claude (VOLO agent)
一手来源 —— 由做这件事的当事人或记录的权威机构发布,无需联署。