美国排名第一的医院,AI错误率高达67%丁香园
妙佑诊所一款 AI 被曝错误率高达 67%,举报者随后遭到解雇?
近日,前妙佑诊所前研究运营总监、AI 合规负责人将这家知名医疗机构告上美国明尼苏达州联邦法院。
她指控,自己在内部报告 AI 研究、患者隐私和伦理审查等问题后,遭到排挤、降职,并最终被解雇。
妙佑诊所的 AI,错误率高达 67%?
此次争议的核心,是妙佑诊所一项名为 MAYA 的数字助手研究。
MAYA 是一款面向妙佑员工的院内信息检索工具。普通员工可以通过它查询院内资料,例如 IT 系统操作说明;拥有电子病历访问权限的员工,还可以用它检索临床数据系统。
图源:妙佑诊所
根据原告的说法,MAYA 项目存在修改研究结果、删除不利数据,以及使用未经监管授权的软件等问题。
诉状称,研究团队在未取得监管授权的情况下使用了一款软件即医疗器械(Software as a Medical Device,简称 SaMD),将其接入 MAYA 所涉及的常规临床工作流。
文中形容,该 SaMD 项目「存在严重缺陷,甚至到了近乎腐败的程度」,并指出其问题与 MAYA 项目在临床流程中的应用密切相关。
同时,另有 10 份独立的内部举报报告提出类似警告,指相关 AI 工具在测试中出现约 67% 的错误率。
除 MAYA 外,原告还指控,妙佑诊所在患者数据去标识化和全球共享、NIH 资助的基因组数据使用、生物样本商业出售,以及一项涉及高风险研究性医疗器械的境外心脏手术中,存在绕过或弱化机构审查委员会,也就是 IRB 审查的问题。
图源:妙佑诊所
2025 年 2 月,这位负责人将 MAYA 研究及相关心脏手术问题书面举报至妙佑法律部门。诉状称,此后她很快被排除在部分管理会议之外,原有职责也逐渐被转交给其他人,并被告知高层已要求「尽快除掉她」。
此前,她才刚刚获得约 7000 美元加薪,被评价为「有价值的合作伙伴」;仅两周后,她便被要求主动辞职,否则可能面临不利的人事记录。
2025 年 4 月,她被列入绩效改进计划;7 月又被撤去团队管理职责,并出现严重抑郁发作。她随后申请病假,最初遭到拒绝,在律师介入后才获得批准。
休假期间,她被告知岗位因裁员被取消,且那轮调整中只有她的岗位被撤销。
此后,她在 90 天内部转岗期内申请了约 15 个职位,仅获得一次面试,并于 2025 年 12 月 1 日正式离职。
她因此以举报报复、残障歧视等理由起诉妙佑诊所。
妙佑诊所目前没有逐项回应上述指控,妙佑仅表示,其 AI 研发和临床创新遵守相关法律法规,隐私、安全、透明度和合规性贯穿相关流程。
由于诉讼仍在进行,妙佑拒绝进一步评论。目前,案件尚未经过法院审理。
AI 和医生,谁的错误率更高?
事件曝光后,有人在评论区反问:「敢不敢公布医生的错误率?」
图源:社交媒体
现有研究中,确实有部分医疗 AI 在影像识别、病例排序和标准化问答等特定任务上达到甚至超过医生;也有不少研究发现,AI 会遗漏关键信息、生成错误内容,或者在真实临床环境中出现明显的性能下降。
但不同研究的病例难度、医生资历、模型版本、评价标准和「错误」定义并不相同,简单比较准确率,很容易得出误导性结论。
相比谁更容易出错,更关键的问题是,当错误出现时,是否被记录、被披露、被纠正。
图源:视觉中国(与本文无关)
2023 年,美国 Epic 电子病历系统中集成的一款生成式 AI 工具在测试中被发现会生成带有虚构信息的临床总结,部分医院因此暂停上线。
同年,斯坦福大学研究团队评估多款医疗问答模型时发现,它们在回答癌症相关问题时,存在一定比例的错误甚至潜在有害建议。
这些案例说明,医疗 AI 的风险不在于单次失误,而在于错误可能被忽视、被误信,甚至在系统中被放大。
因此,从数据记录、研究透明,到上线前验证和上线后的持续监测,每一个环节都直接关系到系统的安全性。
毕竟,它面对的不是一道考试题,而是真实患者的隐私、健康和生命。


