OpenAI 请数百名医生把关 ChatGPT 健康建议:已审核超70万条回复

OpenAI 组建了一支覆盖 49 种语言、数百名执业医生的网络,专门审核 ChatGPT 的健康建议是否存在误导和安全隐患。截至今年 7 月,这些医生已审核超 70 万条回复,每周有超过 3 亿人向 ChatGPT 咨询健康问题。

一句话看懂:OpenAI 组建了一支覆盖 49 种语言、数百名执业医生的网络,专门审核 ChatGPT 的健康建议是否存在误导和安全隐患。截至今年 7 月,这些医生已审核超 70 万条回复,每周有超过 3 亿人向 ChatGPT 咨询健康问题。

事件核心:发生了什么

据 Business Insider 报道,OpenAI 已招募数百名来自肯尼亚、尼泊尔、巴西等地的执业医生,以兼职合同形式评估 ChatGPT 在健康场景中的对话样本。这项工作由 2024 年加入 OpenAI 的 Rebecca Soskin Hicks 主导,她与负责健康研究的 Karan Singhal 合作搭建了这支团队。医生们不直接参与模型训练数据标注,而是识别模型在模糊、信息不完整的医疗对话中可能误导用户或带来身体风险的地方。

截至今年 7 月,医生网络已审核超过 70 万条 ChatGPT 回复。根据医生反馈,研究团队会寻找新的数据和训练方法,改善模型在紧急分诊、追问缺失信息、表达不确定性和控制回答详细程度上的表现。OpenAI 健康产品负责人 Ashley Alexander 强调,ChatGPT 不应用于诊断和治疗,其服务条款也有相应说明。此前 7 月,一名牧师起诉 OpenAI,称 GPT-4o 对其肺部健康危机存在误诊和轻描淡写。

为什么重要

医疗是 AI 落地中风险最高的领域之一:错误建议可能造成真实伤害,而法律和监管框架仍不清晰。OpenAI 在诉讼压力下没有收缩健康相关功能,而是选择加大人工审核投入,说明它押注“医生参与评估”能成为模型安全迭代的一部分。目前公开信息显示,这套机制更接近评测和反馈闭环,而不是已获监管批准的临床工具。它也在一定程度上回应了外界对 AI 健康建议“是否可靠”的质疑。

从竞争格局看,谁能在健康建议上把误判率降下来,谁就更容易拿到用户信任。OpenAI 已将 Apple Health 和部分医疗记录接入 ChatGPT,并称 GPT-6 Astra 在健康基准测试中表现“state of the art”,但这些结论仍限定在特定评测条件下,不能等同于临床效果已被验证。

对用户/开发者/创作者的影响

对普通用户来说,ChatGPT 在健康问题上的回答可能更谨慎、更倾向于追问细节和提示不确定性,但这不代表可以替代医生。对开发者和创作者,如果基于 ChatGPT API 构建健康类应用,需要留意 OpenAI 服务条款中“不用于诊断和治疗”的边界,以及医疗建议相关的合规风险。医生反馈驱动的改进方向——紧急分诊、信息补全、不确定性表达——也可能逐步体现在 API 行为中,值得在评测和产品设计时纳入测试。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是医生审核机制是否会从评测走向更正式的产品功能或安全认证;二是 GPT-6 Astra 等模型在健康基准上的表现能否被第三方研究复现;三是相关诉讼和监管是否会促使 OpenAI 调整健康类功能的开放范围。

来源:Business Insider

celebrityanime
celebrityanime
文章: 28023

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注