标签: OpenAI

医生这个职业可能真的要重新定义自己的位置了。谷歌研究员干了一件狠事,他们把AI扔进了模拟的临床规培体系,不是让它背题库,而是逼它每天面对数千个难缠的虚拟病人。以前那些大语言模型最多也就是在多选题里拿高分,但那根本不叫临床医学。真正的临床是对话,是患者在描述症状时模棱两可,是你在信息不完整的情况下被迫做判断,是你得在病人说不舒服但又说不清哪里不舒服的时候稳住阵脚。 这套系统用的是在线强化学习框架,AI要连续和病人来回问答最多六十轮,中途…

医生这个职业可能真的要重新定义自己的位置了。谷歌研究员干了一件狠事,他们把AI扔进了模拟的临床规培体系,不是让它背题库,而是逼它每天面对数千个难缠的虚拟病人。以前那些大语言模型最多也就是在多选题里拿高分,但那根本不叫临床医学。真正的临床是对话,是患者在描述症状时模棱两可,是你在信息不完整的情况下被迫做判断,是你得在病人说不舒服但又说不清哪里不舒服的时候稳住阵脚。 这套系统用的是在线强化学习框架,AI要连续和病人来回问答最多六十轮,中途…

谷歌研究员用在线强化学习框架训练了一个名叫 ResidencyRL 的临床推理 AI,让它连续与数千个刁钻的“虚拟病人”进行最多 60 轮诊疗对话。双盲评估显示,专家在 87.6% 的场景中更认可这个模型,红旗症状漏诊率下降 31%。这是大语言模型第一次被拉进完整临床决策流程里接受检验。