Google 测试 AMIE 用于临床视频咨询

Google 正在将医疗对话大模型 AMIE 引入临床视频问诊场景测试,试图把 AI 从“文字问答助手”推进到“参与真实诊疗流程”的阶段。这一动向值得关注,因为它直接触及医疗 AI 商业化最难的一环:临床信任与落地路径。
先解决问题,再了解资讯。选择你现在要完成的任务。

Google 正在将医疗对话大模型 AMIE 引入临床视频问诊场景测试,试图把 AI 从“文字问答助手”推进到“参与真实诊疗流程”的阶段。这一动向值得关注,因为它直接触及医疗 AI 商业化最难的一环:临床信任与落地路径。

AI 领域知名研究者 Nathan Lambert 在完成一本强化学习(RLHF)教科书后复盘发现:大模型在长文技术写作上的能力几年几乎没有进步,与它在代码、数学上的飞跃形成鲜明对比。这说明模型在“组织已知知识并有效呈现”这类核心能力上存在短板,也挑战了外界对 AI 近期独立解决开放式科学难题的乐观预期。

LiquidAI 于 8 月 12 日发布 30 亿参数的视觉语言模型 LFM2.5-VL-3B,在屏幕理解、目标定位、函数调用等能力上大幅提升,为端侧本地部署视觉 AI 提供更实用的选择。

Google DeepMind发布手语转文字模型SL2T,并首次将其接入Pixel 11的Gboard和Live Transcribe,让美国手语用户可以像口语听写一样直接用手语输入。

Misc. bug: Pre-built Windows ROCm binary does not detect GPU 通常出现在只安装了 AMD Adrenaline 驱动、但没有单独安装 ROCm/TheRock SDK 的 Windows 机器上。优先检查是否已按 AMD 官方指引安装并配置

Thrive Holdings是一家以收购AI服务公司为核心策略的投资方,刚刚完成20亿美元募

荣耀今天在中国发布了一款“机器人手机”,将三轴云台直接集成到手机背面。经过一小时上手测试,The Verge 认为它可能不是噱头,而是把小型稳定器塞进手机后,少数真正能做到“好看也好用”的产品。

Anthropic 宣布,为满足欧盟《AI 法案》透明度要求,所有 Claude 模型生成的内容(含纯文本)将从发布首日起嵌入不可见统计水印,并回溯至现有模型。这是主流闭源大模型中首个公开确认“全文水印”方案的动作,直接影响大量依赖 AI 文本的创作者和开发者。

Nvidia正在推进新一代开放权重模型Nemotron 4,最大版本参数规模至少达到1万亿,试图追平中国实验室已经率先实现的大模型量级,同时这也让Nvidia站到了自己核心客户的对面。

OpenAI 发布两份研究报告,显示企业 AI 使用正从“提问/辅助”转向“执行/交付”,但前沿公司与普通公司的采用差距在半年内扩大了约三倍,使用深度正成为新的分水岭。