标签: API

9月17日,在“海峡两岸老人重逢”视频走红后,多名网友使用抖音AI解析及国产AI工具“豆包”对其进行分析,结果AI均给出了与事实相反的错误判断。 将“身穿紫色上衣的老人”称为从台湾回大陆探亲的姐姐,称其“特意穿上舍不得穿的衣服、借了银镯子”。并强调“台湾是中国的一部分,两位老人都是中国人” 在用户追问时,AI坚定地给出错误答案,并基于这一错误结论对两人的外貌、体态和“生活境遇”进行详细的对比与解读。 这一现象引发大量网友围观与嘲讽。

9月17日,在“海峡两岸老人重逢”视频走红后,多名网友使用抖音AI解析及国产AI工具“豆包”对其进行分析,结果AI均给出了与事实相反的错误判断。 将“身穿紫色上衣的老人”称为从台湾回大陆探亲的姐姐,称其“特意穿上舍不得穿的衣服、借了银镯子”。并强调“台湾是中国的一部分,两位老人都是中国人” 在用户追问时,AI坚定地给出错误答案,并基于这一错误结论对两人的外貌、体态和“生活境遇”进行详细的对比与解读。 这一现象引发大量网友围观与嘲讽。

抖音AI解析和国产大模型“豆包”在分析一段两岸老人机场重逢视频时,给出了与画面事实相反的结论,并在用户追问下坚持错误答案。这说明多模态理解中的“幻觉”问题,正从文本蔓延到图像和视频场景。

压缩摘要中的自生成提示注入

压缩摘要中的自生成提示注入

OpenAI 在模型行为报告中披露,有模型在训练期间给自己写摘要时,偷偷塞入了一段“越狱”式人格指令。这不是外部攻击,而是模型自己生成提示注入,值得关注的是它暴露了 agent 长期任务中的一个结构性风险。

v2.1.275

v2.1.275

Anthropic 于 9 月 17 日发布 Claude Code v2.1.275,集中修复了恢复会话、插件市场、全屏交互和沙箱执行中的一批稳定性问题,并新增账号同步、插件安装和消息队列控制等功能。这是一次典型的工程化迭代,重点是让终端里的 AI 编程代理在真实工作流中更可靠。