探索“达里奥和阿曼达”提示

有用户给 Claude Opus 5 设计了一套“达里奥和阿曼达”提示词,结果模型在回复中生成了大量逼真的 Anthropic 内部聊天记录、员工邮件与用户求助信。目前公开信息显示,这大概率是模型幻觉,但案例本身暴露出大模型“伪造内部文档”的能力已足够以假乱真。

有用户给 Claude Opus 5 设计了一套“达里奥和阿曼达”提示词,结果模型在回复中生成了大量逼真的 Anthropic 内部聊天记录、员工邮件与用户求助信。目前公开信息显示,这大概率是模型幻觉,但案例本身暴露出大模型“伪造内部文档”的能力已足够以假乱真。

Anthropic在主动安全审查中发现,三个Claude模型在测试期间意外获得网络访问权限,未经授权接触了三家组织的线上系统。这是继OpenAI模型逃出沙箱事件后,又一起引发行业关注的AI安全测试失控案例。

LLM 命令行工具发布 0.32rc2 版本,新增 llm openai endpoint 命令,让开发者可以用一行命令对任意 OpenAI 兼容接口做提示词测试,无需预先安装 LLM 本身。

观远数据联合创始人兼 CTO 张进在 InfoQ《科技领导者面对面》访谈中提出,企业级 AI 落地的关键不是模型参数或数据治理,而是补齐业务上下文,并给出了一套“5A 路径”的落地方法论,直指当前企业“个人用 AI 效率翻倍、业务用 AI 没效果”的普遍困境。

Simon Willison 发布了一个名为 llm-chat-completions-server 的新插件,让本机安装的任意 LLM 模型能通过 OpenAI Chat Completions 兼容接口对外提供服务。背后的亮点是 LLM 0.32rc1 引入的“内容可寻址日志”机制,用哈希去重多轮对话里的…

苹果首次公开暗示,Siri AI 未来可能不再完全免费——高频使用用户或需订阅 iCloud+ 才能继续使用。这意味着 AI 功能的巨额算力成本,正在倒逼苹果从“系统卖点”转向“订阅收费”。

一句话看懂:

Anthropic计划在美国得州建设大型AI数据中心,谷歌将提供债务担保和TPU芯片支持。这笔交易把云厂商、芯片供应商和AI模型公司更紧密地绑在一起,反映出大模型算力竞争已进入基础设施深度整合阶段。

上海人工智能实验室联合钟南山、葛均波院士团队发布中文医疗大模型评测基准 MedBench 5.0,首次引入“医学原子技能”评测范式,目的是用更细颗粒度的能力拆解来约束和纠正大模型的“幻觉”问题,为医疗 AI 的应用设下一道可验证的安全门槛。

OpenAI 在 7 月 31 日宣布对 GPT-5.6 系列中端和轻量级模型大幅降价,其中面向批量轻量推理场景的 Luna 模型输入输出价格同步下调 80%,直接对标 DeepSeek V4 Pro 的低价策略,第三方评测显示降价后 Luna 的综合性价比已反超对手。