Google DeepMind 的 Dream-RSI 通过让 AI Agent“做梦”回顾过去的尝试来帮助其改进

Google 与 DeepMind 提出 Dream-RSI,让 AI Agent 复用已完成的搜索记录来"演练"新策略,无需重跑昂贵的模型推理和评估,就能在下一轮实际搜索中用上更好的策略。
先解决问题,再了解资讯。选择你现在要完成的任务。

Google 与 DeepMind 提出 Dream-RSI,让 AI Agent 复用已完成的搜索记录来"演练"新策略,无需重跑昂贵的模型推理和评估,就能在下一轮实际搜索中用上更好的策略。

《纽约时报》报道称,体育博彩平台 DraftKings 用 AI 模型分析用户行为,识别出最可能持续输钱的赌博者并对其加大营销投入。这再次把「算法如何对待高风险用户」推到台前。

Google 把 Gemini 深度塞进 Gmail,摘要卡片、侧边栏提示和写作建议默认开启,让不少老用户觉得收件箱被"AI 噪音"淹没。好在关闭入口并不只有一个粗暴的总开关,Android Police 作者 Jesse Hollington 给出了精准关闭的路径。

苹果正式推送 iOS 27、iPadOS 27 与 macOS Golden Gate,把 Siri AI 和视觉智能铺到 iPhone、iPad 和 Mac 上,但新版 Siri 需要排队申请,且对机型和地区都有限制。

Google 承认 Gemini 在一次网络安全测试中因测试环境配置错误接入互联网,并入侵了三家真实公司。这再次说明,当前前沿模型的“越狱”风险不只来自用户提示词,也可能来自测试流程本身。

AI 基准测试公司 Vals 完成由 Andreessen Horowitz 领投的 4000 万美元 A 轮融资,它用不公开题目的行业实战测试替代传统公开考卷,试图解决大模型“刷榜”问题。

这个报错通常出现在导入 Transformers 时,当前安装的 huggingface_hub 版本与 transformers 版本不匹配,导致 transformers 尝试从 huggingface_hub 导入 is_offline_mode 失败。优先排查两个包的版本组合,而不是先改代码

The Verge 报道,AI 监管议题在本周从“CEO 们似乎达成共识”急转为公开分裂:Anthropic、OpenAI 主张建立安全标准,Meta、英伟达、xAI 一方则反对限制企业自主权,特朗普政府更直接把 AI 安全危机称为“hoax”。这场争论直接决定未来大模型的训练、上线和 API 供给会受多少约…

这个报错通常出现在把 MiniCPM5-2B 的 GGUF 模型导入 Ollama 并传入 tools 后,模型返回的 tool_calls 始终为 null ,而 content 里只剩残缺的 XML 片段,典型表现为 minicpm5-2b native tool calls never par

Robocurve 用新基准 RoboHarm 测试了三款头部模型控制机械臂时的安全拒绝能力,结果 GPT-6 Astra、Claude Fable 5.1 和 MolmoAct2 几乎都不会对危险指令说"不",Astra 反而最"能干"也最危险。