两个 Token 就让 Kimi“变成”Claude?前Google DeepMind研究员意外撞上大模型的蒸馏疑云

前 Google DeepMind 研究员 Ilia Shumailov 与 Alexander Panfilov 发现,前沿模型的加密推理块可在同系列大小模型间跨用户、跨会话重放,从而被解码出隐藏的思考内容;他们还发现仅用两个 Opus 推理 Token 预填充,就能明显改变 Kimi-K3 的答案风格。

前 Google DeepMind 研究员 Ilia Shumailov 与 Alexander Panfilov 发现,前沿模型的加密推理块可在同系列大小模型间跨用户、跨会话重放,从而被解码出隐藏的思考内容;他们还发现仅用两个 Opus 推理 Token 预填充,就能明显改变 Kimi-K3 的答案风格。

Cursor 推出名为 Projects 的新工作方式,用单一常驻线程中的协调者 Agent 替代"每个任务开一个对话"的模式,支持长期运行、主动调度子 Agent 并持续改进。

产品人 Madhu Guru 总结了企业 AI 项目大面积失败的三类原因,并给出对应解法,核心指向一个反直觉结论:AI 落地难在组织方式,而不只是技术选型。

AI 媒体与产品公司 Every 正在招聘一名专职撰稿人(staff writer),负责撰写一份每日 AI newsletters,覆盖新模型、产品、研究和公司动态。这则招聘由 Every CEO Dan Shipper 在 X 上转发,卖点是"身处 AI 浪潮中心、能第一时间接触新模型和工具"。

Box 现在可以挂载到 AI Agent 的运行沙箱里,让 Agent 像读写本地文件一样直接访问企业内容;对正在把 Agent 推向核心业务流程的企业来说,这是一块之前一直缺失的基础设施。

Zara Zhang 在 X 上公开质疑“一人公司”叙事,认为 AI 虽然放大了单人的产出上限,但创业过程中的孤独感和动机衰减无法靠工具解决,人仍然需要合伙人来一起构思、扛压和庆祝。

Vercel CEO Guillermo Rauch 披露,网络技术公司 Tailscale 面向用户的模型路由产品 Aperture,底层跑在 Vercel AI Gateway 上。这不只是一次客户案例,而是他抛出的一个判断:AI 网关正在变成新的 CDN。

Claude Code 新增 claude plugin eval 命令,让开发者可以为自己的插件或 Skill 建立测试用例、跑分并对比"有插件/无插件"的效果差异,回应了模型迭代后插件是否仍有效的验证难题。

产品人 Peter Yang 公开质疑“软件工厂”式全自动开发,认为除验证与测试外,AI 目前还无法在无人介入的情况下端到端构建新产品或功能。这条观点引发了对 AI 编程真实边界的讨论。

OpenAI 招揽了开源项目 Git AI 的两名核心成员 Aidan 和 Sasha,用来强化 Codex 的代码贡献可视化能力,并承诺 Git AI 继续开源、继续投入。