单个机柜到底能跑多少个 Agent?答案不在 GPU 身上

英特尔在 8 月发布的白皮书中提出,衡量单机柜能跑多少 Agent,关键不在 GPU 峰值算力,而在于调度、内存与卸载效率;按其实测,优化后同一延迟目标下并发 Agent 数可从 235 提升到 300。

英特尔在 8 月发布的白皮书中提出,衡量单机柜能跑多少 Agent,关键不在 GPU 峰值算力,而在于调度、内存与卸载效率;按其实测,优化后同一延迟目标下并发 Agent 数可从 235 提升到 300。

斯坦福教授、Inception 联合创始人兼 CEO Stefano Ermon 在 No Priors 播客中提出,扩散模型(Diffusion)有望在 AI 推理赛道占据主导地位,挑战当前自回归大模型的主流地位。这一判断关系到下一代模型架构和推理成本的走向。

Box CEO Aaron Levie 公开演示了 Jev 与 Box 的结合,认为这类工具能让 AI Agent 在工作流中做出“瞬间判断”,覆盖数据分类、业务判断等大量企业场景。

Claude Code 从 2.1.277 版本起,会在目录里没有 CLAUDE.md 时自动读取并采用 AGENTS.md 作为项目上下文说明文件,用户可在 /config 中开关该行为。这意味着跨工具的 AI 编程配置标准又向统一迈了一步。

Anthropic 的 Claude Code 新增了对 AGENTS.md 的支持,而这套能力并非临时补丁,而是建立在即将推出的 Claude Code mods(定制模组)机制之上,意味着开发者很快就能像写配置一样改造自己的编程 Agent 行为。

Anthropic 旗下 Claude 官方账号在 X 上发布了一条新动态,引发开发者社区关注。由于原始推文内容暂时无法直接抓取,目前可确认的是官方账号本身有更新动作,具体细节仍需以官方渠道为准。

Anthropic 旗下 Claude 官方 X 账号发布了一条新动态,但原始推文内容未能抓取成功。目前公开信息显示,这条动态来自 Claude 官方渠道,具体信息仍需以原链接为准。

Claude 官方账号发布了一条关于“这个周末打算做点什么”的互动贴,目前公开信息显示并未附带具体的产品发布或功能更新,更像是一次面向开发者与用户的社交媒体互动。

AI 创作者 Peter Yang 称 Meta 的 @Muse 是他目前用过最好的个人 AI 助手,帮他在有线电视和手机账单上一年省下 800 多美元。一款免费 AI 助手能直接落到家庭支出这种具体场景,是这类产品从演示走向实用的一个信号。

Vercel 创始人 Guillermo Rauch 表示,一个名为 Jev 的 AI 产品正在被“所有人”采用,其真实数据与坊间传闻同样可观;他把这一现象归因于“AI 太贵、太慢”的行业情绪,而非单纯的产品力。