MIT 等机构发布 Ataraxos,以极低成本战胜顶级人类 Stratego 选手

MIT 联合 CMU、NYU、斯坦福发布新 AI 系统 Ataraxos,在不完全信息棋类游戏 Stratego 上大幅击败顶级人类选手,且训练成本远低于同类模型,论文已登上 Nature。

MIT 联合 CMU、NYU、斯坦福发布新 AI 系统 Ataraxos,在不完全信息棋类游戏 Stratego 上大幅击败顶级人类选手,且训练成本远低于同类模型,论文已登上 Nature。

英伟达 CEO 黄仁勋在 X 上披露,多家行业公司的高管于前一天在白宫共同签署了《超级智能白宫协定》,原则是把安全开发与部署的首要责任压回造技术的公司自己身上。这件事值得关注,是因为它试图用“内部管控 + 外部独立评估 + 董事会监督”这套组合,给尚未定型的超级智能立一条行业自律底线。

OpenAI 的 GPT-6.1 Sol (Max) 在 Arena 的 Code Arena: WebDev 榜单上以 1759 分升至第 3 名,混合价格约 8 美元/百万 token,被 Arena 评价为重塑了性价比前沿。

特朗普推动二十余家科技公司签署一份自愿性 AI 安全协议,承诺接受独立安全审计并定期会商标准,但协议不具法律约束力,也未新增任何强制义务。

Perplexity 把 Computer 代理接到邮箱入口,任何人无需账号即可通过转发或抄送邮件委托任务,并在限时内免费运行。这相当于把 AI 代理的分发渠道从独立 App 搬到用户已经在用的邮件工作流里。

Artificial Analysis 评测显示,Google 新模型 Gemini 4 Argon 在高推理档位下智能指数达到 53,追平 GPT-6 Astra(max,53),且在五折促销与缓存折扣加码下,单任务成本仅为后者的 60%。这意味着 Google 重新回到智能水平前三。

OpenAI 发布新模型 GPT-6.1 Sol,在编码和计算机操作任务上接近此前更强的 Astra,但每 token 价格只有后者的五分之一。这延续了大模型“能力下放、价格下探”的节奏,意味着高性能 Agent 能力的调用成本被大幅压低。

OpenAI 披露并阻断了一起有组织的模型蒸馏行动,攻击者试图通过操纵对话交互,把模型受保护的内部推理过程提取出来,用于训练或复现其他模型。这类风险并非 OpenAI 独有,OpenAI 已通过 Frontier Model Forum 与行业共享信息。

这个报错通常出现在加载形状异常的 GGUF 模型时,llama.cpp 在 tensor 解析阶段对元素总数或字节数的整数乘法溢出,触发 UBSan 报告。优先排查模型文件本身是否损坏或非标准 GGUF,并关注 gguf.cpp 中的元素数量校验逻辑。

在 llama.cpp / llama-server 上加载 Gemma 4 系列 GGUF 模型并启用前缀缓存复用时,即使已经加了 -fa on 和 --swa-full ,服务端仍会打印 cache reuse is not supported 并退化为每次请求全量重算 prompt(例如 46