开放权重AI模型正追赶前沿,但安全差距依然存在。

中国智谱AI的开放权重模型GLM-5.2在网络安全和生物能力上已逼近GPT-5.5、Claude Opus 4.7等前沿闭源模型,但安全测评显示它几乎不拒绝任何危险请求,前沿能力与安全实践之间的差距正在拉大。

中国智谱AI的开放权重模型GLM-5.2在网络安全和生物能力上已逼近GPT-5.5、Claude Opus 4.7等前沿闭源模型,但安全测评显示它几乎不拒绝任何危险请求,前沿能力与安全实践之间的差距正在拉大。

SpaceX今年已累计购入价值3.29亿美元的特斯拉Megapack储能电池,其中二季度单季采购额达2.95亿美元。这批电池很可能用于xAI数据中心,反映出AI算力扩张正在成为储能和电力基础设施的重要驱动力。

科技巨头集体表态 AI 算力供不应求,HBM 内存价格持续上涨,前沿模型 API 定价不降反升;为维持“杰文斯悖论”驱动的需求增长,模型厂商正把市场拆成高端、中端、价值三个价格带,通过分层定价让整体算力消耗继续扩大。

Y Combinator 支持的编程代理 Bullet 启动 Mac 私有测试,以 SWE-Bench Verified 95.8% 和“紧凑工具循环”为主打,试图解决 Claude Code、Codex 等现有代理“模型能力强、但执行链路慢”的痛点。

由英伟达牵头的开放安全AI联盟(OSAA)成立仅一周,已有超过120家企业加入,并迅速发布了AI安全事件共享与报告框架的公开提案。这件事之所以值得关注,是因为它把“开源AI如何保证安全”从口号落实成了具体行动,也为美国国内关于是否封禁中国开源模型的争论提供了另一种答案。

Anthropic与AI云初创公司Volta签署了一份为期六年、总额约100亿美元的算力协议。Volta将联合加密矿企Bitdeer在挪威建设133兆瓦数据中心,采用英伟达最新Vera Rubin AI芯片架构,为Claude模型的训练与推理提供云计算资源。

AI 开发的重心正从“给智能体写好提示词”转向“设计一个让智能体自己写提示词并持续运行的循环系统”。Claude Code 社区已把它命名为“循环工程”,并出现了一批能通宵产出改进成果的真实案例。

开源工具 Soup 推出了 v0.72.4 版本,让开发者在 4GB 显存的笔记本 GPU 上也能微调 8B 参数大模型,并新支持了 DPO、ORPO 等偏好对齐训练。它用"层流式加载"技术把显存占用压到 3.32GB,大幅降低了消费级硬件做 LLM 微调的门槛。

让 AI 智能体免人工审核自动合并代码的关键,不是更强的模型,而是一道「有证据、有规则」的评测闸门——前提是评测系统本身得先解决偏差问题。

MiniMax 发布的全模态生成系统 MiniMax-H3 被第三方开发者移植到了苹果 MLX 框架,Mac 用户可以在本地生成最长 15 秒、带音频的视频片段。这个移植意味着视频生成模型的运行门槛首次被拉低到个人桌面设备。