杰文斯悖论还能持续吗:AI 定价分层如何支撑算力需求增长

科技巨头集体表态 AI 算力供不应求,HBM 内存价格持续上涨,前沿模型 API 定价不降反升;为维持“杰文斯悖论”驱动的需求增长,模型厂商正把市场拆成高端、中端、价值三个价格带,通过分层定价让整体算力消耗继续扩大。
先解决问题,再了解资讯。选择你现在要完成的任务。

科技巨头集体表态 AI 算力供不应求,HBM 内存价格持续上涨,前沿模型 API 定价不降反升;为维持“杰文斯悖论”驱动的需求增长,模型厂商正把市场拆成高端、中端、价值三个价格带,通过分层定价让整体算力消耗继续扩大。

Y Combinator 支持的编程代理 Bullet 启动 Mac 私有测试,以 SWE-Bench Verified 95.8% 和“紧凑工具循环”为主打,试图解决 Claude Code、Codex 等现有代理“模型能力强、但执行链路慢”的痛点。

由英伟达牵头的开放安全AI联盟(OSAA)成立仅一周,已有超过120家企业加入,并迅速发布了AI安全事件共享与报告框架的公开提案。这件事之所以值得关注,是因为它把“开源AI如何保证安全”从口号落实成了具体行动,也为美国国内关于是否封禁中国开源模型的争论提供了另一种答案。

Anthropic与AI云初创公司Volta签署了一份为期六年、总额约100亿美元的算力协议。Volta将联合加密矿企Bitdeer在挪威建设133兆瓦数据中心,采用英伟达最新Vera Rubin AI芯片架构,为Claude模型的训练与推理提供云计算资源。

AI 开发的重心正从“给智能体写好提示词”转向“设计一个让智能体自己写提示词并持续运行的循环系统”。Claude Code 社区已把它命名为“循环工程”,并出现了一批能通宵产出改进成果的真实案例。

开源工具 Soup 推出了 v0.72.4 版本,让开发者在 4GB 显存的笔记本 GPU 上也能微调 8B 参数大模型,并新支持了 DPO、ORPO 等偏好对齐训练。它用"层流式加载"技术把显存占用压到 3.32GB,大幅降低了消费级硬件做 LLM 微调的门槛。

这个报错通常发生在用 LlamaIndex 加载一个“不是由 LlamaIndex 创建”的既有 Weaviate 向量库时,Weaviate 返回的对象缺少 LlamaIndex 解析 Node 所需的元数据字段(如 id 、 _node_content ),导致查询阶段抛出 ValueError

让 AI 智能体免人工审核自动合并代码的关键,不是更强的模型,而是一道「有证据、有规则」的评测闸门——前提是评测系统本身得先解决偏差问题。

MiniMax 发布的全模态生成系统 MiniMax-H3 被第三方开发者移植到了苹果 MLX 框架,Mac 用户可以在本地生成最长 15 秒、带音频的视频片段。这个移植意味着视频生成模型的运行门槛首次被拉低到个人桌面设备。

GitHub 法务团队的非工程师成员用 Copilot CLI 搭建了合同起草和版权通知分析等内部工具,将重复性法律工作的审阅和起草时间缩短约一半。这件事说明,用自然语言驱动 AI 构建工具的门槛已显著降低,非技术岗位也能直接参与 AI 应用开发。