Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议

Anthropic 与成立仅数月的云初创公司 Volta 签署了约 100 亿美元、为期多年的算力协议。过去这种量级的合同只会流向亚马逊、微软或谷歌,如今一家不拥有硬件的数据中心“中间商”拿到了订单,说明 AI 算力供给格局正在发生结构性变化。

Anthropic 与成立仅数月的云初创公司 Volta 签署了约 100 亿美元、为期多年的算力协议。过去这种量级的合同只会流向亚马逊、微软或谷歌,如今一家不拥有硬件的数据中心“中间商”拿到了订单,说明 AI 算力供给格局正在发生结构性变化。

这个报错通常出现在 ComfyUI 使用 MiniMax H3 Video VAE 进行解码,且显存不足导致 VAE 模型被部分 CPU offload 时。优先排查 ComfyUI 是否已更新(Issue 末尾标记为已修复),并确认 `comfy/ldm/minimax/vae.py` 中相关参数

开发者 ryanzhou 发布了一套完整配置,让 DeepSeek V4 Flash(304B 参数)能在单颗 AMD MI300X 上生产级运行,无需量化即可将全部权重装入 192GB HBM,单流解码达 168.6 tok/s。这件事值得关注,因为它验证了 AMD 大显存卡在高端推理场景中可作为 NVID…

Cloudflare 在本地开发工具中内置了 OpenTelemetry 追踪能力,让 AI 编程 agent 无需任何配置即可自动查询 Worker 的运行轨迹和日志,从而快速定位并修复故障。

Cloudflare 发布了一套名为 Agent Development Lifecycle(ADLC)的工具集,让 AI 智能体不再只写代码,而是接管 CI/CD、可观测性、问题处理等更多软件工程环节,并明确提出用 ADLC 取代传统 SDLC。

Cloudflare 在 Astro 开源仓库部署了一条全自动的 AI 故障分诊流水线——复现、诊断、修复、发预览版全部由隔离运行的子代理完成,将存量 issue 从 200 多个压到约 30 个,并预计下月归零。这套底层引擎已被封装为开源框架 Flue,供其他项目复刻。

NVIDIA在FMS大会上宣布开源cuFile API,让GPU能够直接读写存储设备、绕过CPU中转,同时联合40多家存储厂商推进Storage-Next计划,为AI时代重新定义存储架构。

NVIDIA 将自动驾驶推理模型 Alpamayo 2 Super 以商用许可开源发布,允许企业直接用于 Robotaxi 和量产自动驾驶系统开发,解决了此前前沿推理模型“只能研究、难以上车”的落地瓶颈。

蚂蚁百灵团队发布了 Ling-3.0-flash 的开源权重

GitHub 在 Code Quality 设置中新增了由 AI 自动生成代码覆盖率工作流的能力,开发者无需手动编写配置,点击即可生成拉取请求(PR)供审查。这套流程将显著降低 CI/CD 配置门槛,让覆盖率检测更快落地。