数据中心是否走向“便携”?Runware 打造模块化单元寻找答案。

AI 基础设施公司 Runware 推出了可整体运输的模块化推理数据中心 Sonic Inference Pod,用“小盒子快速叠加”的方式替代“大园区慢慢建设”,试图解决 AI 推理需求增长快于机房建设速度的核心矛盾。

AI 基础设施公司 Runware 推出了可整体运输的模块化推理数据中心 Sonic Inference Pod,用“小盒子快速叠加”的方式替代“大园区慢慢建设”,试图解决 AI 推理需求增长快于机房建设速度的核心矛盾。

Anthropic 与成立仅数月的云初创公司 Volta 签订了一份为期六年、价值 100 亿美元的算力采购协议,用于锁定英伟达最新 Vera Rubin 芯片的算力供应。这笔交易反映了 AI 大模型军备竞赛中,头部玩家正在用长期合同换取稀缺算力资源。

Cloudflare 把智能体(agent)当作一种新形态的应用来运维,推出了统一的 Agents 管理平台,首发功能是“智能体追踪”(agent tracing),让开发者能看到 agent 每一次模型调用、工具执行和 token 花费,而不再只是看到一个 HTTP 200 的空壳响应。

Anthropic 与成立仅数月的云初创公司 Volta 签署了约 100 亿美元、为期多年的算力协议。过去这种量级的合同只会流向亚马逊、微软或谷歌,如今一家不拥有硬件的数据中心“中间商”拿到了订单,说明 AI 算力供给格局正在发生结构性变化。

这个报错通常出现在 ComfyUI 使用 MiniMax H3 Video VAE 进行解码,且显存不足导致 VAE 模型被部分 CPU offload 时。优先排查 ComfyUI 是否已更新(Issue 末尾标记为已修复),并确认 `comfy/ldm/minimax/vae.py` 中相关参数

开发者 ryanzhou 发布了一套完整配置,让 DeepSeek V4 Flash(304B 参数)能在单颗 AMD MI300X 上生产级运行,无需量化即可将全部权重装入 192GB HBM,单流解码达 168.6 tok/s。这件事值得关注,因为它验证了 AMD 大显存卡在高端推理场景中可作为 NVID…

Cloudflare 在本地开发工具中内置了 OpenTelemetry 追踪能力,让 AI 编程 agent 无需任何配置即可自动查询 Worker 的运行轨迹和日志,从而快速定位并修复故障。

Cloudflare 发布了一套名为 Agent Development Lifecycle(ADLC)的工具集,让 AI 智能体不再只写代码,而是接管 CI/CD、可观测性、问题处理等更多软件工程环节,并明确提出用 ADLC 取代传统 SDLC。

Cloudflare 在 Astro 开源仓库部署了一条全自动的 AI 故障分诊流水线——复现、诊断、修复、发预览版全部由隔离运行的子代理完成,将存量 issue 从 200 多个压到约 30 个,并预计下月归零。这套底层引擎已被封装为开源框架 Flue,供其他项目复刻。

NVIDIA在FMS大会上宣布开源cuFile API,让GPU能够直接读写存储设备、绕过CPU中转,同时联合40多家存储厂商推进Storage-Next计划,为AI时代重新定义存储架构。