Introducing Cosmos 3 Edge

NVIDIA 于 7 月 20 日发布了拥有 40 亿参数的开放世界模型 Cosmos 3 Edge,专为在边缘设备上运行机器人、视觉 AI 代理而设计,旨在将数据中心级别的环境理解与实时推理能力压缩到内存受限的硬件上,模型已在 Hugging Face 开源。

NVIDIA 于 7 月 20 日发布了拥有 40 亿参数的开放世界模型 Cosmos 3 Edge,专为在边缘设备上运行机器人、视觉 AI 代理而设计,旨在将数据中心级别的环境理解与实时推理能力压缩到内存受限的硬件上,模型已在 Hugging Face 开源。

荷兰光刻机巨头ASML当前市值约7000亿美元,距离成为欧洲首家万亿市值公司还差约3000亿美元。AI需求的爆发推动其订单满额,产能快速提升,使这一目标显得不再遥远。

中国AI初创公司月之暗面(Moonshot AI)发布的最新明星模型Kimi K3,因性能引发全球关注,上线仅数日就暂停新订阅。这轮热潮不仅推高了其投资者阿里巴巴和腾讯的股价,还重新点燃了市场对中国AI模型能否以更低成本追赶美国前沿水平的讨论。

Skippr AI 是一个新出现在 Product Hunt 上的产品,旨在通过 AI 自动化优化用户的工作流程或内容处理环节。其具体功能和面向的用户群体尚待官方完整披露,但它的上线暗示了 AI 工具正进一步向细分任务场景渗透。

摩尔线程不仅完成了从预训练到强化学习的全流程国产GPU大模型训练,其支持的5D世界模型EvoPhys-World更在斯坦福大学评测中获得第一。这标志着国产GPU的竞争,正从堆砌硬件参数转向比拼“生产高质量Token”的系统能力。

神州数码在 WAIC 2026 上发布了面向企业 AI 落地的“神州问学”流程操作系统和 AI Infra OS 智算平台,试图同时解决企业如何将模型嵌入业务流程、以及如何提升 GPU 集群利用率这两个关键问题。

一个名为 LoRA Speedrun 的开源项目发布了微调速度排行榜,参与者需在固定硬件(单张 L40S)上微调 Qwen2.5-1.5B 模型至 GSM8K 数学推理准确率 ≥57%,目前最快纪录为 6 分 05 秒(准确率 61.1%)。该项目旨在为参数高效微调(PEFT)技术提供一个可复现、可验证的公平…

牛津经济研究院报告警告,英国电网容量瓶颈和工业电价高企正迫使数据中心开发商外迁。随着AI数据中心的电力需求到2035年可能增长五倍,英国若不能解决能源基础设施与电价的结构性矛盾,其“G7最快AI采用国”目标将面临物流与成本的双重制约。

开发者正在尝试在浏览器中直接运行 1-Bit 量化的大语言模型(如 Qwen、Gemma),并通过 WebGPU 技术实现推理。虽然目前还远未达到可用速度,但这条路展示了大模型在端侧落地的另一种可能。

开发者通过接入魔珐星云具身驱动 SDK,为纯文本 AI Agent 装上了能实时响应的 3D 数字人身体,实现语音、口型、表情和动作的同步输出,端到端延迟控制在 500ms 左右,并支持对话打断。