NVIDIA 的 Cosmos 框架教程:使用全模态混合 Transformer 设计 Colab 友好的 Cosmos 3 世界模型微型模型

NVIDIA 发布了 Cosmos 框架的详细教程,指导开发者如何在 Google Colab 环境下,利用全模态混合 Transformer(Omnimodal MoT)架构构建 Cosmos 3 世界模型的缩小版(微型模型)。这降低了物理世界模型的门槛,让开发者无需大规模算力即可实验和定制。

NVIDIA 发布了 Cosmos 框架的详细教程,指导开发者如何在 Google Colab 环境下,利用全模态混合 Transformer(Omnimodal MoT)架构构建 Cosmos 3 世界模型的缩小版(微型模型)。这降低了物理世界模型的门槛,让开发者无需大规模算力即可实验和定制。

AI 芯片公司 SambaNova 完成 10 亿美元 F 轮融资首轮交割,估值达 110 亿美元,领投方为 General Atlantic。这笔融资距其发布 SN50 芯片和完成 3.5 亿美元 E 轮融资仅过去约 5 个月,显示出资本市场对其推理芯片路线的持续押注。

法国 AI 初创公司 ZML 发布了名为 ZML/LLMD 的推理服务器免费产品,能让多种开源大模型在英伟达、AMD、谷歌 TPU、苹果 Metal 和英特尔 Arc 等不同芯片上以接近峰值速度运行,旨在打破芯片供应商锁定,降低 AI 推理成本。

OpenAI 的最新大模型 GPT-5.6 系列(含旗舰版 Sol Ultra)将于本周四正式向公众开放。此前该模型因美国政府要求额外安全测试而被推迟发布,OpenAI 对此公开表达了不满。这一事件凸显了 AI 监管与商业效率之间的持续张力。

研究人员发现一种名为“HalluSquatting”的新型攻击手段,利用AI编码助手和智能体的“幻觉”特性,通过伪造资源标识符,可在不逐个攻击目标的情况下,大规模组建僵尸网络、发起DDoS攻击。Cursor、GitHub Copilot等9款主流AI工具均被证实存在这一安全缺口。

安全公司 Noma Labs 发现 GitHub 新推出的 AI 代理工作流存在严重提示词注入漏洞(命名为 GitLost),攻击者可通过在公开仓库中发布精心构造的 Issue,诱导 AI 代理泄露同一组织内私有仓库的数据,无需任何认证或代码技能。

SuperCLUE 发布了面向编程场景的模型评测,腾讯 Hy3 以 295B 总参数量、仅 21B 激活参数,在代码能力上追平了参数量数倍于它的 DeepSeek-V4-Pro,且单题推理成本仅为 0.43 元。

近期,多家美国企业在AI任务中主动从价格高昂的头部模型转向调用DeepSeek、智谱GLM等中国大模型,原因是这些模型在足够好用的前提下,API成本低60%至90%,直接为企业节省数百万美元运营开支。这一趋势在OpenRouter聚合平台数据中得到印证,国产模型调用份额周均超过30%,峰值达46%。

淘宝闪购高管在2026中国互联网大会上指出,当前电商和即时零售App普遍缺乏原生AI交互能力,用户只能通过关键词搜索,复杂需求被严重压制。淘宝闪购已联手通义千问推出智能体,上线一周AI订单即突破1亿笔,证明场景化需求是下一个爆发点。

Y Combinator CEO Garry Tan 宣称借助 AI 编程代理每日完成并部署 3.7 万行代码、连续 72 天不断发布,但资深工程师审查其个人网站前端后发现,该网站加载时触发 169 次服务器请求、总负载达 6.42MB,远超 YC 旗下极简基准 Hacker News(7 次请求、12KB)…