NVIDIA 发布 Nemotron 3 Embed 系列,8B 版本登顶 RTEB 检索基准

NVIDIA 推出了专为检索增强生成(RAG)场景设计的 Nemotron 3 Embed 系列嵌入向量模型,其中 8B 版本在 RTEB 检索基准上排名第一。该系列还包含了两个针对不同部署场景优化的 1B 参数版本,展示了将大模型压缩为高效嵌入模型的新路径。

NVIDIA 推出了专为检索增强生成(RAG)场景设计的 Nemotron 3 Embed 系列嵌入向量模型,其中 8B 版本在 RTEB 检索基准上排名第一。该系列还包含了两个针对不同部署场景优化的 1B 参数版本,展示了将大模型压缩为高效嵌入模型的新路径。

图灵奖得主 Yann LeCun 离开 Meta 后在巴黎创立新实验室 AMI Labs,押注预测式架构(JEPA)而非大语言模型。他认为,到2030年,真正有影响力的 AI 将是能理解物理世界、具备规划和推理能力的“世界模型”,而非单纯依靠文本训练的 LLM。

Kim K3 在 Frontend Code Arena 的全球开发者盲测中飙升至总榜第一,超过 Claude Fable 5 和 GPT-5.6 Sol,且计划在 7 月 27 日开放完整模型权重。这是首个在核心开发任务上同时击败两大闭源巨头的开放权重模型。

百度高管透露,公司不强制员工使用 AI,而是每月发放 1000 元额度让员工自由体验各类大模型,以此降低尝试门槛。同时,百度 AI 业务营收占比首次超过 50%,高管预测通用智能体与行业智能体的大规模部署将在 2026 年下半年出现。

英伟达正将AI基础设施的竞争焦点从“单颗GPU算力”转向“Token工厂效率”,并推出Vera Rubin平台——一套整合CPU、GPU、LPU、网络和存储的异构系统,旨在以更低电力、更少GPU数量,实现更高的Token产出和更低的单位成本。

AI公司为维持大模型在线服务,抢购全球约70%的高端计算机内存,导致内存价格飙升、消费级电脑涨价最多达50%。《大西洋月刊》调查指出,这场由工程低效引发的供应链危机可能持续数年,廉价电脑最早在2028年消失。

智谱AI以数亿元人民币收购AI Infra公司中科加禾(XCore Sigma),旨在强化其在大模型推理优化和多国产芯片适配方面的底层工程能力。这起收购直接回应了其GLM-5在爆发式调用增长下暴露出的高并发推理架构瓶颈,也表明国产大模型竞争正从模型本身转向算力软件基础设施。

自2026年6月以来,包括招商银行、农业银行、平安银行、光大银行在内的十多家银行联合银联、美国运通以及Kimi、阿里云等大模型公司,推出了AI主题银行卡。用户刷卡消费可获得大模型Token、AI会员权益、智能Agent工具等数字资产,传统积分体系正向算力和AI服务方向转型。

2026年7月16日,欧盟委员会根据《数字市场法案》正式命令谷歌,须在12个月内让第三方AI应用在Android设备上获得与谷歌自家Gemini相同的系统功能访问权限,包括语音唤醒、跨应用操作、传感器数据调取及调用谷歌端侧AI模型等11项具体能力,否则面临法律诉讼。这一裁决将直接改变Android生态中AI应…

Netflix 透露,2026 年内其约 300 部影视作品使用了生成式 AI 技术,主要应用于后期制作环节,目标是在降低成本的同时提升输出质量与效率。这一规模化的应用实践,为影视行业如何落地 AI 提供了来自头部平台的直接参考。