NVIDIA NVLink:AI工厂的扩展网络

NVIDIA 发布了第六代 NVLink 互连技术,定位为“AI 工厂”专用的扩展网络(Scale-up Network),旨在解决大模型训练和推理中 GPU 间高带宽、低延迟通信瓶颈,实测可提升混合专家模型(MoE)推理吞吐量至 2.3 倍于普通以太网。

NVIDIA 发布了第六代 NVLink 互连技术,定位为“AI 工厂”专用的扩展网络(Scale-up Network),旨在解决大模型训练和推理中 GPU 间高带宽、低延迟通信瓶颈,实测可提升混合专家模型(MoE)推理吞吐量至 2.3 倍于普通以太网。

据Axios报道,特朗普政府自2025年起通过制裁、安全警告和行政令等多种手段,逐步限制美国公司使用中国AI模型。这种做法并非一纸禁令,而是通过“软压力”和监管风险,让企业因担忧合规成本而主动回避中国模型,形成事实上的慢动作封锁。

哈佛大学历史学教授、纽约客撰稿人Jill Lepore博士在新书《人工国家的兴衰》中,将当前AI系统的过度量化与测量行为定义为一种“去人性化”的过程。她认为,大型科技公司和AI企业正在用测量和计算取代传统国家治理功能,而近期大学毕业生在毕业典礼上当众对AI CEO们喝倒彩的行为,恰恰是推动社会反思与重构的关键…

YouTube 于 7 月 16 日更新了其合作伙伴计划(YPP)的变现政策,明确将三种“非真实内容”列为不可变现类型,包括 AI 生成的批量模板视频、令人不适或情绪操纵内容,以及使用 AI 虚拟人物讨论敏感话题的视频。此举旨在遏制内容农场式创作,维护平台广告收入的质量竞争。

Adobe 实验性相机应用 Project Indigo 在 1.1 版本中上线“AI Playground”工具套件,引入生成式滤镜、物体移除和 AI 聊天反馈等功能。这是该应用从“模拟 SLR 摄影体验”到“AI 编辑平台”的关键转向,且未依赖 Adobe 自家的 Firefly 模型。

用户在 Docker 环境中运行 Open WebUI (v0.3.21) 和 LiteLLM (1.46.1)。用户通过 Open WebUI 将 LiteLLM 配置为 OpenAI 兼容端点,并在 LiteLLM 中设置了用户预算限制。当用户的查询导致成本超过预算时,LiteLLM 会返回详细

用户使用 Pip 安装 Open WebUI v0.10.2,在 Ubuntu 24.04 上启动服务时,因环境变量 CORS_ALLOW_ORIGIN 被设置为空字符串而崩溃。Issue 中用户试图通过空字符串来 禁用 CORS(即不发送 CORS 头),但该用法不受支持。

用户在运行 Open WebUI 时,计划使用远程 Ollama 服务器进行推理,希望本地 Open WebUI 安装保持轻量,不安装 CUDA、Torch 以及完整 Ollama 相关依赖包(如 PyTorch 等大型机器学习库)。

2026年7月19日,面壁智能发布并开源具身智能模型系列MiniCPM-Robot,包含操作模型RobotManip(1.5B参数)和跟踪模型RobotTrack(0.9B参数),同时推出面向物理AI的低时延推理框架PhyAI。这标志着多模态大模型不再止于“回答”,而是开始直接驱动机械臂和移动平台完成连续动作…

Netflix 首席产品与技术官 Elizabeth Stone 在 Lenny's Podcast 中提出,AI 让每个人都能更快产出原型和代码,但真正稀缺的是能理解整体系统、跨域协作并承担责任的“系统型人才”。她认为,组织不应只关注工具熟练度,而应培养人才对问题边界和系统关系的判断力。