通义实验室发布 Wan-Streamer v0.2,端到端响应延迟仅 550ms

通义实验室发布 Wan-Streamer v0.2,将 AI 视频对话的端到端响应延迟压缩至约 550ms(含 350ms 网络传输),同时将输出分辨率从 192×336 提升至 640×368。这是目前公开信息中延迟最低的全双工视频交互模型之一,通过“Thinker-Performer”双通路架构在高画质与…

通义实验室发布 Wan-Streamer v0.2,将 AI 视频对话的端到端响应延迟压缩至约 550ms(含 350ms 网络传输),同时将输出分辨率从 192×336 提升至 640×368。这是目前公开信息中延迟最低的全双工视频交互模型之一,通过“Thinker-Performer”双通路架构在高画质与…

NVIDIA 正式推出 Nemotron 3 Embed 系列开源嵌入模型,其中 8B 参数版本在最新 RTEB 基准测试中位列第一,为 RAG 和语义搜索场景提供了更强的大模型嵌入方案。

一种名为 Schema 的“推理框架(Harness)”在 ARC-AGI-3 基准测试的公开集上,配合 Claude Opus 4.8 和 Fable 5 模型达到了 98.98% 的成绩,接近人类水平(100%)。它不修改模型权重,而是通过改进模型使用方式——即如何观察、建模、预测和修正——大幅提升了 A…

2026年7月17日,阶跃星辰(StepX)在上海WAIC 2026展会上展示了STEPX Neo样机,这是全球首款以大模型为底层架构、原生集成智能体(AI Agent)的手机,而非传统语音助手的简单升级。

在2026年世界人工智能大会上,银河通用机器人创始人王鹤预测,具身智能技术将在2028年前迎来重大突破,其性能将比肩对话式AI如ChatGPT。这一预测为机器人行业的商业化时间表提供了具体锚点,也将推动相关训练与计算需求加速爆发。

重庆市卫健委联合蚂蚁集团正式上线“渝小健”AI就医智能体,已接入233家公立医院,提供AI导诊、报告解读、云陪诊等服务,成为国内少有的市级统一AI医疗服务平台。

阿里通义实验室推出 Wan-Streamer v0.2,这是一款端到端多模态模型,将 AI 对话响应的整体延迟压缩到 0.55 秒,并支持全身数字人实时互动。传统语音助手或视频对话中的卡顿、音画不同步问题,在它身上得到了实质性解决。

用户在 Windows 系统(NVIDIA GPU + AMD CPU)上使用 Ollama 0.30.7 运行 Phi4 模型时触发。复现方式包括命令行运行 ollama run phi4 以及调用 /api/chat 端点。

用户在使用 ComfyUI 时,在终端中运行自定义启动脚本 ./run_comfy.sh 后,日志显示更新正常、虚拟环境检测正常,但在后续生成图像(或加载模型)步骤中报错。报错信息为 Triton 后端的寄存器分配失败。

文远知行于2026年7月17日正式发布自研物理 AI 认知基础大模型 WITT,核心创新在于提出了“最小物理事实单元”概念,旨在让 AI 能更精准地理解和验证视频、图像、文本中的物理世界信息,从而为自动驾驶决策提供更可靠的认知框架。