英伟达推出统一音频智能模型 Nemotron-Labs-Audex-30B-A3B

英伟达研究团队正式发布了名为 Audex 的统一音频-文本大语言模型,旨在解决当前多模态模型中音频处理与文本逻辑能力难以兼得的问题。该模型基于 MoE 架构,在音频理解、生成等任务上表现优异,同时几乎无损地保留了原始大模型的推理与文本处理能力。
先解决问题,再了解资讯。选择你现在要完成的任务。

英伟达研究团队正式发布了名为 Audex 的统一音频-文本大语言模型,旨在解决当前多模态模型中音频处理与文本逻辑能力难以兼得的问题。该模型基于 MoE 架构,在音频理解、生成等任务上表现优异,同时几乎无损地保留了原始大模型的推理与文本处理能力。

前 OpenAI 研究员田永龙被曝已加入腾讯,将主导混元大模型的多模态视觉语言模型(VLM)研发。这是继姚顺雨之后,又一位具备 OpenAI 核心研发背景的人才加入腾讯,反映出腾讯在大模型领域正在持续加大投入,特别是在多模态和视觉理解方向。

微软正在将旗下Excel和Outlook中的部分AI任务从OpenAI和Anthropic的模型切换至自研MAI模型,以降低高昂的第三方模型调用成本。这一调整表明微软在自研大模型上取得阶段性突破,并开始逐步构建更独立的AI技术矩阵。

SpaceXAI 与代码编辑器 Cursor 正在进行深度技术合作,基于 SpaceXAI 的大规模算力中心从头训练一个全新 AI 模型,传闻其关键性能有望达到 OpenAI GPT-5.5 或 Anthropic Claude Opus 4.8 的水平,模型最快可能于今日(2026年7月8日)正式发布。

开源桌面 AI 助手 Rowboat 于近期发布,通过将全部数据存储在本地 Markdown 文件并支持本地模型运行,主打“长期上下文记忆”与深度工作流集成。它试图解决当前 AI 工具普遍存在的隐私顾虑与冷启动问题,为开发者和知识工作者提供一种数据自主权更高的新选择。

微软正在将自研的MAI系列模型部署到Excel、Outlook等核心Office产品中,取代此前依赖的OpenAI和Anthropic模型。此举在降低成本的同时,也标志着微软在AI模型上的独立性取得实质性突破。

蚂蚁集团副总裁周俊在 AICon 会议上指出,万亿参数大模型运行 15 分钟的算力成本已相当于一辆特斯拉,团队提出从“更多 Token”转向“更高 Token 密度”的策略,并通过混合线性注意力架构和 Kpop 算法,让十亿参数模型在 Agent 任务上超越更大模型,且推理成本降低十倍以上。

2026年7月7日,Meta正式发布其超级智能实验室(Super Intelligence Lab)的首个图像生成模型Muse Image,该模型已免费部署在Meta AI应用、Instagram和WhatsApp中,支持对话式生成高质量图像、文字渲染和购物预览等实用功能。
![[Bug]: Router retry_policy set via UI/ POST / Config/update is silently dropped (never persisted or applied)](https://www.chat-gpts.plus/wp-content/uploads/2026/07/31308-001b0085-768x403.jpg)
用户运行 LiteLLM Proxy Server 时,通过 Admin UI 的 Router Settings 页面(Reliability & Retries 区域)设置 retry_policy (例如: {"RateLimitErrorRetries": 3} ),点击保存后 UI 提示成
![[Bug]: Prompt caching broken for Bedrock Application Inference Profiles via /v1/messages endpoint](https://www.chat-gpts.plus/wp-content/uploads/2026/07/26625-4d39e2a9-768x403.jpg)
用户在 LiteLLM 中配置了 Bedrock App Inference Profile(ARN 格式,如 bedrock/converse/arn:aws:bedrock:us-east-1:ACCOUNT:application-inference-profile/PROFILE_ID ),