通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型

通义实验室发布新一代语音合成模型 Qwen-Audio-3.0-TTS,包含 Flash(低延迟)和 Plus(高质量)两个版本,在第三方评测中多项指标领先。其最直接的变化是支持 16 种语言、20 种方言,并允许用户用自然语言“指挥”声音的情绪、角色和场景,而非仅靠技术参数调优。

通义实验室发布新一代语音合成模型 Qwen-Audio-3.0-TTS,包含 Flash(低延迟)和 Plus(高质量)两个版本,在第三方评测中多项指标领先。其最直接的变化是支持 16 种语言、20 种方言,并允许用户用自然语言“指挥”声音的情绪、角色和场景,而非仅靠技术参数调优。

AMD AI业务高级总监在GitHub上公开的代码中,泄露了Anthropic成为其客户的信息。芯片分析机构SemiAnalysis通过解读代码确认了这一合作,这意味着Anthropic正在加速构建多元化的算力供应商体系,摆脱对英伟达GPU的单一依赖。

欧盟议会计划最快于2025年9月向议员和工作人员推出名为EPGenAI Hub的内部AI工具平台,整合Meta、OpenAI、Anthropic和Mistral等多家主流大模型。此举标志着全球主要立法机构首次规模化部署多模型AI基础设施,背后涉及对AI供应商选择、数据安全与监管示范效应的多重考量。

中国AI公司Moonshot发布的新模型Kimi K3,在多项基准测试中追平甚至超越美国领先模型,且成本极低。这并非简单的技术追赶,而是中国全面拥抱开源模型策略,正在倒逼美国闭源巨头和监管层重新思考AI技术路线。

Box 联合创始人 Aaron Levie 通过分析 AI 在不同领域的落地速度,指出 AI 进展的瓶颈并非智能本身,而是与现实世界的交互反馈速度。编程领域之所以被 AI 迅速渗透,是因为其反馈闭环几乎完全在数字世界内完成。

Anthropic 将 Claude Code 的系统提示词长度压缩了 80%。开发者 Thariq 对此的解释是:随着模型能力提升,过多的指令、约束和示例反而会限制其表现。

技术产品经理 Peter Yang 在 X 上指出,非技术用户在使用 ChatGPT Work 和 Codex 时,对“在云端运行”这一概念感到困惑,且跨产品引导链路存在断点——用户被要求跳转至 Codex Web 后,又被提示“重新下载 App”,暴露出 AI 产品在用户认知和交互设计上的脱节问题。

一名用户分享了如何用 Claude Cowork(Anthropic 的 AI 协作工具)的提示词(Prompt)来半自动化管理日历,展示了当前大模型在个人生产力场景中的具体应用能力,以及 CoWork 模式的进化方向。

OpenAI 的代码生成工具 Codex 被开发者 Peter Yang 在实战中用于“应对一场战斗”——虽然是自嘲式表达,但再次印证了 AI 编程助手正在从辅助写代码升级为更主动的任务执行者,尤其是在复杂对抗场景下的潜力值得关注。

OpenAI 产品负责人 Thibault Sottiaux 在 X 上发起公开征集,邀请用户分享 ChatGPT 如何对个人生活产生“深刻积极影响”的真实案例。这一动作旨在从职场效率讨论转向情感与真实价值层面,引发广泛关注,阅读量已超过 20 万次。