阿里发布语音识别新模型,医疗词汇”听中率”破 95%,曾拿全球最低错字率

阿里发布新一代语音识别模型,在医疗词汇场景下的识别准确率突破 95%,此前已在公开评测中拿下全球最低错字率。这件事的看点在于:语音识别的竞争正从“通用场景听清”转向“垂直行业听懂”。

阿里发布新一代语音识别模型,在医疗词汇场景下的识别准确率突破 95%,此前已在公开评测中拿下全球最低错字率。这件事的看点在于:语音识别的竞争正从“通用场景听清”转向“垂直行业听懂”。

研究团队近日发布物理世界模型 PhiZero,放弃视频生成中“盲目预测像素”的做法,改用自监督学习得到的“物理语言”先做显式推理、再渲染视频,为解决视频模型物理一致性不足的痛点提供了新路线。

7月31日,华为正式开源openPangu-2.0-Pro大模型,总参数5050亿、每Token激活约180亿参数,权重、推理代码与技术报告同步放出。这是昇腾AI生态在模型层面的一次关键补强,也让“国产开源

AI 应用正在催生一套独特的设计语言,从闪烁文字、流式文本到小型图标和米色色调,这些交互范式不仅定义了当前 AI 产品的颜值,也开始向其他软件领域渗透,可能成为未来数年普遍的交互模式。

Redis 作者 antirez 公开发文指出,在 AI 辅助编程普及的当下,开发者逐行审查 AI 生成的代码“大部分毫无意义”。他认为,核心工作应转向“掌控设计思路”和“拼命做质量测试”,这一观点正在引发技术圈对编程范式转变的深层讨论。

GitHub Copilot在VS Code的2026年7月版本中大范围升级了Agent工作区、多会话聊天和模型控制能力,同时将Copilot视觉识别、BYOK模型支持推向正式可用,标志着AI辅助编程从单次补全迈向多Agent协作的常态化。

LinkedIn 上线举报按钮“Seems like AI slop”,让用户标记看起来由 AI 生成的低质量内容。此举与多个平台对抗 AI 灌水内容的趋势同步——Cloudflare 的数据显示,互联网机器人流量已首次超过人类请求。

GitHub Copilot 应用在 2026 年 7 月底推出了“堆叠会话”和“拉取请求”管理功能,允许开发者在同一仓库内创建多个相互依赖的任务会话,并直接在 App 中管理 PR 流程。这标志着 AI 编程助手从“单次对话”向“任务编排与项目管理”的实质性升级。

英国AI云服务商Nscale以16.5亿美元收购Anyscale,后者是开源分布式框架Ray背后的公司。这笔交易让Nscale从底层算力延伸到工作负载管理软件层,试图在日益拥挤的AI基础设施市场中构建更完整的垂直栈。

AI合规初创公司Dili完成2170万美元融资(种子轮+Series A),定位为美国基础设施建设中的“合规裁判”,用AI解析复杂建筑法规,目前已在约700个项目落地。这笔融资折射出AI从通用场景转向垂直刚需的趋势。