腾讯混元发布 Hy ASR 3.0 preview:语音识别不再逐字硬转,而是真的听懂了语境

腾讯混元发布 Hy ASR 3.0 preview,把语音识别从“逐字转写”推进到“理解语境后再输出”。这件事值得关注,因为它意味着语音识别可能从单纯的工具能力,升级为大模型语义理解的一个入口场景。

腾讯混元发布 Hy ASR 3.0 preview,把语音识别从“逐字转写”推进到“理解语境后再输出”。这件事值得关注,因为它意味着语音识别可能从单纯的工具能力,升级为大模型语义理解的一个入口场景。

Swiftlet 是一个专为 Qwen3 系列 MoE 模型打造的 Swift + Metal 运行框架,通过把专家权重放在 SSD 上按需读取,让 80B 级模型在 Mac 上峰值内存仅 4.3GB,并首次实现了 35B 级模型在 iPhone 17 上原生机跑,不再依赖服务器。

CodeBuddy与WorkBuddy宣布将Hy3大模型的免费体验延长至2026年8月31日,原因是用户反馈热烈。对开发者和办公用户而言,这是一次更长的零成本测试窗口,也反映出工具类产品正在用自研模型加深用户绑定。

亚马逊一名工程师用 Claude 编写的数据处理程序因调用无限制、缺乏监控,5 个月烧掉 180 万美元、超预算 860%,且项目从未上线。它说明 AI 从辅助工具

Palantir CEO Alex Karp在财报电话会上批评前沿AI实验室“想殖民你的企业”,并宣称企业需要“AI主权”来保住数据和竞争优势。这既是对大模型厂商的公开抨击,也是Palantir借财报高增长向企业客户推销自身价值的最新动作。

开发者发布了一款名为 PISIGuard 的开源浏览器扩展,能在用户向 ChatGPT、Claude、DeepSeek 等 AI 发送消息前自动识别并脱敏姓名、邮箱、API 密钥等敏感信息,AI 回复后再自动还原,全程在本地完成。在 AI 隐私焦虑日益突出的当下,它提供了一种不依赖 AI 服务商承诺的轻量级保…

墨西哥国立自治大学(UNAM)首次用 AI 摄像头监考远程入学考试,结果高分考生比例异常飙升,校方决定让约 5.8 万名考生重新线下考试。这起事件暴露了 AI 监考系统在大规模高利害考试中的可靠性危机。

Anthropic 于 8 月 4 日发布 Claude Code v2.1.221,重点修复了一批涉及命令执行安全、MCP 连接和跨平台兼容性的问题,并新增了 Focus View 等开发体验改进,让 CLI 编程智能体在真实工程环境里更可靠。

苹果周一因儿童性虐待内容(CSAM)将 Telegram 从 App Store 短暂下架,在 Telegram 删除内容并封禁涉事用户后恢复上架。这再次表明,平台内容审核机制,尤其是 AI 驱动的识别与处置流程,正成为 App Store 合规的硬性门槛。

AI 咨询顾问正在推动一种新的降本思路:把最贵的前沿模型当作“战略顾问”使用,只负责规划和拆解复杂任务,日常执行交给便宜的小模型。这反映出企业 AI 支出正从“疯狂烧 token”转向精细化成本控制。