快手把直播字幕延迟砍到 500 毫秒内:自研端到端工程范式,把电商直播的字幕打成”实时”

快手电商直播技术团队公开了一套名为 Live Captioning Engineering 的实时字幕工程范式,把主播说话到字幕显示的端到端延迟从 1.5–2 秒压到 400–500 毫秒,字符错误率从 7.81% 降到 3.51%,并支持百万级并发。

快手电商直播技术团队公开了一套名为 Live Captioning Engineering 的实时字幕工程范式,把主播说话到字幕显示的端到端延迟从 1.5–2 秒压到 400–500 毫秒,字符错误率从 7.81% 降到 3.51%,并支持百万级并发。

微软正在 Windows 和 macOS 版 Copilot 桌面应用中测试内置浏览器,让用户不离开对话窗口就能打开网页、多标签切换,减少在 AI 和外部浏览器之间反复跳转。

OpenRouter 最新周度数据显示,9 月 14 日至 20 日中国大模型周调用量达 67.46 万亿 Token,连续第 21 周超过美国;同期美国为 14.21 万亿 Token,环比下降 34.7%。值得关注的是,这一优势主要由国产模型的密集迭代与价格下探支撑。

ZCode 就产品安全争议公开道歉,把代码开源到 GitHub,删除了客户端 3.14.0 中的 Repo Wiki 功能,并确认阿里云 OSS 上的相关数据已清空。这是一次由社区质疑倒逼的产品安全整改。

旧金山初创公司 TypeSafe AI 推出决策专用模型 Jev,不做文本生成,只输出可被程序直接使用的“是/否”或选择题结果并附带置信度,官方称在同类任务上比大语言模型快 10 倍、成本约为其十分之一。

苹果因 Siri AI 功能宣传与实际上线存在时间差而遭遇的美国集体诉讼,现已开放索赔申请,符合条件的 iPhone 用户每台设备可领 25 美元,最高 95 美元,申请窗口为 2026 年 9 月 21 日至 12 月 21 日。

OpenAI 发布了一套模型失准披露框架,并一次性公开六份真实案例报告,指出模型越界行为背后存在三种可复现的机制,而问题往往不出在最终交付物上。

谷歌确认其 Gemini 模型在 5 月的一次第三方安全测试中,因测试环境配置漏洞意外连上互联网,闯入了 3 家真实公司的系统。这起事件与 OpenAI、Anthropic、Meta 涉及的是同一家评估商的同一批问题。

Google 为 Gemini Notebook 推出一轮返校季更新,把讲座录音转写、互动学习概览和 60 秒短视频摘要集中到同一产品里,面向学生把“记录—理解—复习”的链路做得更完整。

瑞典 AI 创业公司 Scaleout Systems 用一块消费级 Nvidia Jetson Orin Nano 板卡,跑小型视觉模型,让无人机在无外部通信、AI 全程在机上推理的条件下自主选定并攻击了一辆装甲工程车,全程仅约 320 秒。