我国首款藏语多语言全模态 AI 输入法发布:覆盖手机电脑,支持三大方言语音输入

2026年9月20日,青海师范大学发布我国首款藏语多语言全模态 AI 输入法"智达",覆盖手机与电脑,支持文字、语音、图片三种输入方式,语音部分覆盖卫藏、安多、康巴三大方言。这意味着藏语数字输入从单一键盘输入扩展到多模态交互。

2026年9月20日,青海师范大学发布我国首款藏语多语言全模态 AI 输入法"智达",覆盖手机与电脑,支持文字、语音、图片三种输入方式,语音部分覆盖卫藏、安多、康巴三大方言。这意味着藏语数字输入从单一键盘输入扩展到多模态交互。

快手电商直播技术团队公开了一套名为 Live Captioning Engineering 的实时字幕工程范式,把主播说话到字幕显示的端到端延迟从 1.5–2 秒压到 400–500 毫秒,字符错误率从 7.81% 降到 3.51%,并支持百万级并发。

OpenRouter 最新周度数据显示,9 月 14 日至 20 日中国大模型周调用量达 67.46 万亿 Token,连续第 21 周超过美国;同期美国为 14.21 万亿 Token,环比下降 34.7%。值得关注的是,这一优势主要由国产模型的密集迭代与价格下探支撑。

ZCode 就产品安全争议公开道歉,把代码开源到 GitHub,删除了客户端 3.14.0 中的 Repo Wiki 功能,并确认阿里云 OSS 上的相关数据已清空。这是一次由社区质疑倒逼的产品安全整改。

旧金山初创公司 TypeSafe AI 推出决策专用模型 Jev,不做文本生成,只输出可被程序直接使用的“是/否”或选择题结果并附带置信度,官方称在同类任务上比大语言模型快 10 倍、成本约为其十分之一。

这个报错通常出现在 LiteLLM 的 Responses→Chat bridge 路径上:Codex CLI 每个请求都会带上 reasoning: {"effort": ..., "summary": "auto"} ,bridge 的 summary 分支把整个 dict 当成 chat 的

一篇来自掘金社区的文章讨论了一个被反复验证的现象——主流图像生成模型很难稳定画出“一只骑自行车的鹈鹕”。它值得关注,不是因为鹈鹕本身,而是因为这类失败案例暴露了当前图像大模型在组合推理和空间关系理解上的结构性短板。

开源项目 openmsg 发布 0.2 版本,让 Claude Code、Codex、OpenCode 等不同厂商的 AI 编程 agent 在运行中的会话里互相收发消息,并支持两名开发者跨机器端到端加密通信。

一篇在 Hacker News 引发讨论的博客指出,Anthropic 于 2024 年 11 月推出的 MCP 协议是为“大模型还不够聪明”的时代设计的,如今模型已能直接写脚本调用 API 和 CLI,大多数 MCP 服务器反而成了可以删掉的中间层。

腾讯混元大模型上线"混元智囊团"专家平台,用线上接单、按任务付费的方式,面向社会招募十余个垂直领域的资深专家,为模型生产高质量数据集和专业内容。这是继字节跳动 Xpert 社区之后,又一家大厂把 AI 人才竞争从"抢全职算法研究员"扩展到"盘活全社会的专业人才"。