Google 官宣 Gemini 3.8 Live,首创“边说边想”颠覆行业交互

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款原生语音模型,首次在低延迟语音流中实现多步深度推理,让 AI 可以"边说边想",而不是在遇到难题时沉默等待。

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款原生语音模型,首次在低延迟语音流中实现多步深度推理,让 AI 可以"边说边想",而不是在遇到难题时沉默等待。

研究者 Phoenix Yin 在 X 上发布长文,用流形假说、互信息、Kolmogorov 复杂度和信息瓶颈串起一条论证:智能成立的前提是现实世界存在可压缩的稳定结构,因此学习在本质上接近压缩,而大模型的记忆、泛化、类比和推理只是同一机制在不同尺度上的表现。这是一篇观点性长文,不是产品发布。

惠普发布 ZBook Ultra G3a 16 移动工作站,搭载 AMD Ryzen AI Max PRO 400 处理器与最高 192GB 统一内存,其中 160GB 可作显存,官方称可本地运行 300B 参数级大模型,2026 年 10 月上市,定价 7449 美元。

中文互联网基础语料 4.0 于 9 月 15 日在济南发布,总量 120GB,面向大模型训练开放申领。它值得关注的地方不在"又多了多少数据",而在于这批语料走的是官方指导、多家企业共建的可信数据路径。

开发者发布了一个名为 Pizza Bot 的开源项目,定位是"为在后台工作的 AI Agent 打造的收件箱"。它试图解决一个具体问题:当多个 AI Agent 异步跑任务时,人类需要一个统一的地方接收它们的结果、提问和待办事项。

TypeSafe AI 获得 4000 万美元种子轮融资,核心方向是让模型在给出数值答案时同步输出概率估计,帮助企业在实际业务中判断 AI 输出的可靠性。这切中了当前大模型落地的一个关键痛点:答案看起来对,但不知道该信多少。

据 The Information 报道,Meta 计划在今年秋季推出一款不带摄像头的智能眼镜,配备六个麦克风,重点转向语音交互,让用户直接与 Meta 的 AI 聊天机器人和 Muse 对话。这意味着 Meta 在可穿戴设备上正从“拍摄记录”转向“语音助手入口”。

当好莱坞还在担心 AI 冲击演员与制作流程时,中国短剧行业已经把 AI 生成视频大规模投入生产。据中国网络视听服务协会数据,今年前三个月中国微短剧产量达 12.8 万部,其中超过 95% 由 AI 参与制作。

Vercel 把 inbound 销售开发团队从 10 人压缩到 1.25 人,靠自建 AI 智能体完成约 90% 的销售开发自动化和 93% 的客服处理量,全年基础设施成本只有几千美元。这说明 AI 销售智能体已经跨过“能用”门槛,真正值得关注的是被固化下来的工作流,而不是模型本身。

2026年9月15日,社区更新转载了一篇由 @leoshen0 撰写的 Agent 入门长文,主张从大模型最基础的 Token 生成机制出发,重新理解 AI Agent 的运作原理,而不是追逐不断更迭的工具与工作流。