全双工实时语音上线,ChatGPT彻底告别“对讲机”时代

OpenAI于近日向全球用户推送了基于GPT-Live架构的全新语音体验。该技术让ChatGPT在语音对话中实现“边说边听边想”,突破了过去必须等用户说完才能回应的单双工模式,标志着AI语音助手从“对讲机”式交互向类人实时对话的转变。

OpenAI于近日向全球用户推送了基于GPT-Live架构的全新语音体验。该技术让ChatGPT在语音对话中实现“边说边听边想”,突破了过去必须等用户说完才能回应的单双工模式,标志着AI语音助手从“对讲机”式交互向类人实时对话的转变。

OpenAI于2026年7月9日正式推出基于GPT-Live架构的新版ChatGPT语音体验,核心突破在于采用全双工模型,让AI能像人一样同时聆听、思考与回话,不再需要等待用户说完才能响应。这是自2024年Advanced Voice Mode以来最具架构意义的一次升级。

前 OpenAI 研究员田永龙(Yonglong Tian)已加入腾讯大模型部门,主要负责视觉语言模型(VLM)的研发工作。这一人才流动反映出国内大厂在视觉-语言多模态技术路线上的竞争正在加速,且直接瞄准 OpenAI 研究成果的产业化落地。

MiniMax正在加速筹备下一代大模型,该模型参数规模将达到2.7万亿,创下中国大模型领域“参数量”的新纪录。这是一个技术信号,意味着国内头部大模型厂商之间围绕“更大规模参数”的战斗,已从千亿级正式迈向万亿级。

2026年7月8日,Cloudflare与OpenAI正式启动一项深度研究试点,核心目标是利用Cloudflare全球网络中的实时数据信号(如网页更新频率、流量趋势和变化轨迹)来提升AI搜索引擎的内容索引精度和实时性。这意味着AI搜索将不再完全依赖传统爬虫,而是能更动态地捕捉互联网上最新、最活跃的信息流。

AI 创业公司 Anthropic 于今年 6 月 1 日秘密提交了首次公开募股(IPO)申请,若进展顺利,它将成为目前市值最大的 AI 实验室上市公司。此举发生在 OpenAI 宣布将其 IPO 计划推迟至 2027 年之际,Anthropic 凭借 Claude Code 在 B2B 市场的强劲表现,率先…

2026年7月9日,字节跳动正式发布多模态图像创作模型Seedream 5.0 Pro,核心升级在于将AI图像生成从“一次性出图”推进到“可交互、可局部精准编辑”的设计阶段。该模型在复杂信息可视化、交互式编辑、真实感纹理及多语言生成上均有明显突破,目前已在火山方舟体验中心上线,并将逐步接入豆包和即梦平台。

HubSpot 在 2026 年 7 月 1 日更新服务条款,被用户发现可能擅自抓取 CRM 中的联系人与商业数据用于“商业数据集”,引发大规模信任危机。四天后,公司宣布完全撤回该条款,并承诺未来所有数据增强功能将严格以“透明 Opt-in”方式提供。

一篇 BBC 报道揭露了美国建国史上一个鲜为人知的篇章:在费城所在的特拉华河谷地区,曾存在一个仅持续17年的瑞典殖民地“新瑞典”。它虽短命且几乎被遗忘,却引入了原木小屋、路德宗信仰等影响美国文化的元素,揭示了美国多元起源的另一面。

历史学者 Carlyn Beccia 在《The Grim Historian》上发表长文,借用古罗马、古希腊和19世纪纽约坦慕尼协会的历史案例,提出“混蛋门槛”(asshole threshold)概念——当一个社会的寄生性利益集团超过某个临界点,诚实的人开始觉得自己是傻瓜,系统便会加速腐烂。作者认为美国正…