全双工实时语音上线,ChatGPT彻底告别“对讲机”时代

OpenAI于近日向全球用户推送了基于GPT-Live架构的全新语音体验。该技术让ChatGPT在语音对话中实现“边说边听边想”,突破了过去必须等用户说完才能回应的单双工模式,标志着AI语音助手从“对讲机”式交互向类人实时对话的转变。

OpenAI于近日向全球用户推送了基于GPT-Live架构的全新语音体验。该技术让ChatGPT在语音对话中实现“边说边听边想”,突破了过去必须等用户说完才能回应的单双工模式,标志着AI语音助手从“对讲机”式交互向类人实时对话的转变。

OpenAI于2026年7月9日正式推出基于GPT-Live架构的新版ChatGPT语音体验,核心突破在于采用全双工模型,让AI能像人一样同时聆听、思考与回话,不再需要等待用户说完才能响应。这是自2024年Advanced Voice Mode以来最具架构意义的一次升级。

前 OpenAI 研究员田永龙(Yonglong Tian)已加入腾讯大模型部门,主要负责视觉语言模型(VLM)的研发工作。这一人才流动反映出国内大厂在视觉-语言多模态技术路线上的竞争正在加速,且直接瞄准 OpenAI 研究成果的产业化落地。

2026年7月8日,Cloudflare与OpenAI正式启动一项深度研究试点,核心目标是利用Cloudflare全球网络中的实时数据信号(如网页更新频率、流量趋势和变化轨迹)来提升AI搜索引擎的内容索引精度和实时性。这意味着AI搜索将不再完全依赖传统爬虫,而是能更动态地捕捉互联网上最新、最活跃的信息流。

AI 创业公司 Anthropic 于今年 6 月 1 日秘密提交了首次公开募股(IPO)申请,若进展顺利,它将成为目前市值最大的 AI 实验室上市公司。此举发生在 OpenAI 宣布将其 IPO 计划推迟至 2027 年之际,Anthropic 凭借 Claude Code 在 B2B 市场的强劲表现,率先…

2026年7月9日,字节跳动正式发布多模态图像创作模型Seedream 5.0 Pro,核心升级在于将AI图像生成从“一次性出图”推进到“可交互、可局部精准编辑”的设计阶段。该模型在复杂信息可视化、交互式编辑、真实感纹理及多语言生成上均有明显突破,目前已在火山方舟体验中心上线,并将逐步接入豆包和即梦平台。

随着人机协作在各类组织中的普及,AI提升效率的同时也拉大了内部的薪酬差距,引发了管理者和员工间的利益分配矛盾。这篇来自《清华管理评论》的研究,系统分析了分配不均的成因,并提出“共享式薪酬”方案,试图帮企业在AI落地中平衡效率与公平。

OpenAI正式推出GPT-Live语音模型,旨在通过更自然的语音交互让ChatGPT的对话体验更接近真人。这一更新直接瞄准用户对AI语音助手的核心痛点——机械感与延迟。

布朗大学一名盲人经济学教授发现,大量学生在允许使用AI的居家考试中平均得分96分,而当考试改为线下闭卷后,平均分骤降至48分,27名学生退考或缺考。事件暴露了生成式AI在顶尖学府中的大规模作弊隐患,也引发了关于教育公正和AI工具边界的广泛讨论。

SpaceX AI联合AI编程公司Cursor发布Grok 4.5模型,定位为能处理软件工程、法律和金融等复杂长链任务的通用型AI,试图缩小与Anthropic和OpenAI的差距。