OpenAI 发布 GPT-Live 和 GPT-Live-1 mini:全双工语音模型,将更深入的推理委托给 GPT-5.5

OpenAI 于 2026 年 7 月 8 日发布 GPT-Live 系列全双工语音模型,专注低延迟实时对话,而将复杂推理任务转发给尚未公开的 GPT-5.5 处理,标志着语音交互从“问答型”向“任务分工型”转变。

OpenAI 于 2026 年 7 月 8 日发布 GPT-Live 系列全双工语音模型,专注低延迟实时对话,而将复杂推理任务转发给尚未公开的 GPT-5.5 处理,标志着语音交互从“问答型”向“任务分工型”转变。

OpenAI 于 2026 年 7 月 8 日发布新一代语音模型 GPT-Live,采用全双工架构,让 ChatGPT 能同时听和说,并可将复杂任务后台委托给 GPT-5.5 处理,大幅提升对话流畅度与智能水平。

谷歌在 Google Photos 中推出基于 Gemini Omni 模型的"Video Remix"功能,让用户无需专业软件即可通过几次点击完成视频重打光、换背景和添加艺术风格等编辑。这是谷歌将生成式 AI 能力下沉到消费级应用的最新动作,直接对标苹果、OpenAI 和 Adobe 的类似产品,意在巩固其…

xAI 于 2026 年 7 月 8 日发布了 Grok 4.5 模型,在多项软件工程基准测试中紧追 Anthropic 的 Fable 5 与 OpenAI 的 GPT-5.5,但定价远低于它们——输入每百万 token 仅 2 美元、输出 6 美元。若实际表现与效率承诺成立,这将对闭源大模型市场的定价标准…

初创公司 General Intuition 用数百万小时游戏数据训练了一个机器人基础模型,仅用8分钟真实机器人数据微调,就能让四足机器人适应动态办公环境。这家公司刚以23亿美元估值完成3.2亿美元融资,认为机器人领域正在从“专用模型时代”走向“通用基础模型时代”。

Cursor 与 SpaceXAI 联合发布 Grok 4.5,这是一款不再仅限软件工程的通用智能模型,能执行需要创造性工具使用的复杂长任务。模型定价为每百万输入 Token 2 美元,输出 6 美元,并提供快速变体。

GitHub 在 JetBrains IDE 中开放了 Codex 作为新的 AI 代理选项,并大幅增强代理的自定义能力——包括 Hooks、MCP 服务器管理、审批模式和 CLI 自动化控制,让开发者能更精细化地管理 Copilot 的行为与权限。

GitHub 的 actions/setup-java 发布 v5.5.0 版本,新增 JDK 下载的加密签名验证、原生支持腾讯 Kona JDK,并修复了 Maven 工具链重复写入等多项开发者体验问题。

加拿大安大略省自2026年初实施招聘AI使用披露新规后,提及AI相关术语的招聘启事比例从9%跃升至28%,显示AI在招聘流程中的渗透已相当普遍,且实际覆盖范围可能更高。

著名风险投资人、OpenAI 早期支持者维诺德·科斯拉在《华尔街日报》访谈中解释了他的“期权价值型投资”策略,并对 OpenAI 的高估值毫不在意。他强调,投资应承受高风险以换取十倍、百倍甚至千倍回报,并认为 AI 行业创造的巨大价值将主要流向资本方,而非劳动者。