小红书发布大模型新架构 PIPO

小红书技术团队提出了名为 PIPO 的大模型推理架构,通过“成对输入、成对输出”的设计,在保持模型推理质量的同时,将首字延迟(TTFT)加速最高 2.64 倍,逐 token 生成速度(TPOT)加速最高 2.07 倍。这一做法直接回应了长链推理场景下日益突出的效率瓶颈。

小红书技术团队提出了名为 PIPO 的大模型推理架构,通过“成对输入、成对输出”的设计,在保持模型推理质量的同时,将首字延迟(TTFT)加速最高 2.64 倍,逐 token 生成速度(TPOT)加速最高 2.07 倍。这一做法直接回应了长链推理场景下日益突出的效率瓶颈。

GitHub Mobile 为其 Copilot 会话列表新增了轻量级筛选和排序功能,让开发者在移动端从数十个 AI 对话中快速定位所需会话,告别手动翻找的繁琐体验。

知名科技行业观察者 Dan Shipper 于2026年7月9日在X平台发文,将GPT-5.6 SOL定义为知识工作的“黄金标准”,暗示该模型在复杂认知任务上的表现已超越现有竞争对手,成为行业新标杆。

OpenAI CEO Sam Altman 于 2026 年 7 月 9 日透露,企业客户反馈 AI 推理成本过高,为此团队在推理效率上取得突破——以“5.6 sol”为单位的每任务成本(美元)大幅下降,同时新模型 terra 和 luna 也显著降低了单位任务的算力开支。

OpenAI 于 2026 年 7 月 9 日发布 GPT-5.6 系列模型(Sol、Terra、Luna),正在 ChatGPT、Codex 和 API 中逐步推出。Box CEO 同步披露的内部测试显示,顶级模型 Sol 在复杂企业文档推理任务上显著超越前代 GPT-5.5,尤其在金融、医疗等需要深度数据…

Sam Altman 在 X 平台确认,OpenAI 即将推出的“ChatGPT Work”产品以 Codex 为核心,并强调 Codex 不会被废弃。该产品结合了 GPT-5.6 模型,定位为能跨应用和文件执行任务的长期工作代理,标志着 OpenAI 从对话助手向生产力工具的转型。

OpenAI 在2026年7月9日晚间宣布,所有用户的 ChatGPT Work 和 Codex 使用限制将被完全重置,并在一小时内生效。同时,一位名为 Rajan Agarwal 的研究人员正式加入团队,主攻模型研究与编码能力提升,负责此次“按钮”操作。

AI 开发者社区曾在2026年中期嘲笑初创公司 Greptile 的部分功能实现,但随后 OpenAI 在类似方向上推出了更激进的方案,显示出大模型公司正在将小型团队的实验性探索视为产品路线图的加速器。

OpenAI 于 2026 年 7 月 9 日发布 ChatGPT Work(基于 Codex 和 GPT-5.6 的新代理功能),允许用户通过实时语音、图像、浏览器/计算机使用及插件执行复杂任务。科技博主 Peter Yang 在第一时间测试后给出详细赞扬与反馈,强调了产品在主流化、语音交互和统一体验方面的…

OpenAI 董事会成员、前首席营收官 Fidji Simo 因慢性疾病恶化,正式辞去全职职务,转而担任兼职顾问。CEO Sam Altman 公开表达遗憾与感谢,反映出这家明星初创公司在高速扩张中正经历核心管理层的意外变动。