OpenAI 联合 80 多位心理健康专家发布开放基准 MentalHealthBench

OpenAI 联合 22 个国家、80 多位持证心理健康专家推出开放基准 MentalHealthBench,用于评测 AI 在真实心理健康对话中的表现。它的意义在于:过去这类评测几乎只盯“紧急危机场景”,现在开始覆盖从日常压力到急性危机的完整光谱。

OpenAI 联合 22 个国家、80 多位持证心理健康专家推出开放基准 MentalHealthBench,用于评测 AI 在真实心理健康对话中的表现。它的意义在于:过去这类评测几乎只盯“紧急危机场景”,现在开始覆盖从日常压力到急性危机的完整光谱。

2026 年 9 月 23 日,OpenAI 公布客户案例:亚太客服平台 Ringg 用 GPT-5.6 等模型做语音和聊天 AI Agent,每月处理 700 万通以上来电,最多 65% 的客户请求由 Agent 直接解决,部分工作负载成本比 GPT-4.1 降低约 90%。

OpenAI 于 2026 年 9 月 23 日发布案例,视频编辑工具 invideo 接入 GPT-6 Astra 后,调色与校色任务成功率提升约 3 倍,并能在一天内产出约 50 个可继续编辑的自定义特效。

OpenAI 于 9 月 23 日发布案例,法律 AI 公司 Harvey 使用 GPT-6 Astra 把案件材料、判例检索和律所文档等法律语境注入起草流程,输出结构更完整、格式更规范的法律文书,让律师把精力从排版整理转向策略判断。

GitHub 在 Copilot 应用中上线本地沙箱功能(公开预览版),通过限制会话对文件系统、网络和凭证的访问,降低 AI 执行意外命令带来的风险。但该功能默认关闭,且不适用于云端或远程主机上的会话。

Google DeepMind 在 2026 年 9 月 23 日公布了 Private AI Compute 的服务器端持久记忆方案,让云端 AI 在跨设备保留上下文的同时,把解密密钥只留在用户设备上。这解决了"云端算力"与"端侧隐私"长期二选一的矛盾。

Google Beam 把“视频会议像面对面”的硬件方案扩展到六个国家,并首次通过共享办公空间搭建体验网络,意味着这类沉浸式会议设备正从内部测试走向规模化商用。

GitHub 在 Copilot 应用中重构了拉取请求(PR)视图,让包含 2200 个文件、超百万行改动和 400 多条行内评论的巨型 PR 也能流畅渲染,核心难点不在代码 diff,而在于高度不可预知的评论。

NVIDIA 与 Hugging Face 联合发文,介绍如何用 NVIDIA Warp 和 MuJoCo Warp(MJWarp)把经典 CPU 版 MuJoCo 机器人仿真迁移到 GPU 上,单次可并行运行最多 2,048 个环境,从而加速机器人的仿真与学习工作流。

Omdia 数据显示,2026 年上半年全球 AI 眼镜出货 420 万台,Meta 以 340 万台拿下 81.3% 份额,而排名第二的 Even Realities 卖的是没有摄像头、也没有扬声器的 G2。这一对比说明,AI 眼镜的市场主导逻辑和隐私争议正在同时被摆上台面。