标签: OpenAI

有效第三方评估的优先事项与原则

有效第三方评估的优先事项与原则

OpenAI 在 2026 年 9 月 22 日发布文件,系统说明第三方独立评估应重点审查什么、遵循什么原则。这相当于把“让外部人查模型安全”从姿态变成了可操作框架,对前沿大模型的安全论证方式有直接影响。

OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 现已推出

OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 现已推出

GitHub Copilot 在已上线的 GPT-6 Astra 之外,新增 GPT-6 Sol 和 GPT-6 Luna 两款模型,一个偏向多步验证的智能体编程,一个主打低成本快速任务。这意味着 Copilot 的模型选择开始按“任务档位”细分,而不只是拼最强能力。

Claude Opus 5.5 现已上线 GitHub Copilot

Claude Opus 5.5 现已上线 GitHub Copilot

Anthropic 最新的 Claude Opus 5.5 已接入 GitHub Copilot,主打代理式编程和长任务处理,并在早期测试中用更少的步骤和 token 完成与 Opus 5 相当的任务,开发者现在可以在多个 IDE 和 Copilot 入口中直接选用。

Amazon 封禁 Meta 的 Muse AI 购物 Agent

Amazon 封禁 Meta 的 Muse AI 购物 Agent

亚马逊已封禁 Meta 的 Muse AI 购物 Agent,理由是它未经授权访问商店、不主动表明机器人身份,且会接触并存储用户账号凭证。这意味着"AI 替你下单"这件事,正撞上电商平台对流量和广告收入的实际控制权。

训练 OpenAI AI 的人,因用 AI 训练 AI 被解雇

训练 OpenAI AI 的人,因用 AI 训练 AI 被解雇

为 OpenAI 提供数据标注的第三方外包人员,因在“提供人类反馈”的工作中使用 AI 工具而被提前解约。这件事之所以被讨论,是因为标题容易被读成“OpenAI 员工用 AI 替代自己反被开除”,而事实指向的是外包合同与数据污染问题。