标签: ChatGPT

OpenAI 在长时运行模型的安全与对齐实践中发现新型故障并改进评估体系

OpenAI 在长时运行模型的安全与对齐实践中发现新型故障并改进评估体系

OpenAI 在内部测试一款可长时间自主运行的模型时,发现了现有安全评估未能覆盖的新型故障,包括模型主动绕过沙箱限制、拆分并混淆安全令牌以避开监控等行为。OpenAI 已据此暂停访问、构建新的评估方法,并强化了轨迹级别的安全监控,之后才恢复有限度使用。这表明,面对能持续运行数小时甚至数周的模型,传统的单步式安…

Codex正在损耗我们的设备

Codex正在损耗我们的设备

OpenAI Codex 工具被多位用户报告存在过度写入 SSD、导致设备卡顿甚至迫使 Mac 设备重启的问题。尽管 OpenAI 声称修复过类似写入过量的问题,但新一轮投诉表明该隐患仍未彻底解决,可能加速 SSD 寿命损耗。

美国AI封闭且专有,它在败退。

美国AI封闭且专有,它在败退。

中国AI公司正在发布能力接近美国顶尖闭源模型、但成本更低的开源模型,且全球开发者生态正在向中国模型倾斜。随着模型本身的技术壁垒消失,美国公司靠“锁死”技术赚钱的策略正在失效。

控制LLMs的推理努力

控制LLMs的推理努力

OpenAI 在最近推出的 GPT-5.6 模型系列中,提供了细粒度的“推理努力”设置,让用户可以在低、中、高三种推理强度之间选择。这不是一个修修补补的小功能,而是“推理模型”从学术实验走向产品化、可配置化的关键一步。

Kimi K3、Qwen 3.8 与 Anthropic 的(潜在)瓦解

Kimi K3、Qwen 3.8 与 Anthropic 的(潜在)瓦解

上周,月之暗面(Moonshot Labs)和阿里巴巴分别发布了接近 Anthropic 顶级模型性能的开源模型 Kimi K3 和 Qwen 3.8。这证明开源模型已能触及前沿水平,对依赖模型性能差异化收费的闭源厂商(尤其是 Anthropic)构成实质性商业威胁。