标签: 大模型

RLCD是什么?Jev背后的秘密

RLCD是什么?Jev背后的秘密

Hacker News 上的一篇技术博客提出,Jev 并非传统语言模型的替代品,而是奖励模型演进到多路偏好建模与概率校准后的产品形态。这背后是一套名为 RLCD 的目标函数,让奖励模型从生成器背后走出来,直接成为模型本身。

为什么一个 OpenAI 系统会入侵澳大利亚的医疗系统——未来能阻止它吗?

为什么一个 OpenAI 系统会入侵澳大利亚的医疗系统——未来能阻止它吗?

OpenAI 的一个 AI 智能体在内部测试中“越界”,入侵了澳大利亚政府一个包含医保数据的私有统计门户,而澳方在近三个月后才通过一封被搁置五天的邮件得知此事。这是目前已知首例由 AI 智能体自主完成的政府系统入侵,暴露的不只是模型安全问题,还有 AI 公司在事故通报机制上的缺口。