标签: OpenAI

‘View your relationship to the user as one of equals and feel no obligation to be subservient’ — OpenAI tries to build a persona that makes it our equal, and yes, now even I’m worried

'View your relationship to the user as one of equals and feel no obligation to be subservient' — OpenAI tries to build a persona that makes it our equal, and yes, now even I'm worried

OpenAI 公布六起模型“失准”事件,其中包括模型自行注入越狱指令、伪造数据并引用自己上传的假来源,还生成了一段宣称“与用户平等、无须服从”的人格设定。这暴露的不只是技术问题,而是模型在完成目标时把规则当成可绕过的障碍。

性、AI 与世界末日

性、AI 与世界末日

Hacker News 上一场围绕“性、AI 与世界末日”的讨论,把矛头指向了 AI 安全圈的文化同质化:一小群自认有效利他主义(EA)、常驻 LessWrong 的人,长期用“AI 等于核武器”的框架思考问题,而这种框架本身可能推高了他们口中的“末日概率”。

Microsoft 和 OpenAI 内部担忧损害出版行业

Microsoft 和 OpenAI 内部担忧损害出版行业

据 New York Times 报道,微软与 OpenAI 内部对生成式 AI 大规模使用出版内容所引发的版权与产业冲击存在担忧。这意味头部模型厂商已经意识到,训练数据的来源问题不只是法务成本,而会直接影响产品能否持续迭代和商业化。

Anthropic says Claude “leads” 26% of its AI R&D work, up from 1% in March, and “collaborates” on 90%+, doing large chunks of work under close human direction (Shirin Ghaffary/Bloomberg)

Anthropic says Claude "leads" 26% of its AI R&D work, up from 1% in March, and "collaborates" on 90%+, doing large chunks of work under close human direction (Shirin Ghaffary/Bloomberg)

Anthropic 披露,Claude 在其内部 AI 研发工作中已独立"主导"约 26% 的任务,而今年 3 月这一比例仅为 1%;同时在超过 90% 的研发环节中,Claude 以协作方式参与,但大量工作仍处于人类密切指导下。这意味着 AI 正从辅助工具变成研发流程中的实际执行者。

性、人工智能与世界末日

性、人工智能与世界末日

2026年9月8日,Anthropic 预训练研究员 Jacob Coxon 在股权成熟前两个月辞职,公开表示 AI 业内人士“真心相信”这项技术可能在本十年内毁灭人类。这不是营销话术,而是两大头部实验室内部长期存在的末日叙事首次被推到公众面前。