标签: ChatGPT

AI 模型不杀人,人杀人

AI 模型不杀人,人杀人

Anthropic 研究员 Jacob Coxon 于 2026 年 9 月 7 日公开辞职,称 AI "可能在这个十年结束前杀死所有人";其同事 Evan Hubinger 回应称"我们确实认真相信 AI 可能杀死全人类",并给出十年内超过 10% 的主观概率。但这场争论真正的问题不是模型会不会杀人,而是谁…

变压器电路的数学框架(2021)

变压器电路的数学框架(2021)

Transformer Circuits 团队在 2021 年发布了一篇数学框架论文,用一套等价但更易读的方式重新描述 Transformer 内部计算,并首次在小模型中定位到能解释“上下文学习”的“归纳头”。它不发布产品,却是后来大模型可解释性研究的重要起点。

为什么 AI 研究者明知会杀死人类,却还在不停地造它

为什么 AI 研究者明知会杀死人类,却还在不停地造它

OpenAI 首席财务官 Sarah Friar 在旧金山高盛科技大会上透露,大模型已能训练更小的模型,这种"递归自我改进"(RSI)让部分 AI 研究者公开表达对生存风险的担忧;但与此同时,投资人和公司仍在继续推进研发。争论的焦点不是技术能不能做,而是明知可能有风险,为什么还在做。