标签: OpenAI

昨晚,AI圈又疯狂了

昨晚,AI圈又疯狂了

Anthropic 在 Claude 模型内部发现了一个名为“J 空间”的隐式推理区域,证明 AI 在回答前会进行不对外显示的思考活动,研究人员甚至可以篡改该区域的中间逻辑来改变模型的输出结果。这一发现直接挑战了“AI 仅是文字接龙”的既有认知,也为 AI 安全检测提供了新的底层视角。