标签: Anthropic

Anthropic:大语言模型在回答前想了什么?

Anthropic:大语言模型在回答前想了什么?

Anthropic 通过 J-lens 工具读取大语言模型 Claude 的内部“思考过程”,发现其内部存在一个类似人脑“全局工作空间”的信息处理机制。这一发现为 AI 安全审计和模型行为控制提供了可操作的工具,但并未证明 AI 拥有真正的意识。