标签: Anthropic

Anthropic 拥有解决其“Mythos”噩梦的方案

Anthropic 拥有解决其“Mythos”噩梦的方案

Anthropic 正借鉴英伟达过去处理技术叙事与商业现实错位的经验,试图缓解其“Mythos”项目所引发的内部与外部争议——该模型在演示中表现惊艳,但实际部署中暴露出高成本与难以大规模商用的问题,这对公司融资与客户信任构成直接挑战。

OpenAI 强化学习实现广泛且持久的有益模型

OpenAI 强化学习实现广泛且持久的有益模型

OpenAI 在 6 月 18 日发布研究成果,发现通过强化学习在单一领域(如健康)训练模型的“有益特质”(诚实、可纠正性、透明等),能显著提升模型在数十个无关领域的对齐表现,且这种改进在对抗性攻击下依然保持稳定。

MCP 零接触 OAuth

MCP 零接触 OAuth

MCP 协议正式推出 Enterprise-Managed Authorization 扩展,允许企业通过 Okta 等身份提供商集中管理所有 MCP 服务器的访问权限,用户只需一次登录即可自动获得授权,彻底消除此前每个服务器都要单独 OAuth 验证的摩擦。

白宫与Anthropic的对话转向制定人工智能安全规则

白宫与Anthropic的对话转向制定人工智能安全规则

美国白宫正在与Anthropic讨论建立一套标准化框架,用于评估AI模型安全漏洞(行业俗称“越狱”攻击)的严重程度,并据此决定政府是否需要干预。这是针对此前因Anthropic拒绝主动下架被指有安全漏洞的最新模型后,美国政府强制实施出口管制的一次政策转向——双方开始从冲突走向标准共建。