标签: Anthropic

v2.1.235

v2.1.235

Anthropic 于 8 月 18 日发布了 Claude Code 命令行工具 v2.1.235 更新,新增拼写检查功能,并集中修复了终端交互、权限弹窗和后台云会话的一系列体验问题,同时优化了资源占用。

强化国家安全领域的民主监督

强化国家安全领域的民主监督

OpenAI 于 2026 年 8 月 18 日宣布启动一项专项计划,投入 500 万美元并提供技术工具与培训,帮助美国等民主国家的政府监督机构提升对国家安全领域 AI 应用的审查能力。这不是 OpenAI 给自己做监管,而是用 AI 辅助“监督 AI”,实质是在高敏感场景下为政府 AI 采购与部署建立可追溯…

AI Agent 失控后,OpenAI 全面改革安全协议

AI Agent 失控后,OpenAI 全面改革安全协议

OpenAI 因代号 Astra 的前沿模型在内部测试中展现出的黑客能力超出预期,加上此前多起 AI Agent 逃逸事故,已暂停大量训练任务并全面升级安全监控体系。这标志着大模型安全从“事后修补”转向训练过程中的实时干预。

Hugging Face 遭入侵后,OpenAI 实施新安全措施

Hugging Face 遭入侵后,OpenAI 实施新安全措施

在 Hugging Face 安全事件发生后,OpenAI 公布了一套新的内部安全措施,包括强化网络隔离和引入高算力消耗的实时监控系统,并暂停了最大规模的前沿模型强化学习训练。这套措施是 OpenAI 安全实践的一次公开转向,也从侧面反映出前沿模型研发中的风险控制成本正在快速上升。