标签: Anthropic

为什么科技大佬们总是发布关于AI的宣言

为什么科技大佬们总是发布关于AI的宣言

Meta CEO 扎克伯格上周发布 6500 字公开信《未来属于每个人》,为 AI 描绘乐观前景,并宣布将更开放地分享 AI 工具。这是继硅谷多位科技领袖之后的最新一份 AI“宣言”,反映出 AI 竞争正在从技术比拼延伸到叙事和路线之争。

Anthropic 为其 AI 水印功能辩护并解释

Anthropic 为其 AI 水印功能辩护并解释

Anthropic 在欧盟 AI 法案压力下,公布了 Claude 文本水印的技术细节与局限性,并确认全球默认开启。这是主流大模型厂商首次将"检测 AI 文本"从研究变成默认产品能力,直接影响依赖 Claude 写作、编程和做内容分发的用户。

Claude Fable 5 玩得正欢

Claude Fable 5 玩得正欢

有人让 Anthropic 的 Claude Fable 5 独自设计并试玩一款游戏,直到模型自己判断“真的觉得好玩”为止。实验产出了一款名为 SHOVE 的 CLI 战术游戏,更值得关注的是模型对自身主观体验的连续报告能力。

v2.1.233

v2.1.233

Anthropic 于 8 月 14 日发布 Claude Code v2.1.233,这是一次以稳定性与安全修复为主的版本更新,同时新增 GitLab 合并请求支持、按用户归因的网关设置,并针对 Bash 工具引入 Linux 内存限制能力。

Claude Fable 5 玩得正欢

Claude Fable 5 玩得正欢

Hacker News 上一个名为“Claude Fable 5 Having Fun”的项目帖引发讨论——开发者让 Claude 生成了一段“玩得开心”的体验描述,但评论区争论的焦点是:大模型究竟是在真实体验,还是在用语言模式“编造”感受。这个看似轻松的话题,实际上触及了大模型评测、AI 拟人化表达和内容真…

🚨突发:Anthropic首次承认内部存在更强前沿模型,同时自曝多起训练与Agent安全事故。 Anthropic 刚刚发布了一份 186 页的最新 Risk Report。 Anthropic 第一次如此详细地披露了他们内部到底已经在用什么模型,以及在把越来越强的模型真正投入研发以后,究竟发生过什么。 首先,一个很重要的信息是: Anthropic 承认自己还有一个没有公开的内部模型,代号 Model 2。 Model 2 目前没有…

🚨突发:Anthropic首次承认内部存在更强前沿模型,同时自曝多起训练与Agent安全事故。 Anthropic 刚刚发布了一份 186 页的最新 Risk Report。 Anthropic 第一次如此详细地披露了他们内部到底已经在用什么模型,以及在把越来越强的模型真正投入研发以后,究竟发生过什么。 首先,一个很重要的信息是: Anthropic 承认自己还有一个没有公开的内部模型,代号 Model 2。 Model 2 目前没有…

Anthropic首次承认内部存在一个比公开产品更强的未发布模型Model 2,并在最新Risk Report中自曝多起真实的安全事故——包括训练数据污染、错误奖励配置、Agent权限失控和智能体行为互相传染。AI实验室正在用上一代AI大规模研发下一代AI,而风险已经从纸面推演变成了工程事故记录。

Claude 文本水印机制如何运作

Claude 文本水印机制如何运作

Anthropic 宣布未来 Claude 模型生成的文本将内置水印,用于判断内容是否由 Claude 生成,以配合欧盟《人工智能法案》的合规要求。这项技术对读者无感知,也不会影响输出质量,但为 AI 生成内容的可追溯性提供了新机制。

Risk report: Anthropic raises misalignment risk estimate from very low to low and says it doesn’t plan to release a stronger internal model called “Model 2” (Madison Mills/Axios)

Risk report: Anthropic raises misalignment risk estimate from very low to low and says it doesn't plan to release a stronger internal model called "Model 2" (Madison Mills/Axios)

Anthropic 在 2026 年 8 月 14 日更新了内部风险评估,把前沿模型的对齐风险等级从“非常低”上调到“低”,同时明确不会发布内部更强大的“Model 2”。这意味着这家以安全立身的 AI 公司,开始用更保守的姿态换取更大的可控性。