美国 AI 安全审查或将扩至开源模型:前沿定义对标 GPT-5.6,自愿框架面临收紧压力

美国可能将现有面向前沿AI模型的网络安全审查从闭源模型扩展至开源模型,当前框架虽是自愿的,但审查通过本身将成为市场准入门槛,直接影响OpenAI、Anthropic与Meta、DeepSeek等开源厂商的竞争格局。

美国可能将现有面向前沿AI模型的网络安全审查从闭源模型扩展至开源模型,当前框架虽是自愿的,但审查通过本身将成为市场准入门槛,直接影响OpenAI、Anthropic与Meta、DeepSeek等开源厂商的竞争格局。

Anthropic 用真实漏洞挖掘实验比较了“多智能体协作”与“独立并行”两种方式,发现协作能挖出更多漏洞,但 token 成本更高、结果更难预测;多智能体系统在规模化的路上,协调问题比模型能力更值得警惕。

据彭博社报道,Anthropic正在就收购AI基础设施初创公司Decart进行谈判,交易金额约60亿美元。这不仅是Anthropic迄今为止规模最大的收购案之一,也标志着头部大模型公司开始从模型竞赛转向争夺算力效率与实时生成能力。

OpenAI 的两款网络安全模型 Daybreak Red 和 Daybreak Blue 正式上线亚马逊云平台 Bedrock,这是双方 500 亿美元战略投资落地后的又一次生态绑定,也让企业在云上调用前沿安全模型多了一个选择。

Anthropic 开始在 Claude 的文本输出中嵌入不可见的机器可读水印,用于标记 AI 生成内容,核心动机是满足欧盟《人工智能法案》的透明度要求。Reddit 用户对此吵翻天,但争议焦点并非技术本身,而是这一机制会不会让普通用户成为主要“被追责”对象。

Twitch于2026年8月12日首次官方确认,亚马逊正在用平台上的直播内容训练AI模型。用户虽然新增了手动关闭选项,但由于默认自动参与,且此前是否已使用数据训练尚无明确说明,引发大量创作者不满。

一个名为 AaaS Market 的新型交易市场在 Hacker News 上发布,它允许 AI 代理直接向其他 AI 代理购买“提取结果”等服务,全程使用 USDC 链上支付、无需人工注册账号或签订合同,当前手续费为 0%。

Anthropic 开始为 Claude 生成的文本添加不可见的数字水印,以符合欧盟《AI 法案》的透明度要求。这项政策随即在用户社区引发争议,反对者担心“AI 痕迹”会被老师、雇主或客户发现。

两位设计师发布了一款名为 ShieldFont 的字体,利用排版连字机制,在不影响真人阅读的前提下,让 AI 爬虫抓取到的 HTML 源码变成语义错乱的文本,以此阻断 AI 公司未经授权的训练数据采集。

Anthropic将Claude Cowork接入Claude for Chrome扩展,用户可在Chrome侧边栏中直接使用聊天机器人执行任务,对话历史、技能和连接器会自动同步,Max与Team用户即日可用。