日本Sakana AI放出Fugu Cyber:一个多智能体系统,把GPT-5.5-Cyber和Claude都挑落马下

日本AI初创公司Sakana AI于7月21日发布网络安全专用多智能体系统Fugu Cyber,在两项严苛基准测试中分别达到86.9%和72.1%的成功率,超过了OpenAI的GPT-5.5-Cyber和Anthropic的Claude Mythos-Preview,表明在特定垂直领域,专业化小模型已经能击败…

日本AI初创公司Sakana AI于7月21日发布网络安全专用多智能体系统Fugu Cyber,在两项严苛基准测试中分别达到86.9%和72.1%的成功率,超过了OpenAI的GPT-5.5-Cyber和Anthropic的Claude Mythos-Preview,表明在特定垂直领域,专业化小模型已经能击败…

OpenAI宣布升级ChatGPT家长通知功能,当未成年用户因暴力威胁或网络霸凌等严重违规被停用时,关联账户的家长或监护人将立即收到警报。这一举措将AI安全防护从预防自伤扩展至防范对他人的伤害,对青少年AI使用规范具有行业示范意义。

Anthropic 的旗舰模型 Fable 5 在性能上与近期发布的开源模型接近,但单次任务的推理成本几乎是 OpenAI 和开源模型的三倍。这一成本劣势可能动摇其在商业竞争中的地位,尤其是在竞争对手拥有更强基础设施能力的情况下。

月之暗面(Moonshot AI)于7月16日发布旗舰大模型Kimi K3,一个拥有2.8万亿参数的MoE架构模型,并承诺于7月27日开放权重。这标志着中国AI公司在开源路线上再次逼近全球最前沿,缩小了曾经被广泛讨论的6到9个月代差。

Anthropic调整了Claude Fable 5的定价策略:从2026年7月20日起,Max套餐用户可在每周使用限额内免费使用最多50%的Fable 5额度;而Pro和Team标准席位用户则需按量付费使用,不再享有免费额度。

微软正式推出 Agent Framework for Go 的公开预览版,使 Go 语言开发者能直接构建 AI 智能体。继谷歌之后,微软也完成了对 Go 语言的原生智能体框架支持,而 OpenAI 和 Anthropic 至今未跟进,在云原生开发者生态中形成明显差距。

为削减高昂的AI运营成本,微软正在评估将中国AI公司月之暗面(Moonshot AI)开发的Kimi K3模型引入Copilot服务,此举每年可能节省约6.02亿美元(约合人民币40亿元),但也面临美国政府的潜在监管与禁令风险。

美国联邦法官正式批准 Anthropic 与作家团体达成的 15 亿美元版权和解协议,这是美国历史上金额最高的版权赔偿案,也意味着首起针对 AI 公司训练大模型使用书籍的版权集体诉讼在美国庭前终结。此前法院已作出“合理使用”的有利裁决,但 Anthropic 也因保存盗版书籍被指侵权。

索尼音乐在美国纽约南区联邦法院再次起诉AI音乐公司Udio,指控其未经授权复制超过3万段录音用于训练AI模型。这起诉讼是此前三大唱片公司版权纠纷的延续,且在索尼音乐扩大诉讼范围的申请被法院驳回后重新发起。

Gartner 最新预测,全球 AI 模型与平台市场的终端用户支出将在 2026 年达到约 640 亿美元,同比增长 63.4%。其中生成式 AI 模型支出增长尤为迅猛(+117%),而 AI 平台也保持稳健增长(+36.9%),表明企业正在从实验性投入转向对效率和实际回报的严格考核。