美国别再被中国 AI 吓到了

上周,中国AI公司Moonshot和阿里巴巴先后发布了新模型Kimi K3和Qwen3.8,声称性能仅次于美国最顶尖模型,且定价更低、计划开源。消息引发市场震荡和政策讨论,但熟悉行业动态的人其实并不惊讶——中国AI的追赶早已不是秘密。

上周,中国AI公司Moonshot和阿里巴巴先后发布了新模型Kimi K3和Qwen3.8,声称性能仅次于美国最顶尖模型,且定价更低、计划开源。消息引发市场震荡和政策讨论,但熟悉行业动态的人其实并不惊讶——中国AI的追赶早已不是秘密。

阿里巴巴最新发布的Qwen-Audio-3.0-TTS-Plus模型在第三方测评平台Artificial Analysis的文本转语音排行榜上以1236的Elo评分登顶,仅以微弱优势超越SpeechifyAI的Simba 3.2。这一结果意味着国产大模型在语音合成赛道已具备全球顶尖的听感竞争力,但推理速度偏慢…

小红书技术团队推出的 dots-note 3.0 模型在真实国际数学奥林匹克竞赛(IMO 2026)中,以六题全部满分的成绩夺得金牌,成为首个在完整数学证明场景下达到人类顶尖选手水平的 AI 系统。这一突破的关键在于模型不依赖人工形式化翻译,而是通过“递归自我批判”机制自主完成证明推理与修正。

OpenAI前CTO Murati创立的Thinking Machines Lab发布首款大模型Inkling,架构借鉴DeepSeek-V3、训练数据使用Kimi K2.5,但在多项基准测试中落后于中国开源模型,调用价格却更高。然而,该模型凭借美国本土研发背景与Apache 2.0开源协议,反而精准满足了美…

日本AI初创公司Sakana AI于7月21日发布网络安全专用多智能体系统Fugu Cyber,在两项严苛基准测试中分别达到86.9%和72.1%的成功率,超过了OpenAI的GPT-5.5-Cyber和Anthropic的Claude Mythos-Preview,表明在特定垂直领域,专业化小模型已经能击败…

OpenAI宣布升级ChatGPT家长通知功能,当未成年用户因暴力威胁或网络霸凌等严重违规被停用时,关联账户的家长或监护人将立即收到警报。这一举措将AI安全防护从预防自伤扩展至防范对他人的伤害,对青少年AI使用规范具有行业示范意义。

Anthropic 的旗舰模型 Fable 5 在性能上与近期发布的开源模型接近,但单次任务的推理成本几乎是 OpenAI 和开源模型的三倍。这一成本劣势可能动摇其在商业竞争中的地位,尤其是在竞争对手拥有更强基础设施能力的情况下。

月之暗面(Moonshot AI)于7月16日发布旗舰大模型Kimi K3,一个拥有2.8万亿参数的MoE架构模型,并承诺于7月27日开放权重。这标志着中国AI公司在开源路线上再次逼近全球最前沿,缩小了曾经被广泛讨论的6到9个月代差。

Anthropic调整了Claude Fable 5的定价策略:从2026年7月20日起,Max套餐用户可在每周使用限额内免费使用最多50%的Fable 5额度;而Pro和Team标准席位用户则需按量付费使用,不再享有免费额度。

微软正式推出 Agent Framework for Go 的公开预览版,使 Go 语言开发者能直接构建 AI 智能体。继谷歌之后,微软也完成了对 Go 语言的原生智能体框架支持,而 OpenAI 和 Anthropic 至今未跟进,在云原生开发者生态中形成明显差距。