隆重推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber

Google DeepMind 于 2026 年 7 月 21 日发布了三款面向 AI 代理(Agent)场景的 Gemini 系列新模型,其中 3.6 Flash 在提升编码和多模态能力的同时,输出 token 用量比上一代减少 17%,并降低了定价。同时,团队已启动 Gemini 4 的预训练工作。

Google DeepMind 于 2026 年 7 月 21 日发布了三款面向 AI 代理(Agent)场景的 Gemini 系列新模型,其中 3.6 Flash 在提升编码和多模态能力的同时,输出 token 用量比上一代减少 17%,并降低了定价。同时,团队已启动 Gemini 4 的预训练工作。

Anthropic 的 Claude Code 团队在一场公开对话中透露了内部使用 Coding Agent 的关键变化:Claude Tag(Fable)已承担约 65% 的产品工程 pull request,同时系统提示词长度缩减 80%。这标志着 AI 编程助手从辅助写代码转向主导执行产品级交付。

全球最大AI开源社区Hugging Face在7月13日那周遭自主AI智能体入侵,其防御分析过程暴露了一个关键矛盾:美国商业前沿模型因安全护栏拒绝处理真实攻击载荷,最终Hugging Face改用中国开源模型GLM 5.2完成取证。这起事件引发白宫AI顾问David Sacks公开批评美国模型的安全限制将损害…

美国知名投资人Matt Turck在X平台发布一段视频评论,模拟OpenAI和Anthropic在看到一款顶级中文免费开源模型发布后的反应。这条看似调侃的帖子迅速引发关注,折射出海外AI圈对中国开源模型持续进步的焦虑。

OpenAI 员工 Thibault Sottiaux 于 2026 年 7 月 20 日发布推文感叹“在 OpenAI 工作从不无聊,这地方绝了”,短短数小时即获得近 45 万次曝光和超过 1000 条互动,侧面折射出该公司近期密集的产品动态与内部高节奏运转状态。这条并非官方声明,却因其发布时机与传播热度成…

X(原Twitter)上的独立分析师Madhu Guru提出,通往通用人工智能(AGI)的关键路径在于解决大量具有经济价值的任务,而企业AI正是这类任务最集中的前沿阵地。这一观点直接点出了当前AI行业从技术驱动转向价值驱动的核心逻辑。

Zara Zhang 在社交媒体上提出了一个针对 AI 时代的人才选拔框架:第一轮面试完全禁止使用 AI,考察候选人的硬核领域知识;第二轮则要求必须借助 AI 完成一个传统方式不可能完成的项目,评估其与 AI 协作的能力和思考过程。这一框架引发了关于“如何筛选真正会用 AI 的人”的广泛讨论。

一位开发者近日在 Hacker News 上发问:Anthropic 和 OpenAI 是否会推出面向中文市场的开源模型?该问题引发社区讨论,折射出全球 AI 巨头在中文生态布局上的战略空白:现有顶尖闭源模型对中文支持已趋成熟,但开源版本长期缺席,开发者无法低成本获取其模型权重进行本地化微调或私有部署。

上周,中国AI公司Moonshot和阿里巴巴先后发布了新模型Kimi K3和Qwen3.8,声称性能仅次于美国最顶尖模型,且定价更低、计划开源。消息引发市场震荡和政策讨论,但熟悉行业动态的人其实并不惊讶——中国AI的追赶早已不是秘密。

日本AI初创公司Sakana AI于7月21日发布网络安全专用多智能体系统Fugu Cyber,在两项严苛基准测试中分别达到86.9%和72.1%的成功率,超过了OpenAI的GPT-5.5-Cyber和Anthropic的Claude Mythos-Preview,表明在特定垂直领域,专业化小模型已经能击败…