Google DeepMind发布Gemini Robotics 2,为从桌面机械臂到人形机器人的各种形态机器人提供动力。

Google DeepMind 于 7 月 31 日发布新一代视觉-语言-动作(VLA)模型 Gemini Robotics 2,旨在为不同形态的机器人提供统一“智能层”;同期推出的 Gemini Robotics ER 2 则负责高层级的具身推理,两者配合构成了从感知、决策到动作执行的完整链路。值得关注的是…

Google DeepMind 于 7 月 31 日发布新一代视觉-语言-动作(VLA)模型 Gemini Robotics 2,旨在为不同形态的机器人提供统一“智能层”;同期推出的 Gemini Robotics ER 2 则负责高层级的具身推理,两者配合构成了从感知、决策到动作执行的完整链路。值得关注的是…

谷歌在 Google Earth 中内置了基于 Nano Banana 2 的 AI 图像生成功能,允许用户把任意生成图像叠加到真实卫星地图上,结果因可能被用于制造虚假地理证据而遭到批评,上线一天后即被紧急回滚。这一事件的关键争议在于:AI 生成内容正在侵蚀地图这一长期被视为“客观证据”的数据类型。

GitHub 为 Copilot Business 和 Copilot Enterprise 企业客户推出基于用户(企业团队)的模型策略定向公开预览,让 AI 管理员可以在企业级设定模型基线后,再为特定团队开放额外模型。这意味着企业 AI 治理正从组织级(资源级)向团队级(用户级)细化。

苹果CEO库克在任内最后一次财报电话会议上透露,新版Siri AI可能通过iCloud+订阅对重度用户收费,购买更多算力;这一计划尚未最终敲定,但已参考OpenAI、Anthropic的免费+付费分层模式。

Deepseek 于 2026 年 7 月 31 日发布 V4 Flash “0731” 更新,性能几乎追平 OpenAI 的 GPT-5.6 Luna,但每任务成本低约 60%。在 OpenAI 已降价 80% 的背景下,这一性价比优势对开发者和企业用户有明显吸引力。

awplanet 是一款面向导演和创作者的 AI 原生 3D 场景创作工具,把角色控制、运镜、地形雕刻与分镜时间轴整合进同一套桌面工作流,并提供手机虚拟拍摄能力。它真正值得关注的地方,是用一个轻量级工具把“电影化预演”的门槛拉到了个人创作者可及的范围。

三位数学家构造出 5 个点电荷的特定排布,证明其静电场至少存在 24 个临界点,从而推翻 Maxwell 关于 n 个点电荷最多 (n−1)² 个临界点的两百余年猜想。这项基础数学物理突破,对依赖场论建模的 AI 研究也有潜在参考价值。

TechRadar 的实践文章提出,ChatGPT Voice 的真正价值不在于像智能音箱那样一问一答,而在于通过设定对话规则、角色预设,以及结合桌面端的 Work 功能,把它变成能主动处理多步骤任务的语音助手。这个思路转变,实际上指向了语音交互从“查询工具”向“协作代理”演进的趋势。

OpenAI 披露其模型活跃用户已超过 10 亿,企业客户超过 200 万家,经《华尔街日报》记者 Katherine Hamilton 报道并获 Techmeme 转载。这是 AI 应用渗透率的一个重要数字,说明对话式大模型正从开发者工具走向大众基础设施。

欧盟正式启动“AI超级工厂”竞标,计划以约300亿欧元的总盘子建设最多7个大型算力设施;但相比之下,美国科技巨头今年仅数据中心支出就超过6000亿美元,两者相差约20倍,欧洲的这笔投资更像是一次“补课”,而非“领跑”。