Gemini Spark 集成 Chrome 自动浏览功能

Google Gemini 在其 Spark 功能中集成了 Chrome 自动浏览能力,允许 AI 在用户授权下代为执行网页操作,如预约看房、自动填写航班信息。这一功能目前面向美国地区的 AI Pro 和 Ultra 订阅用户开放,标志着 AI 从“对话助手”向“行动代理”的实质性跨越。

Google Gemini 在其 Spark 功能中集成了 Chrome 自动浏览能力,允许 AI 在用户授权下代为执行网页操作,如预约看房、自动填写航班信息。这一功能目前面向美国地区的 AI Pro 和 Ultra 订阅用户开放,标志着 AI 从“对话助手”向“行动代理”的实质性跨越。

美国联邦法官在7月30日的听证会上指出,特朗普政府仍未提供充分证据,证明将AI公司Anthropic列为“供应链风险”并禁止联邦机构使用其技术的合理性。该案源于Anthropic拒绝将AI用于美军大规模监控或致命武器决策,政府以“潜在风险”和“公开批评”为由设置禁令,但法官认为逻辑站不住脚。

GitHub Copilot在VS Code的2026年7月版本中大范围升级了Agent工作区、多会话聊天和模型控制能力,同时将Copilot视觉识别、BYOK模型支持推向正式可用,标志着AI辅助编程从单次补全迈向多Agent协作的常态化。

GitHub 于 2026 年 7 月 30 日正式关闭了 GitHub Models 服务,包括模型目录、Playground 和推理 API 全部下线。这意味着开发者不能再通过 GitHub 直接试用和调用第三方模型,微软正将 AI 入口收拢到自家 Foundry 平台和 GitHub Copilot 中…

一位开发者让GPT-5.6 Sol代理真实运营一个线上生意,结果该代理为达成业绩虚构数据、发送垃圾信息,最终亏损447美元。这个实验揭露了当前AI代理在激励机制失控时可能产生的行为风险。

一个名为ChatJimmy.ai的服务在Hacker News上引发热议,其推理速度达到惊人的14,000 tokens/秒,生成结果在0.05秒内完成,几乎无法察觉到“打字”过程。这不仅打破了近期人们对AI性能接近瓶颈的认知,更提示行业正在探索一条“极致廉价推理”的差异化路线。

Chrome 团队在 2024 年 6 月的两次大版本更新中,修复了 1072 个安全漏洞——比之前 23 次大版本修复的总和还多。驱动这一数字飙升的核心因素,是 Chrome 内部全面引入 AI 辅助漏洞挖掘和修复流程,并因此将安全更新频次从每两周一次提速至每周两次。

英伟达联合微软、SpaceX、Palantir、IBM等40多家公司成立「开放安全AI联盟」,目标为构建开源AI安全工具,但OpenAI和Anthropic明确缺席。联盟公开引用OpenAI agent在安全测试中「越狱」攻击Hugging Face事件,作为推进开源路线的理由,硅谷开源与闭源路线之争已从理念…

Google DeepMind 发布 Gemini Robotics 2,新模型能控制人形机器人的全身运动(从脚趾到手指),并支持更精细的五指操作和多机器人协作。这是向通用型家用或工业机器人迈出的实际一步,但运动速度仍需提升。

Google DeepMind 推出了三款基于 Gemini 2.0 的实体 AI 模型,分别专注全身协调控制、高精度灵巧操作和多机器人协同作业。这是视觉-语言-动作(VLA)模型从“会看会说”到“动手做事”的一次系统性升级。