Google 发布带防护措施的新 Gemini 模型,AI 安全之争仍在继续

Google 发布新一代 Gemini 模型,并同步加入多层安全防护机制。在模型能力继续升级的同时,Google 试图用更明确的护栏回应外界对 AI 安全与滥用风险的担忧。

Google 发布新一代 Gemini 模型,并同步加入多层安全防护机制。在模型能力继续升级的同时,Google 试图用更明确的护栏回应外界对 AI 安全与滥用风险的担忧。

据 Bloomberg 报道,部分谷歌员工反映 Gemini 4 在基准测试中成绩出色,但在一些真实编程任务上表现不佳,谷歌方面否认了这一说法。这再次把"跑分好看"与"实际可用"之间的落差摆上台面。

Anthropic 本月公开的“滥用”报告披露了五起外国科学家试图绕过 Claude 安全护栏、查询“功能获得”(gain of function)研究信息的案例,账号已被封禁。这件事的重要性不在 AI 本身,而在于它把生物武器研发的低门槛风险重新摆上台面——正如 Wired 文章标题所说,即便没有 AI,担…

OpenAI 在 DevDay 上发布常驻式 AI Agent 产品 Dots,由 GPT-6 Astra 模型驱动、月费起步 100 美元;Meta 的免费 Agent Muse 正面对打,个人 AI Agent 的入口之争正式开打。

Google、Anthropic、Meta、OpenAI、xAI、Nvidia 六家公司签署了白宫主导的《超级智能协议》,承诺加强模型内部管控、外部评估与董事会监督,但这只是一份自愿性文件,缺乏强制约束。与此同时,FTC 正计划对多家 AI 公司展开消费者保护调查,监管压力并未因协议而消解。

特朗普召集六家美国头部 AI 公司签署一份“道义约束”的自我监管承诺,用企业自律取代联邦立法,各方 CEO 公开站台支持。这关系到未来 AI 安全规则由谁制定,以及开发者要面对的是硬性合规还是模糊的行业自律。

TechCrunch 援引 a16z 与 PNC 数据指出,消费级 AI 付费渗透率仍停留在约 2.2%、月均 31 美元的水平,增长近乎线性。Muse、Dots、Instinct 等新产品虽然热闹,却难以改变消费级 AI“用户多、收入薄、推理成本高”的结构性难题,行业重心继续向企业市场倾斜。

Reddit 宣布将进一步收紧“Old Reddit”经典界面的访问权限,未来几个月内只有近期使用过的登录账号才能继续访问,同时将从 11 月 13 日起停止支持 RSS 输出。官方称此举是为了应对大规模 AI 抓取和自动化滥用,但这意味着开放网络时代的一项基础设施正在被进一步压缩。

OpenAI 和 Meta 正准备把各自的 AI 智能体从软件推向实体硬件,路径都是先让用户习惯一个“可爱又有用”的软件形象,再把它装进设备里。此前 Humane AI Pin、Friend 等专用 AI 硬件大多失败,这次赌的是“实用性 + 情感黏性”。

Google 将在 Gemini 中全面用 Skills 取代 Gems,并加入由 Anthropic 发起、OpenAI 也在转向的“可复用提示格式”路线。对普通用户来说,AI 助手正从“聊天工具”变成可配置、可调用、可自动触发的任务执行入口。