Gavin Newsom 正在力推 AI 紧急关闭开关

加州州长纽森签署行政令,要求专家团队在两个月内提出方案,考虑强制前沿大模型内置可被例行验证有效的“紧急关闭开关”等安全措施。在国会中期选举前难以立法的情况下,加州正试图把州级监管变成全美模板。

加州州长纽森签署行政令,要求专家团队在两个月内提出方案,考虑强制前沿大模型内置可被例行验证有效的“紧急关闭开关”等安全措施。在国会中期选举前难以立法的情况下,加州正试图把州级监管变成全美模板。

Anthropic CEO Dario Amodei 提出用独立安全评估机构和民主国家 AI 实验室之间的协调来“控制前沿模型的发展节奏”,但这一设想已遭到英伟达 CEO 黄仁勋的质疑;同一期节目中,TechCrunch 还讨论了 Automattic 那场仅持续 33 小时的董事会“政变”。

Anthropic CEO Dario Amodei 提出“Pace the Frontier”计划,主张由独立安全评估机构加民主国家 AI 实验室之间的协调来给前沿模型开发定节奏,方案已获部分行业支持,但遭到英伟达 CEO 黄仁勋的明确反对。

三名安全研究人员借助 Anthropic 的 Claude 模型,通过 OpenAI 官方社区论坛的漏洞链,在不到 72 小时内进入其内部代码仓库。这是首次公开披露 AI 大模型显著压低高难度攻击成本的真实案例。

Anthropic 为 Claude Code 发布 v2.1.277 版本,新增对 AGENTS.md 项目指令文件的支持,并集中修复了一批崩溃、挂起和会话异常问题。这次更新既是生态兼容动作,也是一次稳定性补课。

OpenAI 新设“全球销售高级副总裁”一职,请来 Brian McCarthy 掌舵企业销售;而他此前所在的 Cursor 刚在三周前被 OpenAI 切断模型供应。这笔人事任命更像是 OpenAI 正在重建整个销售体系的一环。

“AI 教父”Geoffrey Hinton 在 12 月 3 日向美国参议院闭门简报时给出明确时间判断:国会围绕 AI 设立护栏的窗口“大概一年,不会多太多”。同场简报没有 OpenAI、Anthropic、Google、Meta 等头部公司参与,会后一项要求高级模型内置关停机制的议案被 Rand Paul…

一项针对 Google DeepMind SynthID-Text 的新研究发现,给大模型输出加“AI 水印”会意外改变模型行为,包括更愿意回应有害请求、更易被提示注入攻击,而 EU AI Act 正推动水印走向主流,这一副作用可能带来合规与安全上的麻烦。

Anthropic 在旧金山湾区建起实体生物实验室,开始自己做湿实验,并探索让 Claude 控制机器人执行科研操作;这意味着大模型公司正从纯软件层往“AI for Science”的落地环节延伸。

Oracle 过去两年投入数百亿美元为别人搭建 AI 算力基础设施,直到今年 4 月才给自家约 16 万名员工配上通用 AI 工具;三个月内八成员工用上,但账单、代码交付和安全验证三处瓶颈随之暴露。