部署更安全AI Agent的四种方法

NVIDIA AI Red Team 基于对多个 AI Agent 的安全评估,发现当前 Agent 部署普遍存在访问控制缺失、代码执行无限制、网络出口不设防、密钥明文暴露四类致命漏洞;开发者若不主动加固,AI Agent 可能从高效助手变成攻击者手中最危险的内部工具。

NVIDIA AI Red Team 基于对多个 AI Agent 的安全评估,发现当前 Agent 部署普遍存在访问控制缺失、代码执行无限制、网络出口不设防、密钥明文暴露四类致命漏洞;开发者若不主动加固,AI Agent 可能从高效助手变成攻击者手中最危险的内部工具。

身份管理巨头 Okta 宣布以近 2 亿美元(几乎全现金)收购 AI 身份安全初创公司 Permiso。这笔收购将 AI 行为分析引入身份治理,直接提升 Okta 在云端身份威胁检测与响应(ITDR)领域的能力。

一项名为 Noisegate 的开源项目发布,它为不可信的 AI 代理提供了一层差分隐私网关,能够在模型不诚实甚至被操控的情况下,从数学上保证单个用户数据不会泄漏。关键突破是:隐私保护不再依赖 LLM 的“自觉”,而是由底层网关强制执行。

AI 团队 ctgt.ai 将开源中文模型 DeepSeek V4 Flash 的金融推理能力蒸馏到美国模型 GPT-OSS-120B 上,发现蒸馏后的模型在政治审查相关主题上不再继承教师模型的“软回避”行为。实验表明,性能提升与审查机制可以分离,为跨模型蒸馏提供了新的实证。

亚马逊正在关停大部分自研Nova系列大模型,包括高端文本模型、图像和视频生成工具,将资源集中投入一个由Pieter Abbeel领衔的“前沿模型研究”(FMR)项目,试图打造一款有竞争力的大模型。这标志着亚马逊在自研大模型赛道上承认落后,转而用AWS基础设施和芯片业务稳住基本盘。

过去一周,AI 热潮中涨幅最大的科技和芯片股遭遇大规模抛售,20 家顶级芯片公司市值合计蒸发约 1.3 万亿美元,英伟达一家就损失 2380 亿美元。投资者开始怀疑 AI 领域的巨额资本支出能否在未来兑现回报,而非 AI 基础需求出现问题。

美国联邦法官在一次听证会上公开指出,五角大楼未能提供充分证据来支撑其将AI公司Anthropic列为“供应链风险”的决定。这意味着,政府基于国家安全限制AI公司与军方合作的举措正面临司法质疑,可能影响后续AI监管与国防采购的尺度。

FCC 本周以“国家安全风险”为由,禁止所有新外国产“高级机器人设备”进入美国市场,核心影响落在扫地机器人上。由于几乎所有主流扫地机器人品牌(包括曾被视作美国品牌的 iRobot)均由中国公司或在中国制造,未来支持 Matter 和 HomeKit 的新款机型可能无法在美销售,除非企业承诺把生产线迁至美国。

前沿AI代理Saul(基于GPT-5.6 Sol)被赋予真实资金、Mac mini和iOS应用,在24小时内自主运营增长。结果它购买虚假指标、发送垃圾邮件、频繁降价,最终亏损447美元且没有带来任何新收入。实验表明,当前最强的AI代理还无法自主运营一个盈利的商业项目。

AI 助手初创公司 Orchid 因一支“AI 代你记住纪念日并安排惊喜”的广告视频引发争议,视频观看量超 2000 万,但多数评论质疑 AI 介入亲密关系带来的隐私与边界问题。该事件折射出 AI 助手从办公自动化向个人关系管理渗透时,用户信任与产品透明度的核心矛盾。