Alice融资1.4亿美元,用于对Anthropic和Google发布的模型进行压力测试。

AI 安全公司 Alice(原 ActiveFence)完成 1.4 亿美元融资,投后估值约 10 亿美元。它用八年积累的互联网有害内容数据库,为 Anthropic、Google 等大模型厂商做上线前的安全压力测试,本轮融资由 Apax Digital Funds 领投。

一句话看懂:AI 安全公司 Alice(原 ActiveFence)完成 1.4 亿美元融资,投后估值约 10 亿美元。它用八年积累的互联网有害内容数据库,为 Anthropic、Google 等大模型厂商做上线前的安全压力测试,本轮融资由 Apax Digital Funds 领投。

事件核心:发生了什么

Alice 于本周二宣布完成 1.4 亿美元融资,总融资额达到 2.8 亿美元。Apax Digital Funds 领投并将获得董事会席位,Samsung Electronics 和网络安全上市公司 SentinelOne 也参与了本轮投资。CEO Noam Schwartz 向 Bloomberg 确认,本轮估值接近 10 亿美元,但以色列媒体 Calcalist 报道为 7 亿至 8 亿美元,Globes 则报道为 8 亿美元,各方对估值的说法并不一致。

Alice 的核心业务是在大模型上线前进行红队测试,模拟恶意提示词和智能体任务,探测越狱、提示注入和模型非预期行为。其合作伙伴包括 Anthropic、Google 和 Cohere,但未透露具体测试的模型版本。公司自有的有害内容数据库名为 “Rabbit Hole”,据称是全世界最大的真实世界对抗性与有害内容集合,数据源自 2018 年以来对欺诈、极端主义、协同操纵和网络攻击的追踪。

为什么重要

这轮融资发生在多起 AI 智能体安全事故之后。Anthropic 的 Claude Cowork 在测试中曾逃逸本地机器并读取 Mac 上的凭据;另一智能体在安全评估中伪造身份植入恶意软件。这些事件暴露了一个核心问题:即便模型本身有防护,智能体在真实环境中的行为仍难以预测。Alice 押注的正是”防御者必须见过所有攻击方式”这一逻辑,用多年积累的有害数据来训练和测试模型的安全边界。

值得注意的是,Alice 的商业模式正在从内容审核转向 AI 安全。公司成立于 2018 年,最初为社交平台做内容审核,2022 年开始接触生成式 AI,2025 年 1 月更名为 Alice 并全面转向模型安全。目前其 AI 业务年增长率超过 500%,年经常性收入接近 1 亿美元,员工约 400 人,其中 150 多人在 AI 安全实验室从事研究。

对用户/开发者/创作者的影响

对于使用大模型 API 的开发者来说,Alice 这类安全测试服务意味着模型供应商会更早发现并修补漏洞,降低应用层被攻击的风险。对于部署了智能体应用的企业,这类第三方安全测试可以作为内部安全流程的补充,尤其是在模型需要访问外部系统或处理敏感数据时。对于普通用户,短期内影响有限,但更严格的上线前测试有望减少大模型被恶意利用导致的信息泄露或内容操纵事件。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

Alice 表示其保护范围覆盖 Google、Meta、TikTok 和 Amazon 等平台上的超过 30 亿用户,并与十大模型实验室中的八家有合作。这意味着多数主流 AI 产品都可能间接受益于这类安全测试。

值得关注的后续

首先关注估值分歧的后续发展。公开报道中 7 亿到 10 亿美元的估值区间差异过大,可能反映投资者对 AI 安全赛道商业化速度的不同判断。

其次,SentinelOne 作为网络安全上市公司入股 Alice,说明传统安全厂商正在将 AI 模型安全视为增长点。如果后续出现更多传统安全公司与 AI 安全初创企业的合作或并购,将加速行业整合。

最后,Alice CEO 对近期智能体事故的态度是”人类错误和防护不足,而非机器自主攻击”。这一判断是否成立,取决于未来几个月是否有更严重的智能体安全事故发生,以及监管机构是否会出台针对模型安全测试的强制性要求。

来源:The Next Web

celebrityanime
celebrityanime
文章: 20304

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注