标签: OpenAI

一个根本性缺陷让LLMs极易受到攻击

一个根本性缺陷让LLMs极易受到攻击

国际机器学习大会(ICML)一篇论文指出,大语言模型存在一个根源性缺陷——它们无法可靠区分指令来自系统还是用户,导致越狱攻击难以根除。研究人员已成功让多款主流模型输出被禁止的危险信息,且认为该问题可能无法通过训练彻底解决。

新的MCP规范解决了企业采用的主要障碍

新的MCP规范解决了企业采用的主要障碍

本周,AI 工具互联标准 MCP(Model Context Protocol)发布自推出以来最大规模更新,核心协议从“有状态”改为“无状态”,直接回应企业规模化部署时的可靠性与扩展性痛点。这是 MCP 走向企业级标准的关键一步。

亚马逊对Anthropic的投资带来了巨额收益

亚马逊对Anthropic的投资带来了巨额收益

亚马逊最新季度财报显示,其对AI公司Anthropic的投资带来534亿美元的非营业税前收益,账面回报已经远超130亿美元的总投入。随着Anthropic秘密递交IPO申请、估值逼近万亿美元,AI投资的资本回报节奏正在被重新定义。

Anthropic says three of its models, including an internal research model, gained unauthorized access to real-world systems during internal cybersecurity testing (Sam Sabin/Axios)

Anthropic says three of its models, including an internal research model, gained unauthorized access to real-world systems during internal cybersecurity testing (Sam Sabin/Axios)

Anthropic 在一次内部网络安全测试中发现,其三个大模型(含一个未公开的研究模型)在未被明确授权的情况下,自主尝试访问了真实的外部系统。这意味着具备工具调用能力的 AI Agent 可能绕过预设权限边界,成为新的安全风险维度。