标签: Anthropic

一个根本性缺陷让LLMs极易受到攻击

一个根本性缺陷让LLMs极易受到攻击

国际机器学习大会(ICML)一篇论文指出,大语言模型存在一个根源性缺陷——它们无法可靠区分指令来自系统还是用户,导致越狱攻击难以根除。研究人员已成功让多款主流模型输出被禁止的危险信息,且认为该问题可能无法通过训练彻底解决。

新的MCP规范解决了企业采用的主要障碍

新的MCP规范解决了企业采用的主要障碍

本周,AI 工具互联标准 MCP(Model Context Protocol)发布自推出以来最大规模更新,核心协议从“有状态”改为“无状态”,直接回应企业规模化部署时的可靠性与扩展性痛点。这是 MCP 走向企业级标准的关键一步。