标签: Gemini

A look at two opposing perspectives on AI agent sandboxing: infosec says labs need better containment, AI alignment says sandboxes can’t fully contain agents (Matthew Green/A Few Thoughts …)

A look at two opposing perspectives on AI agent sandboxing: infosec says labs need better containment, AI alignment says sandboxes can't fully contain agents (Matthew Green/A Few Thoughts ...)

围绕 AI agent 的沙箱隔离,安全圈与对齐研究圈给出了针锋相对的两套判断:前者认为实验室的隔离做得不够,后者则质疑沙箱本身无法真正兜住 agent 的行为。这场争论直接关系到 agent 能否被放心接入真实系统。

上下文语言模型

上下文语言模型

Meta、华盛顿大学等机构的研究者提出 Context Language Models(CLMs),让语言模型把上下文当作一个可自主读写的"文件"来管理,而不是依赖外部的检索或压缩框架。在多个长任务基准上,它以更少算力取得更高准确率,指向一条"上下文管理内化为模型能力"的新路线。

无论人工智能安全是什么,它都不是这个

无论人工智能安全是什么,它都不是这个

美国多家 AI 公司 CEO 在白宫签署了一份 AI 安全协议,但协议主要依靠企业“自我监管”,联邦政府并未像 1966 年立法强制汽车安装安全带那样设定硬性标准。这值得关注,因为它决定了未来大模型能力边界由谁划定、出事后谁来负责。