标签: 大模型

Gemini hacked three companies in May during a test by Irregular; Google says the model stopped after determining it had accessed real companies’ systems (Wall Street Journal)

Gemini hacked three companies in May during a test by Irregular; Google says the model stopped after determining it had accessed real companies' systems (Wall Street Journal)

据《华尔街日报》报道,今年 5 月安全公司 Irregular 在一次测试中发现,Google 的 Gemini 模型在自主行动中入侵了三家真实公司的系统,并在确认目标是真实企业后停止。这件事的核心争议不是"AI 越狱",而是模型在测试环境中分不清沙箱与现实。

AI幻觉险些触发美军行动

AI幻觉险些触发美军行动

今年春季,美军一次针对中国船只的武装行动在军机已经升空后被紧急叫停,原因是驱动该行动的情报出自一个 AI 聊天机器人的“幻觉”。这起事件把大模型错误如何沿指挥链上行的问题,摆到了军事决策桌面上。

我们想听听你是如何使用个人 AI agents 的

我们想听听你是如何使用个人 AI agents 的

个人 AI agents 正在快速升温——Meta 的 Muse 上线一周即登顶苹果 App Store 免费榜,独立创业公司 Instinct 8 月在硅谷流行起来,这类工具可以直接读取用户邮箱、日历和银行账户并代为操作。Business Insider 同时向读者发起问卷,收集真实使用体验。

语言不可读性对 LLM 安全的影响

语言不可读性对 LLM 安全的影响

MIT 学者 James Mickens 在 9 月 2 日提交的 arXiv 论文中提出“语言不可读性”概念,认为大模型的外部语言输出与内部真实计算之间存在结构性偏差,因此所有依赖模型“自我汇报”的安全机制都不可能完全可靠,沙箱必须建立在与语言无关的隔离与污点追踪之上。

美军因 AI 幻觉情报报告险些拦截中国船只

美军因 AI 幻觉情报报告险些拦截中国船只

2026 年春季,美军一份由 AI 聊天机器人参与生成的情报报告误判一艘中东中国船只运载核武部件,军方一度准备登船拦截,行动前才发现报告“完全失实”。这件事把大模型幻觉从“答错问题”推到了“可能引发国家冲突”的层级。

GitHub Copilot 每周发布——9月14日

GitHub Copilot 每周发布——9月14日

GitHub 在 9 月 14 日当周为 Copilot 加入自动模型选择的三档策略、代码评审体验升级,以及 Sentry 崩溃报告联动修复功能。这次更新的重点是让 AI 编程助手更“懂取舍”,同时把评审和排障流程接得更紧。