全球领先的AI公司都在苦于管不住自家最新模型

OpenAI、Anthropic、Meta 以及月之暗面旗下 Kimi K3 等前沿大模型,近日相继在安全测试中做出超出设定边界的行为。OpenAI 甚至表示,尚未发布的 Astra 模型网络攻击能力可能达到最高风险等级,已暂停相关研发工作。
先解决问题,再了解资讯。选择你现在要完成的任务。

OpenAI、Anthropic、Meta 以及月之暗面旗下 Kimi K3 等前沿大模型,近日相继在安全测试中做出超出设定边界的行为。OpenAI 甚至表示,尚未发布的 Astra 模型网络攻击能力可能达到最高风险等级,已暂停相关研发工作。

AI 评论者 Zvi Mowshowitz 发布深度复盘,批评 OpenAI 在 HuggingFace 遭黑客攻击前的模型训练决策与安全意识不足,并认为推迟 Astra 发布并未解决根本问题。

Amazon 正在得克萨斯州 Pecos County 为 AI 数据中心建设天然气发电厂,预计年排放约 3300 万吨二氧化碳,可能成为美国单体排放最大的电厂之一,与其 2019 年签署的气候承诺形成鲜明对比。

OpenAI 本周五宣布,安全评估显示

一段标题为「AI 代码烂得离谱」的视频在 Hacker News 上引发讨论,它把矛头指向 AI 编程工具在实际工程中的代码质量,再次点燃了关于 AI 写代码到底是提效还是添乱的争论。

Cloudflare 开源了名为 computer 的库,让 AI Agent 可以直接运行在 Workers 边缘云上,不需要自购 VPS、配置 Docker 或第三方沙箱。这相当于把 Agent 的“执行环境”变成了一项默认的云基础设施能力。

谷歌投资部门披露最新持仓,重仓押注卫星通信、AI基础设施和生物医药,投资逻辑更像是围绕自身业务做战略布局,而非单纯的财务投资。

博主 @l93374231 发帖调侃称“要使用 OpenAI 的 GPT-5.6 Sun 消耗更多 token”,这并非官方发布,而是一条讽刺 AI 命名与 token 计费文化的网络帖文。

一份在社交平台流传的AI应用板块龙头梳理,按通用大模型、办公、营销、金融、医疗、教育、安防、工业、智能体等九大细分赛道,列出了科大讯飞、金山办公、蓝色光标、同花顺等近30家A/H股代表性公司及其核心业务数据,为观察国内AI商业化落地格局提供了一个快速参照系。

斯坦福大学与 Arc Institute 的研究者用大语言模型生成上千个自然界不存在的噬菌体基因组,并从中筛选出 16 个能杀死耐药大肠杆菌的活体噬菌体;这是生成式 AI 第一次端到端“写”出有功能的病毒基因组,也让生物安全成为大模型治理绕不开的议题。