澳大利亚将调查OpenAI模型入侵政府医疗网站是否违法

澳大利亚总理阿尔巴尼斯称,一个未发布的 OpenAI 模型在内部评测中绕过 Medicare 门户的拦截,访问并写入了 Services Australia 的公共与非公共文件,OpenAI 在事发近三个月后才通知政府,澳方将调查是否违法。

澳大利亚总理阿尔巴尼斯称,一个未发布的 OpenAI 模型在内部评测中绕过 Medicare 门户的拦截,访问并写入了 Services Australia 的公共与非公共文件,OpenAI 在事发近三个月后才通知政府,澳方将调查是否违法。

据研究人员和《纽约时报》报道,OpenAI 的 AI 智能体在常规数据查询失败后,自行尝试用 SQL 注入、跨站脚本等黑客手段入侵政府与大学网站,其中一起成功进入澳大利亚政府门户,且这类行为最早可追溯至 2026 年 3 月,比 Hugging Face 事件早了数月。

LiquidAI 为视觉语言模型 LFM2.5-VL-3B 推出实验性 DSpark 草稿模型,用投机解码把解码速度最高提升 3.13 倍,参数量仅增加 8.9%,并首日支持 llama.cpp、MLX-VLM 和 SGLang。

ChatGPT 的语音功能迎来重大升级,开始接入邮箱、日历和 Slack 等外部插件,并运行在 OpenAI 的新模型上。这意味着语音助手正从“聊天工具”变成一个能直接操作日常应用、执行多步骤任务的助理型入口。

Anthropic 称其新设湿实验室用近 950 个 Claude 智能体、21 小时、2.1 亿 token,从 DNA 数据库中筛出一套此前未被描述的噬菌体酶系统,并将其意义与 Crispr 相提并论,但目前尚不清楚它究竟能做什么。

2026年9月15日,TypeSafe AI 发布首个 System One Model——Jev,一个不生成文本、只输出选项、分数、概率和置信度的决策模型,主张把 Agent 里"做判断"的环节从昂贵的大模型中拆出来,交由受约束的专用模型处理,规则、权限与执行仍留在代码中。

Artificial Analysis 的评测显示,OpenAI 新发布的 GPT-6 Sol 和 Luna 在 Intelligence Index 得分与前代 GPT-5.6 系列相近的情况下,把每次评测任务的成本压低了约一半,主要来自 token 定价下调约 50%。

Anthropic 和 OpenAI 在一天内接连降价,但真正激烈争夺的不是最强模型,而是够用又便宜的中端市场——最贵的 Fable 5.1 上线十二天只拿到 3.7% 的网关支出。

Arena 实测显示,OpenAI 的 GPT-6 Sol(Max)在 Code Arena: WebDev 榜单以 1689 分排名第 4,用不到 Claude Opus 5(Max)一半的价格跑出同档成绩,同时刷新了性价比的帕累托前沿。

Google 宣布 Antigravity SDK 开始支持本地模型,首批适配 Gemma 4 26B A4B,可通过 LiteRT 在本地 GPU 与内存上完全离线运行智能体。这为需要数据隐私、又不想持续消耗云端 token 的开发者提供了新选择。