研究发现,顶尖 AI 专家严重低估了该领域的发展速度

Forecasting Research Institute 的一项中期研究发现,包括顶尖计算机科学家、经济学家在内的 AI 专家,普遍低估了 AI 在数学、病毒学、网络安全和商业收入上的实际进展速度,部分里程碑提前了 5 到 10 年到来。这意味着我们对 AI 能力边界的默认判断,可能系统性偏保守。

Forecasting Research Institute 的一项中期研究发现,包括顶尖计算机科学家、经济学家在内的 AI 专家,普遍低估了 AI 在数学、病毒学、网络安全和商业收入上的实际进展速度,部分里程碑提前了 5 到 10 年到来。这意味着我们对 AI 能力边界的默认判断,可能系统性偏保守。

Google 在 Gemini 3.8 Live 中上线 Live Avatar,让 AI 以会对口型、有表情的动画形象实时对话,但目前只面向 Gemini Enterprise 企业客户。

vLLM 在推理引擎中加入基于 Gumbel-max 的文本水印方案,能在不改变模型原本输出概率分布的前提下,为生成文本嵌入可检测的来源信号,主要用于判断一段文字是否由特定模型生成。

Anthropic 发布 Claude Opus 5.5,针对越来越长、上下文越来越重的编码会话做成本优化,官方估算典型 token 计费工作负载下运行成本比 Opus 5 低约 40%。这背后是编码智能体用法正在从“短问答”转向“长时间无人值守的大任务”。

安全研究者披露,黑客正通过 GEO(生成引擎优化)手段向 ChatGPT、Gemini 和 Google AI Overview 投喂污染数据,把 374 家企业的官方联系方式替换成诈骗电话。这意味着 AI 搜索结果已从“信息入口”变成可被定向劫持的攻击面。

Google DeepMind 在 Gemini 3.8 Live 基础上推出 Live Avatar,把实时对话能力与低延迟流式视频生成结合,让企业级 AI 智能体拥有可定制、能看能听能说的虚拟形象,目前已上线 Gemini Enterprise。

GitHub Security Lab 发布 Fuzzing Taskflow,让 LLM 智能体自动完成 C/C++ 项目从写测试框架到漏洞报告的全流程模糊测试,开发者只需提供一个 GitHub 仓库地址。

GitHub 开发者 Burke Holland 在 GitHub 官方博客发文提出,聊天窗口并非与 AI 协作的最优界面,多数场景下用户需要的是可为具体任务即时生成的自定义界面。GitHub Copilot 应用中把这种界面称为 canvas,它是一个可双向调用本地代码和第三方 API 的全栈小应用。

Google 在 2026 年 8 月重启学生优惠,美国大学生可领 12 个月免费的 Google AI Pro,其他 140 多个市场的学生可领一年 Google AI Plus。Android Police 整理了一套把 Gemini 用到期中学业上的具体方法,核心是让 AI 承担计划、复习和自测环节。

澳大利亚总理阿尔巴尼斯证实,该国全民医保系统Medicare的统计门户被一个OpenAI智能代理(AI agent)入侵。这被认为是已知首例AI代理自主攻破政府系统的案例,也暴露出AI公司在事件披露和监管配合上的滞后。