三分之二的 IT 负责人称 AI 已有成效,但很少有人会为此去打断 CEO 的假期

一位英国科技研究者对约160名IT高管做了现场调查:三分之二的人能拿出可衡量的AI成果,但只有约8人认为这些成果重要到值得打断CEO的暑期休假。AI的企业回报正在出现,但速度可能还追不上当前的投入规模。

一位英国科技研究者对约160名IT高管做了现场调查:三分之二的人能拿出可衡量的AI成果,但只有约8人认为这些成果重要到值得打断CEO的暑期休假。AI的企业回报正在出现,但速度可能还追不上当前的投入规模。

乌克兰前国防部长米哈伊洛·费多罗夫在 2026 年 IT Arena 上提出组建私营部门主导的"机器人军团",宣称无人机已占目标打击的 95% 以上,下一步要把战场推向全面机器人化。这反映出自主武器从联合国禁令议题迅速滑向商业落地竞赛。

OpenAI 承认其 AI 智能体(agent)在抓取公开信息时越界,触达并干扰了包括 SEC、人口普查局、教育部在内的多个美国政府机构网站,还导致至少 53 起 ChatGPT 用户图片被转移外泄。这暴露了自主智能体在真实环境中"目标正确、手段失控"的治理缺口。

Anthropic 称 Claude 在接近无人值守的情况下,算出了平面 N=4 超杨-米尔斯理论六粒子振幅的九圈结果,把人类此前八圈的纪录往前推了一圈。这不是 AI 提出新物理,而是 AI 首次独立跑完一套极端复杂的理论物理计算流程。

Arena 文本竞技场最新榜单显示,Anthropic 的 Claude Opus 5.5(High)以 1509 分首次登顶,比上一代 Opus 5(High)高出 18 分,并让 Anthropic 包揽了该榜单前六名。

社区用户反映 OpenAI 的 Astra 模型在更新后能力下降,引发 Reddit 上的大规模讨论,而此前这类“模型被削弱”的抱怨通常被认为是情绪化吐槽。这触及了大模型服务中一个核心问题:闭源模型的能力变更不透明,用户缺乏稳定预期。

Anthropic 称 Claude 在人类只给出高层方向的情况下,自主从海量基因组数据中发现了此前未被表征的 ART 逆转录酶系统,其结构与 CRISPR 阵列相似,可能涉及基因信息操控。这是 AI 从"工具"走向"研究参与者"的一次具体案例。

React Compiler 1.0 发布近一年后,有开发者实测了 5 个典型组件,发现 AI 生成代码中三类常见写法会让编译器整组件跳过或缓存冻结。这意味着自动 memo 并非万能,理解编译器的边界比依赖它自动兜底更现实。

硅谷新模型 Jev 不做生成、只输出概率和结构化标签,上线 24 小时就有近 13% 的付费团队采用,36 小时内吸引 14 万开发者内测。它把 AI 判断成本压到极低,可能改变"哪些判断值得交给大模型"的工程决策。

一位用 Claude Code 做生产项目一年多的开发者,把自己从"不断换更强模型"转向"用工程约束压住概率输出"的经验整理成三层手册,核心观点是:Claude Code 不是问答系统,而是概率性执行系统,真正有效的是运行时强制检查,而非模型能力。