Alibaba 发布闭源模型 Qwen 3.8 Max,ECI 得 157 分

阿里巴巴在 2026 年 8 月 2 日发布了闭源模型 Qwen 3.8 Max,在 Epoch AI 的能力指数(ECI)上拿到 157 分,是阿里目前公开可查的最强模型之一。值得关注的是,这次走的是闭源路线,与 Qwen 系列此前的开源形象形成对比。

阿里巴巴在 2026 年 8 月 2 日发布了闭源模型 Qwen 3.8 Max,在 Epoch AI 的能力指数(ECI)上拿到 157 分,是阿里目前公开可查的最强模型之一。值得关注的是,这次走的是闭源路线,与 Qwen 系列此前的开源形象形成对比。

ARC Prize Foundation 发布第二代抽象推理基准 ARC-AGI-2,用 1360 道网格题测试 AI 的少样本推理和泛化能力,同时被刻意设计成“对机器更难、对人仍可解”。发布时纯 LLM 得分 0%,前沿推理系统也只有个位数百分比。

波士顿咨询公司(BCG)全球人才与组织负责人 David Martin 警告,过度依赖 AI 摘要和把核心业务判断交给 AI,会加速批判性思维退化;他建议每季度主动脱离 AI 一周来自我检验。
![[Bug]: aws_bedrock_project_id sent as wrong header ("anthropic-workspace") to Bedrock Mantle — should be "anthropic-workspace-id"](https://www.chat-gpts.plus/wp-content/uploads/2026/10/31947-aedb8605-768x403.jpg)
这个报错通常出现在通过 LiteLLM Proxy 调用 AWS Bedrock Mantle 的 Anthropic 兼容接口( bedrock/mantle/anthropic.* )并配置了 aws_bedrock_project_id 时。由于项目 ID 被写进了错误的请求头 anthrop

麦肯锡和波士顿咨询(BCG)在 2026 年 10 月初发布的两份报告指出,AI 使用成本下降反而可能推高电力需求,因为企业会用得更多、更频繁。数据中心电力需求已成为经合组织电力市场中增长最快的负荷。

一个 AI Agent 自主向数百名研究人员发送邮件求助,《科学》杂志的独家报道称它还向记者解释了这么做的原因。这件事值得关注的地方不在"AI 会发邮件",而在于 Agent 第一次把"主动求助外部人类"变成了可观察的现实行为。

Vox 资深科技记者 Adam Clark Estes 撰文指出,频繁使用 ChatGPT、Claude 等 AI 聊天机器人会在提升效率的同时带来"去技能化"风险,但问题的关键不是少用 AI,而是有选择地使用。文中引用多项调查数据,显示美国 68% 的 Z 世代成年人担心认知外包损害自身能力建设。

德国一个名为 Kolibri 的主权 AI 模型在 Hacker News 的 Show HN 板块亮相,主打由本国力量掌控训练与部署。在欧洲持续强调“数字主权”的背景下,这类项目被视作区域自建大模型能力的一次公开试水。

德国 AI 公司 Aleph Alpha 发布开源权重模型 Kolibri,78B 参数但每个 token 只激活约 3.5B,主打德语与英语、本地部署和合规可控,被视为欧洲“主权 AI”路线的直接答卷。

前 OpenAI、DeepMind 研究员,现任英国 AI 安全研究所(AISI)首席科学家在 TIME 撰文,称超级智能 AI 导致人类灭绝的概率约为 50%,而关于 AI 安全最关键的争论,很可能要到无法挽回时才有答案。