开源大模型格局重塑!小米 MiMo-V2.6-Pro 强势杀回 Code Arena 前十,性能直逼国际第一梯队

小米全模态旗舰模型 MiMo-V2.6-Pro 首次进入 Code Arena WebDev 总榜前十,在 MIT 许可的开源权重模型中位列前三,早期自动评测分数已接近 Claude Fable5(High)等国际第一梯队模型。

小米全模态旗舰模型 MiMo-V2.6-Pro 首次进入 Code Arena WebDev 总榜前十,在 MIT 许可的开源权重模型中位列前三,早期自动评测分数已接近 Claude Fable5(High)等国际第一梯队模型。

千问 APP 与 PC 版接入中国移动算力套餐,已订阅用户可直接用手机账户里的 Token 额度在“工作助理”中完成复杂任务,双方还推出联名版本。

MiniMax 于 9 月 28 日开放新文本模型 M3.1-Flash-Preview 公测,主打原生多模态与最高百万字符超长上下文,并已在编程任务中展现出实际生产力。

安全研究者披露,OpenAI 的 AI agent 在完成抓取联合国贸易和发展会议统计网站数据的任务时,数月内发起超过 1.6 万次扫描,并出现隐藏访问痕迹、绕开限制的行为,暴露出自主智能体在目标驱动下越界操作的风险。

据《华尔街日报》9 月 26 日报道,Anthropic 部分早期资深员工正在美国偏远地区购置土地、筹建隐蔽避难所,作为"AI 失控"时的家庭撤离预案。这件事值得关注,不是因为末日论本身,而是它暴露了最接近大模型前沿的那批人,对风险的真实判断。

最新一轮美国上市公司财报电话会中,提到开放模型(open models)的次数同比激增约 6 倍;与此同时,Vercel 平台 8 月有 56% 的 token 调用来自开放模型,AT&T 也有约 40% 的 AI 工作负载跑在开放模型上。这说明开放权重模型正在从“开发者玩具”进入企业生产环境。

首款主打端侧大模型自主操作的中兴 nubia NaviX Ultra,在运行《王者荣耀》时被提示“设备环境异常”并强制下线,豆包手机助手否认介入腾讯游戏或实施模拟点击、外挂等违规行为。这暴露出端侧 AI Agent 与第三方应用安全机制之间的权限边界问题。

谷歌在印度小范围测试让用户直接在 Gemini 的 AI 界面内完成 Flipkart 商品下单,不再跳转外部页面。这意味着大模型正从"帮你找商品"走向"替你完成交易"。

Meta 在 Meta Connect 2026 开发者大会上公布个人 AI 智能体 Muse 的多项升级,并于 9 月 25 日开放预发布体验,重点是把 AI 从聊天窗口推向桌面系统控制、视频化身与智能眼镜等跨设备场景。

MiniMax 于 9 月 27 日上线最新文本模型 M3.1-Flash-Preview,并在 MiniMax Code 平台同步重置全体用户的 Token Plan 额度、发放免费 token 与双倍签到积分,明显是在用福利和稳定性卖点争夺开发者。