小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型

小米 MiMo 团队发布 MiMo-V2.6 的 Pro 与 Flash 两个全模态开源模型,其中 Pro 在 Artificial Analysis 智能指数上得分 46,据称是当前开源模型中的最高分,并放出模型权重、技术报告、强化学习环境和训练代码。

小米 MiMo 团队发布 MiMo-V2.6 的 Pro 与 Flash 两个全模态开源模型,其中 Pro 在 Artificial Analysis 智能指数上得分 46,据称是当前开源模型中的最高分,并放出模型权重、技术报告、强化学习环境和训练代码。

小米 MiMo-V2.6-Pro 首次进入 Code Arena 的 WebDev 总榜前十(约第 10 名),在开源权重模型中排到约第 3,AutoEval 得分 1628 分,较上一代 MiMo-V2.5-Pro 提升 153 分。这意味着小米的大模型在代码与网页开发这类硬指标上,已经挤进全球第一梯队的边…

有创作者在使用 GPT-6 Astra 后一度想换回旧模型,后来发现 OpenAI 官方文档里其实已经写明了该模型“爱堆格式、爱重复短语”等毛病,并给出了对应的自定义指令对策。问题不在模型能力,而在默认出厂的“说话方式”需要手动调。

Artificial Analysis 评测显示,Grok 4.7 在智能体知识工作基准上大幅跃升,综合智能指数升至 46 分,编码代理指数升至 56 分,帮助 xAI 进入顶级实验室前四;但这一进步伴随明显的 token 消耗上升。

影视广告 AI 创业公司 Higgsfield AI 借助 OpenAI 的 GPT-6 Astra,把一项全新视频功能从开发到上线压缩到一天之内,且只由一名工程师完成,同时让中小商家用一句提示词就能批量生成视频广告变体。

开源项目 Heretic 推出一款工具,可解除语言模型的内置限制,让其严格按用户指令输出,项目通过 pip 一键安装,首个示例模型用的是 Qwen/Qwen3.5-4B。它把“模型对齐该由谁决定”这个问题,从厂商手里部分交回给了使用者。

2026 年 9 月 21 日,OpenAI 发布 V7 案例:这家欧洲金融科技初创公司用 GPT-5.6、GPT-6 Astra 等模型,把企业散落的文件整理成 Agent 可直接查询的「机构记忆」,让 AI 在金融、保险等场景中跑通上百步工作流。

据开发者爆料,Anthropic 的 Claude Opus 5.5 已进入内测,型号跳过 5.2 直接命名 5.5,定价传闻为输入每百万 Token 4 美元、输出 20 美元,较 Opus 5 下降约 20%,目标直指 GPT-6。

Anthropic 疑似跳过了 Opus 5.2,直接内测 Claude Opus 5.5(代号 claude-wafer-eap),并流出一份把百万 token 输入价压到 4 美元、缓存读取压到 0.2 美元的定价表,明显冲着 GPT-6 而来。

开发者对 DeepSeek-V4.1-Flash 的实测出现明显波动,同一模型在 Codex 与 DeepSeek Harness 两条调用链上的表现差异巨大,问题可能不完全出在模型本身,而在于承载它的工具链。