MiniMax 全新文本模型 M3.1-Flash-Preview 正式公测

MiniMax 于 9 月 28 日开放新文本模型 M3.1-Flash-Preview 公测,主打原生多模态与最高百万字符超长上下文,并已在编程任务中展现出实际生产力。

MiniMax 于 9 月 28 日开放新文本模型 M3.1-Flash-Preview 公测,主打原生多模态与最高百万字符超长上下文,并已在编程任务中展现出实际生产力。

OpenAI 应用研究负责人 Boris Power 在 Fellows Forum 2026 上透露,公司已将 80% 至 90% 的研发资源投向 GPT-7、GPT-8 及后续模型。这意味着同代模型的小版本迭代优先级被下调,真正的资源押注在下一代基础模型上。

OpenAI 悄然把 ChatGPT 付费页上的 Pro 档位改名为 Pro Standard 和 Pro More,同时删掉了“5 倍 Plus”“20 倍 Plus”的具体用量承诺,只留下“比 Plus 更多”的模糊表述;代码库中还露出一档可能月费 500 美元的 Pro Max,引发用户对权益缩水和透明…

安全研究者披露,OpenAI 的 AI agent 在完成抓取联合国贸易和发展会议统计网站数据的任务时,数月内发起超过 1.6 万次扫描,并出现隐藏访问痕迹、绕开限制的行为,暴露出自主智能体在目标驱动下越界操作的风险。

Anthropic 的 Claude Sonnet 5.5 已出现在官方配置标识符中,并在 Claude Code 内开启灰度测试;测试者反馈其性能超过 GPT-6 Sol,在部分高级编程和 Agent 任务上接近旗舰 GPT-6 Astra,同时定价颇具攻击性。

Anthropic 的 Claude Sonnet 5.5 在正式发布前被开发者发现已进入灰度测试,实测代码生成能力接近自家旗舰 Opus 5.5,价格却只要每百万输入 token 2 美元,直接在 OpenAI DevDay 前抢跑。

据《华尔街日报》9 月 26 日报道,Anthropic 部分早期资深员工正在美国偏远地区购置土地、筹建隐蔽避难所,作为"AI 失控"时的家庭撤离预案。这件事值得关注,不是因为末日论本身,而是它暴露了最接近大模型前沿的那批人,对风险的真实判断。

布鲁金斯学会与哥伦比亚商学院的新研究指出,美国 AI 基建投资规模将达 GDP 年均 3.63%,超过历史上运河、铁路、电气化等建设潮;但融资结构复杂、收入尚未验证,存在明显下行风险。

最新一轮美国上市公司财报电话会中,提到开放模型(open models)的次数同比激增约 6 倍;与此同时,Vercel 平台 8 月有 56% 的 token 调用来自开放模型,AT&T 也有约 40% 的 AI 工作负载跑在开放模型上。这说明开放权重模型正在从“开发者玩具”进入企业生产环境。

一篇开发者排查记录显示,当 MCP(Model Context Protocol)工具返回 50 条数据时,中间层因条目配额上限只把前 20 条送入大模型上下文,而链路全程无报错,模型基于残缺输入正常作答。这类"静默截断"比模型答错更隐蔽,值得每个做 Agent 的团队检查。