瞄准 AI 编程、金融等场景,单次成本仅为Opus 5 的1/8!这款国产旗舰模型跻身 AA 榜单全球前三

阶跃星辰发布新一代旗舰基座模型 Step 5 Preview,在 AA 综合智能指数上进入全球开源前三,而单任务成本只有 Claude Opus 5 的 1/8,主攻 AI 编程、金融等 Agentic 场景。

一句话看懂:阶跃星辰发布新一代旗舰基座模型 Step 5 Preview,在 AA 综合智能指数上进入全球开源前三,而单任务成本只有 Claude Opus 5 的 1/8,主攻 AI 编程、金融等 Agentic 场景。

事件核心:发生了什么

9 月 20 日,阶跃星辰推出新一代旗舰基座模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作与金融等场景,重点提升真实世界智能体任务中的综合表现。该模型采用稀疏 MoE 架构,总参数量 600B、激活参数 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。

在 Artificial Analysis Intelligence Index(AA 综合智能指数)中,Step 5 Preview 跻身全球开源前三。官方披露,其单任务成本约为 Claude Opus 5 的 1/8,并计划于 10 月 15 日正式开源。在此之前,阶跃已通过 Step 3.5 Flash、Step 3.7 Flash 连续两代模型探索同一方向。

为什么重要

当前大模型竞争正从“堆参数换智能”转向“提升算力转化为智能的效率”。Step 5 Preview 的卖点不是单项能力登顶,而是在能力、成本、效率与场景覆盖之间找平衡点——用官方的话说,是把 Intelligence Index 与单任务成本之间的帕累托前沿进一步外推。

如果这一成本优势在实际调用中成立,它对闭源旗舰模型构成直接压力:Agentic 任务往往需要多轮推理和工具调用,单次成本差异会被放大数倍。开源前三的排名也意味着,开源阵营在高知识密度场景中又添一枚可用的主力工作模型。

对用户/开发者/创作者的影响

对开发者而言,100 万 Token 上下文加原生视觉输入,适合处理长代码库、长文档和图文混合任务;27B 激活参数配合稀疏 MoE,也意味着推理成本和部署门槛相对可控。目前公开信息显示,该模型计划开源,若权重和 API 定价同步落地,团队可在本地或私有环境验证金融、软件工程等数据敏感场景。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对企业和内容创作者,判断重点应放在“单位成本能买到多少可用智能”,而非榜单名次。建议等 10 月 15 日开源后再评估实际推理吞吐、工具调用稳定性和长上下文衰减情况。

值得关注的后续

一是 10 月 15 日开源的具体范围:权重、许可证和推理框架支持是否完整。二是 API 定价与限速策略,单任务成本 1/8 的说法能否在真实工作流中复现。三是竞品是否跟进降价或推出同定位模型,尤其是在 AI 编程和金融分析这两条赛道上。

来源:InfoQ CN

celebrityanime
celebrityanime
文章: 24579

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注