一句话看懂:韩国AI实验室Upstage正式发布商用大模型Solar Pro 4,主打超长上下文与智能体任务,以明显低于同类产品的API定价进入多个国际评测榜单,成为首个登上Agent Arena等排行榜的韩国模型。
事件核心:发生了什么
Upstage近期推出Solar Pro 4,定位为面向复杂智能体任务的商用大模型。其核心参数是512K上下文窗口和最高128K的输出长度,意味着用户可以在单次会话中载入多份合同、报告与数据文件,交给模型完成长文本理解和生成。官方定价显示,输入价格每百万tokens为0.3美元,缓存读取输入价格为0.06美元,输出价格每百万tokens为1.2美元。
在性能验证上,Upstage公布了三项评测分数:Terminal-Bench v2.1得分57,τ³-Banking得分23,AA-LCR得分71。这些测试分别覆盖终端操作、多轮工具调用与长文档处理等真实agent场景。官方还演示了一个咖啡品牌选址案例:模型仅用3条提示词就完成了10个候选店址的政策筛选,并依次自动生成Excel工作簿、评审报告和演示文稿三份交付物。
为什么重要
Solar Pro 4的看点不止于参数本身。其一,它打破了中美企业主导大模型榜单的惯常印象——这是韩国实验室首次出现在Agent Arena、Code Arena: WebDev和Text Arena排行榜上,目前在Agent Arena中位列第44,与MiniMax M2.7、Nemotron 3 Ultra等知名模型处于同一能力区间。其二,它的差异化路线很清楚:不在通用聊天上硬拼,而是专注长文档、终端任务和多轮工具调用这些智能体落地场景。其三,每百万tokens 0.3美元的输入价格远低于同类商用模型,是在用成本和长上下文的组合吸引开发者。
对用户/开发者/创作者的影响
对开发者来说,低价的API和128K输出长度降低了智能体应用的试错门槛



