阶跃甩出 Step 5 Preview:600B 稀疏 MoE 只激活 27B,把开源旗舰的”性价比边界”往外推了一格

阶跃星辰发布旗舰基座模型 Step 5 Preview,采用 600B 总参数、单次仅激活 27B 的稀疏 MoE 架构,主打真实 Agent 任务场景,在多项高难度评测中接近 GPT-6Astra 与 Claude Opus5,同时把单任务成本压到后者的八分之一。
先解决问题,再了解资讯。选择你现在要完成的任务。

阶跃星辰发布旗舰基座模型 Step 5 Preview,采用 600B 总参数、单次仅激活 27B 的稀疏 MoE 架构,主打真实 Agent 任务场景,在多项高难度评测中接近 GPT-6Astra 与 Claude Opus5,同时把单任务成本压到后者的八分之一。

阶跃星辰发布下一代旗舰基座模型 Step5Preview,在 AI 编程、软件工程、金融等 Agentic 场景上发力,单任务成本仅为 Claude Opus5 的 1/8,并计划于 10 月 15 日正式开源。

阶跃星辰的 Step 5 Preview 已全量开放 API 与 Studio,以 600B 总参数、27B 激活的稀疏 MoE 架构对标 K3 级性能,新用户最长可获 75 天免费额度,全权重模型将于 10 月 15 日放出。
![[Bug]: Qwen3.5 structured output doesn't work](https://www.chat-gpts.plus/wp-content/uploads/2026/09/35700-bd9ee480-768x403.jpg)
在 vLLM 上通过 OpenAI 兼容接口为 Qwen3.5 提供 structured output 时,thinking 模式下返回的 JSON 可能被 markdown 代码块包裹(如 ```json ... ```),或在启用 MTP 投机解码时违反 response_format 约束。
![[Model Support] DeepSeek-V4.1 Tracking Issue](https://www.chat-gpts.plus/wp-content/uploads/2026/09/56400-8f0f3572-768x403.jpg)
这是 DeepSeek-V4.1(DSv4.1)模型支持的 Tracking Issue,不是单一报错。若你在 vLLM 加载 DeepSeek-V4.1-Flash 时遇到模型无法解析(如 [Model Support] DeepSeek-V4.1 Tracking Issue )、ROCm 段错

迪士尼任命 Character.AI 前 CEO 卡尔平德·阿南德(Kalpinder Anand)出任公司史上首位 CTO,10 月 2 日上任,直接向 CEO 乔什·达马罗汇报,统管企业技术、基础设施、数据、AI 平台及产品和工程运营。这意味着传统内容巨头正把 AI 从试验性项目提升到公司级技术主线的位置…

特朗普在社交媒体宣布将组建“人工智能部队”并任命专门负责人,同时给出“AI 未来可能占美国 GDP 25%”的判断。这类表态的价值不在于数字本身能否兑现,而在于它透露的监管取向:以保护和扶持为主,而非收紧限制。

据路透社报道,Anthropic 正考虑在 IPO 前推出新一代模型,以应对 OpenAI GPT-6 Astra 在企业市场上的快速扩张。值得关注的是,这家公司 CEO 此前刚公开呼吁全行业放慢迭代节奏,如今自身却可能被迫加速。

启元机器人的 Q1、T1 已接入腾讯云 WorkBuddy,成为首个与该平台打通的具身智能硬件。WorkBuddy 由此从屏幕里的 AI 助手,变成能走会动、可被远程调度的物理执行端。

阿里千问发布 Qwen3.8-LiveTranslate 同声传译大模型,用统一的 Interleave 架构把字均延迟从 2.8 秒压到 2.3 秒,并新增说话人分离、原文译文同屏、长上下文消歧三项能力,让实时传译更接近可用状态。