硅基流动上线开源模型 Hy4 preview,770B 总参数、1M 上下文

硅基流动(SiliconFlow)上线开源模型 Hy4 preview,总参数 770B、单次推理激活 49B、支持 1M 上下文,采用 Apache 2.0 协议,可直接接入 Claude Code、Codex、Cursor 等现有工具。

一句话看懂:硅基流动(SiliconFlow)上线开源模型 Hy4 preview,总参数 770B、单次推理激活 49B、支持 1M 上下文,采用 Apache 2.0 协议,可直接接入 Claude Code、Codex、Cursor 等现有工具。

事件核心:发生了什么

根据硅基流动官方 X 账号发布的信息,Hy4 preview 已在其平台上开放使用。这款模型总参数规模为 770B,但每个 token 只激活约 49B 参数,属于典型的稀疏混合专家(MoE)架构路线;上下文窗口达到 1M,官方定位是面向编码、分析、研究和复杂真实工作负载。协议方面采用 Apache 2.0,意味着商用限制较少。硅基流动同时强调,用户可以把 Hy4 preview 直接接入 Claude Code、Codex、Cursor 等已有工具链,由平台提供推理服务。该推文发布于 2026 年 9 月 14 日,并称该模型是 OpenRouter 上热度较高的开源模型之一。

为什么重要

770B 总参数加 1M 上下文,在当前开源权重模型里属于第一梯队规格,而“只激活 49B”的设计直接影响推理成本和响应速度,这是能否承载真实业务的关键。更值得注意的是渠道意义:过去这类大模型往往先出现在海外推理平台或自建集群上,如今由国内平台首发上线并提供 API,说明国内推理服务商在模型托管和工程优化上的竞争力在提升。Apache 2.0 也降低了企业二次开发和私有化部署的法律顾虑,对希望在开源与闭源之间寻找平衡的团队来说,多了一个可评估的选项。

对用户/开发者/创作者的影响

对开发者而言,最直接的价值是不必更换工具:继续用 Cursor、Claude Code、Codex,只把后端模型指向 Hy4 preview 即可,迁移成本较低。1M 上下文适合处理大型代码库、长文档和跨文件分析任务,而 49B 激活参数意味着单位推理成本可能低于同等总参数量的稠密模型,目前公开信息显示其定价尚未披露,需要实际调用后评估。对创作者和企业用户来说,Apache 2.0 允许更灵活的商用和微调,但 preview 版本通常稳定性、工具调用能力与正式版存在差距,不建议第一时间用于关键生产链路。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是正式版何时发布、preview 与正式版的能力差距有多大;二是 API 定价和吞吐表现,这决定它能否在编码场景替代现有主流模型;三是工具链适配深度,尤其是 Claude Code、Cursor 中的长上下文与 Agent 调用是否稳定;四是其他开源模型厂商和推理平台是否会跟进类似规格,推动 1M 上下文成为新的竞争基线。

来源:X:硅基流动 SiliconFlow (@SiliconFlowAI)

celebrityanime
celebrityanime
文章: 23469

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注