腾讯混元发布 Hy4 preview:770B 总参数、1M 上下文,开源上线

腾讯混元发布新一代大模型 Hy4 preview,以 770B 总参数和 1M 上下文窗口开源上线,直接拉高了大模型在长文本处理和超大规模参数层面的开源竞争门槛。

一句话看懂:腾讯混元发布新一代大模型 Hy4 preview,以 770B 总参数和 1M 上下文窗口开源上线,直接拉高了大模型在长文本处理和超大规模参数层面的开源竞争门槛。

事件核心:发生了什么

腾讯混元于近期正式发布并开源了 Hy4 preview 模型。根据官方公布的信息,该模型采用 MoE(混合专家)架构,总参数量达到 770B,其中激活参数规模相对精简,目的是在保持高推理能力的同时控制算力成本。Hy4 preview 的最大亮点在于支持 1M token 的上下文窗口,这意味着模型可以一次性处理相当于多本厚书规模的文本内容,远超当前主流开源模型常见的 128K 或 200K 上下文长度。目前该模型已上线开源社区,开发者可通过腾讯混元官方渠道获取权重并进行本地部署或 API 调用。

为什么重要

此次开源动作的意义不仅在于参数数字的堆叠,更在于它将“超大参数”和“超长上下文”两个技术方向同时推向了开源生态。过去,千亿级参数的模型多由闭源厂商掌控,而 1M 上下文也更多出现在商业 API 服务中。Hy4 preview 的开源意味着中小开发团队和企业有机会基于这一体量进行定制化训练与推理部署,不必完全依赖闭源 API。从行业竞争角度看,腾讯混元选择在此时发布 preview 版本,既是在追赶国内大模型开源节奏,也是在长文本处理这一差异化赛道上抢占技术话语权。对于开源社区而言,770B 级别的模型如何在高并发推理场景下控制算力消耗,将成为后续讨论的焦点。

对用户/开发者/创作者的影响

对于普通用户,Hy4 preview 的 1M 上下文直接改善了对超长文档、完整代码库或多轮复杂对话的处理体验,例如一次性分析整本财报或长篇小说时,不再需要分段拼接。对于开发者,开源模型意味着可以基于自有数据做领域微调,并将模型集成到企业内部知识库、客服系统或文档处理工具中,且数据隐私可控性高于调用外部 API。对于创作者,长上下文能力有助于进行长篇内容的结构化改写、跨章节一致性校对,以及基于大量素材的辅助创作。不过,770B 总参数的模型对本地推理硬件的显存要求较高,普通开发者更现实的路径是借助云服务或 API 方式进行调用,而非完全自建推理集群。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

首先,Hy4 preview 的实际推理速度和部署成本尚未有公开的详细基准数据,后续是否提供量化的算力消耗对比值得关注。其次,开源版本的许可协议细节将直接影响企业商用范围,目前公开信息显示其已开源,但具体授权条款仍需查看官方仓库说明。第三,国内其他大模型厂商是否会在上下文长度或参数规模上快速跟进,将决定这一波开源竞赛是否会从“参数竞赛”转向“长文本应用生态”的比拼。

来源:公众号:腾讯混元

celebrityanime
celebrityanime
文章: 21235

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注