腾讯混元发布开源旗舰模型Hy4preview,总参数770B、上下文1M

腾讯混元于8月28日发布开源旗舰大模型Hy4preview,总参数770B、激活参数49B,支持1M上下文,并在软件工程、办公、游戏与科研等真实生产力场景中展示了具体能力,值得开发者重点关注。

一句话看懂:腾讯混元于8月28日发布开源旗舰大模型Hy4preview,总参数770B、激活参数49B,支持1M上下文,并在软件工程、办公、游戏与科研等真实生产力场景中展示了具体能力,值得开发者重点关注。

事件核心:发生了什么

腾讯混元正式推出开源旗舰大模型Hy4preview,这是Hy4迭代的早期版本。模型总参数规模达770B,激活参数为49B,上下文长度支持1M。该模型已同步在HuggingFace、GitHub、ModelScope等平台开源,并上线腾讯云TokenHub和OpenRouter,用户可通过腾讯内部的WorkBuddy/CodeBuddy、元宝和ima等产品直接体验。

能力层面,Hy4preview依托腾讯内部软件工程、游戏、金融、安全等领域的专家共建高质量数据,在四个方向取得进展:提升软件工程中长周期开发任务的理解、规划与调试能力;在办公场景中完成从数据分析到文档、表格、演示文稿的全流程交付;通过MCP方式支持接入Unreal5和Unity引擎做游戏开发,从对话直接生成可玩demo;以及在分子动力学、凝聚态物理和基础数学等科研领域有覆盖。

内部盲测数据显示,在163位专家评分的203个工程任务中,Hy4preview平均得分2.99/4.00,略高于GLM-5.3的2.92和Kimi K3的2.94。在科研方面,结合Hyra模型,将三维Blaschke–Lebesgue经典问题的体积下界从0.380799推进到0.41104,距离Meissner四面体猜想的最终证明仅剩约2%的差距;在32,512个原子的磷脂双层模拟中实现2.0倍加速,达到54.9ms/step。

为什么重要

这是大模型竞争从参数比拼转向生产力实效验证的一个具体信号。腾讯此次选择以开源方式发布早期版本,而不是等到完全成熟后再推出,意味着厂商越来越倾向于通过“边发布、边收集反馈、边快速迭代”的方式推进模型演进。Hy4preview的总参数770B属于当前开源模型的第一梯队,而49B激活参数的设计也在控制推理成本与性能之间做平衡,这对企业实际部署有直接影响。

另一个看点是腾讯将内部业务场景的优势转化为模型能力壁垒——软件工程、游戏引擎对接、金融安全等领域的专家数据,是通用互联网公司难以短期复制的资源。这种“业务反哺模型”的路径,与单纯拼算力和公开语料的做法形成了差异。

对用户/开发者/创作者的影响

开发者和企业技术团队是这轮开源最直接的受益者。Hy4preview支持1M上下文,意味着可以处理长文档、大型代码仓库或复杂项目级任务,而不需要频繁做切片和拼接。模型同时上线OpenRouter和腾讯云TokenHub,API调用门槛较低,适合做产品原型验证和私有化部署测试。MCP方式接入Unreal5和Unity引擎的能力,为游戏开发者提供了从自然语言直接生成可玩demo的路径,虽然当前仍是早期版本,但值得先在实验性项目中尝试。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

办公场景下,模型在数据分析到文档、表格、演示文稿的全流程交付能力,对日常处理报表和制作材料的创作者有一定实用价值;元宝和ima等产品中的直接体验入口,可以降低试用成本。但需要留意,腾讯官方已经明确提示Hy4preview存在复杂任务长思考等已知问题,生产环境落地前需要充分测试。

值得关注的后续

首先,Hy4preview的正式版Hy4何时发布、预训练和后训练改进幅度有多大,是判断该模型路线能否持续领先的关键。其次,开源社区的反馈速度和实际部署案例——尤其是软件工程任务中的调试能力和游戏MCP生态的第三方适配情况——将验证早期版本的真实生产力。第三,GLM和Kimi等竞品面对本次盲测结果是否会有公开回应或版本更新,可能影响下一轮国产开源大模型的性能标杆。最后也建议关注腾讯云上该模型的API定价和TokenHub的接入政策,开源只是第一步,商业化落地的实际成本才是企业做选型决策的核心变量。

来源:AIbase

celebrityanime
celebrityanime
文章: 21241

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注