消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级

英伟达被曝正在开发新一代开源大模型 Nemotron 4,最大版本预计拥有至少一万亿参数,目标直指全球顶级开源模型。这不仅是模型竞赛,也是英伟达用开放生态拉动其 GPU 算力需求的关键布局。

一句话看懂:英伟达被曝正在开发新一代开源大模型 Nemotron 4,最大版本预计拥有至少一万亿参数,目标直指全球顶级开源模型。这不仅是模型竞赛,也是英伟达用开放生态拉动其 GPU 算力需求的关键布局。

事件核心:发生了什么

据 The Information 报道,援引项目参与者的消息,英伟达正在研发新一代 AI 模型系列 Nemotron 4。多名参与开发的员工透露,其中规模最大的模型预计至少包含 1 万亿个参数,目前最终训练尚未完成,发布日期也未确定,但内部员工认为最早可能在今年秋末准备就绪。

英伟达生成式 AI 副总裁 Kari Briski 在邮件中表示:“投资 Nemotron,是因为我们相信每家企业、每个国家都需要可及的前沿开源模型。”英伟达此前已推出面向代码审查、工具调用、安全警报监控等任务的 Nemotron 3.5 Lightning 模型,并发布了开源模型路由库 NeMo Switchyard,用于按任务自动分配模型。

为什么重要

英伟达是美国少数主动推出开源模型的大型科技企业之一。当前背景是,AI 开发和运行成本持续攀升,而价格更低的中国模型在性能上逐步逼近 Anthropic、OpenAI 等美国领先实验室的顶尖系统,开源模型因此获得更多关注。近期涉及自主 AI 智能体的黑客攻击事件,也进一步加大了外界对开源模型的审视。

对英伟达而言,真正的战略意图不止于“做出一个大模型”。开源模型生态越繁荣,AI 应用场景越广泛,市场对训练和推理算力的需求就越高,最终会转化为对英伟达 GPU 的采购动力。上个月英伟达还与多家企业成立联盟,共同开发并共享 AI 安全与网络安全工具,并与微软等科技巨头签署公开信支持开放权重模型。这一系列动作表明,英伟达正试图从“卖芯片的”进一步嵌入 AI 基础设施标准的制定层。

对用户/开发者/创作者的影响

如果 Nemotron 4 按计划落地,对开发者的直接意义是:多了一个可自由部署、可微调的高参数开源模型选项。相比调用闭源 API,开源模型意味着企业可以把模型放在自有环境中运行,对数据隐私、定制化需求和长期成本控制都更友好。对依赖 GPU 云服务的团队来说,英伟达亲自下场做模型,也可能让后续的模型-硬件适配更顺畅。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对内容创作者而言,更大的开源模型通常意味着更强的指令理解、代码生成和多步任务处理能力,未来有望通过开源社区工具直接调用,而非只能依赖付费 API。但需要注意的是,万亿参数模型的本地部署门槛极高,普通用户大概率仍需要通过云服务或轻量化版本(如 Nemotron 3.5 Lightning 这类分支)来使用。

值得关注的后续

目前公开信息显示,Nemotron 4 的正式发布时间、实际参数量、开源许可证类型及训练成本均未最终确认。后续值得观察几个具体节点:

一是模型是否按报道预期在今年秋末落地,以及发布时是否附上完整的基准测试结果;二是开源许可证的具体条款——开放权重与完全商用授权之间仍有很大差别;三是 Meta、Mistral 等开源阵营主要玩家以及中国大模型厂商是否会在参数规模或性能上作出回应。此外,英伟达能否将 Nemotron 与其 GPU 生态形成协同效应,还需要看实际部署案例和开发者采用情况。

来源:IT之家(RSS)

celebrityanime
celebrityanime
文章: 18313

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注