一句话看懂:英伟达被曝正加速开发新一代开源大模型 Nemotron 4,参数量预计至少达到 1 万亿级别,目标是直接对标全球顶级开源模型,同时拉动市场对高性能 GPU 算力的需求。
事件核心:发生了什么
据外媒报道,芯片巨头英伟达正在加紧研发新一代开源人工智能模型 Nemotron 4。公开信息显示,该模型的参数规模预计至少达到 1 万亿级别。此前,英伟达已推出过 Nemotron-4 340B 系列(拥有 3400 亿参数)等开源模型,这些成果被广泛用于大语言模型的训练数据生成、核心模型开发及企业级 AI 应用。
此次 Nemotron 4 的参数规模若属实,将使其跻身全球体量最大的开源模型行列,与多个头部开源大模型形成直接竞争。
为什么重要
英伟达当前的商业模式高度依赖 AI 算力销售,其深度参与开源模型开发并非单纯做“模型生意”,而是有着明确的战略意图:通过提供高性能开源底座,吸引更多开发者和企业使用其 GPU 集群进行训练与推理,从而巩固其在 AI 基础设施市场的统治地位。
与此同时,长江证券的分析指出,随着行业模型调用成本显著下降,企业试错门槛正在降低。开发者可以在固定预算内进行更大规模的用户测试和产品迭代,这将加速各类应用场景的渗透,推动 AI 应用整体走向关键转折点。英伟达加码开源模型,本质上是在为这一轮应用爆发提前铺设算力入口。
对用户/开发者/创作者的影响
对于开发者而言,Nemotron 4 若按期发布,意味着未来可能拥有一个参数量达万亿级、可商用且开放权重的基础模型选择,这将直接影响模型选型和训练预算分配——尤其是那些依赖开源模型做微调或数据生成的团队。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对企业用户来说,开源万亿模型的推出可能进一步拉低高质量 AI 能力的调用成本,尤其在文本生成、知识问答和复杂推理等场景中,企业有望以更低价格获得接近闭源顶级模型的效果。
对创作者而言,虽然当前信息集中于语言模型方向,但英伟达若将类似能力扩展至多模态或图像生成相关组件,内容生产工具的底层能力也可能随之升级,进而降低高质量视觉内容的生成门槛。
值得关注的后续
目前公开信息显示,英伟达官方尚未正式公布 Nemotron 4 的发布时间与技术细节,以下几点值得持续跟踪:
一是实际参数规模与开源协议能否兑现“万亿级”预期;二是其性能表现与现有头部开源模型(如 Llama 系列)的对比结果;三是该模型是否会与英伟达的软件生态(如 CUDA、NeMo 框架)深度绑定,从而进一步加高竞争壁垒。
来源:AIbase


