Mistral releases Mistral Large 4, dubbed “le Chonk”, a 1T-parameter open-weight model for general agentic capabilities, trained on 4,000 Grace Blackwell GPUs (Sabrina Ortiz/The Deep View)

Mistral 发布 Mistral Large 4(代号“le Chonk”),一款 1 万亿参数的开源权重模型,主打通用智能体(agentic)能力,并在 4000 块 Grace Blackwell GPU 上完成训练。这意味着欧洲头部 AI 公司把最大规模的模型直接开权重放出来,而不是只走闭源 API…

一句话看懂:Mistral 发布 Mistral Large 4(代号“le Chonk”),一款 1 万亿参数的开源权重模型,主打通用智能体(agentic)能力,并在 4000 块 Grace Blackwell GPU 上完成训练。这意味着欧洲头部 AI 公司把最大规模的模型直接开权重放出来,而不是只走闭源 API 路线。

事件核心:发生了什么

据 Techmeme 收录的报道,Mistral 推出了 Mistral Large 4,内部代号“le Chonk”。这是一个参数量约 1 万亿的开放权重(open-weight)模型,定位为通用智能体能力,也就是更擅长多步任务规划、工具调用和自主执行,而不只是单轮对话。训练侧动用了 4000 块 NVIDIA Grace Blackwell GPU,说明这是一次面向大规模算力集群的旗舰级训练。目前公开信息显示,模型以开放权重形式发布,具体许可证条款、上下文长度和基准测试分数尚未在素材中完整披露。

为什么重要

1T 参数级别的模型过去基本是闭源厂商的主场,开放权重阵营里能对标的作品不多。Mistral 这次把旗舰规模模型开源,等于在“开源 vs 闭源”的路线竞争里又加了一个重量级筹码:开发者可以自行部署、微调,而不必完全依赖厂商 API。对行业格局来说,这也强化了 Mistral 作为欧洲开源代表与 OpenAI、Anthropic、Google 等闭源路线形成对照的位置。同时,4000 块 Grace Blackwell 的用量,也把训练门槛和算力军备竞赛的现实摆到了台面上——开放权重不等于低成本训练。

对用户/开发者/创作者的影响

开发者层面,最直接的价值是可以在自有或租用算力上跑一个接近前沿水平的智能体基座,做工具调用、自动化流程和垂直微调,减少对单一 API 的依赖。企业采购会关注许可证是否允许商用、部署成本与推理延迟。创作者则更可能间接受益:更强的 agentic 能力会渗透进各类 AI 应用、内容生产工具和自动化工作流,但是否直接开放图像生成等多模态能力,目前公开信息显示还不明确。需要注意的是,1T 参数模型的推理硬件要求不会低,普通用户短期内更可能通过第三方产品而非本地部署来使用它。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是许可证与商用条款是否真正宽松,这决定开发者生态能否快速扩大;二是官方基准与实测智能体表现,尤其是工具调用和多步任务的稳定性;三是推理成本与部署方案,包括是否提供托管 API 或量化版本;四是闭源厂商是否会跟进调整开源策略或价格。这些将决定“le Chonk”是一次声量发布,还是能真正落地的开源旗舰。

来源:Techmeme

celebrityanime
celebrityanime
文章: 27609

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注