法国热门初创公司 ZML 发布免费产品,以加快多种人工智能芯片的推理速度

法国 AI 初创公司 ZML 发布了名为 ZML/LLMD 的推理服务器免费产品,能让多种开源大模型在英伟达、AMD、谷歌 TPU、苹果 Metal 和英特尔 Arc 等不同芯片上以接近峰值速度运行,旨在打破芯片供应商锁定,降低 AI 推理成本。

法国热门初创公司 ZML 发布免费产品,以加快多种人工智能芯片的推理速度

一句话看懂:法国 AI 初创公司 ZML 发布了名为 ZML/LLMD 的推理服务器免费产品,能让多种开源大模型在英伟达、AMD、谷歌 TPU、苹果 Metal 和英特尔 Arc 等不同芯片上以接近峰值速度运行,旨在打破芯片供应商锁定,降低 AI 推理成本。

事件核心:发生了什么

根据 TechCrunch 独家报道,由图灵奖得主 Yann LeCun 支持的法国创业公司 ZML,于近期发布了免费推理服务器产品 ZML/LLMD。该产品支持包括 Llama、Mistral 等在内的多种开源大语言模型,运行在英伟达、AMD、谷歌 TPU、苹果 Metal 和英特尔 Arc 等主流芯片之上。ZML 创始人 Steeve Morin 表示,其目标是让不同芯片都能在 AI 推理场景中发挥最大可用速度,有时甚至能超过原生性能。值得注意的是,虽然该产品免费,但并非开源,此举旨在收集使用数据以优化未来商业模式。ZML 团队仅 20 人,此前已融资 2000 万美元,投资者包括 HP 联合创始人 Solomon Hykes、Hugging Face 联合创始人及 Yann LeCun 等。

为什么重要

在 AI 成本日益受到关注的背景下,推理(inference)的重要性已超过模型训练。目前大多数企业受制于软硬件架构壁垒,被锁定在单一芯片供应商生态中。ZML/LLMD 试图提供一个软件层,让企业可以在不同芯片间灵活选择——包括成本更低或功耗更低的欧洲新锐芯片(如 Axelera、Fractile、Kalray 等)。这不仅是技术挑战,更可能形成市场扰动:如果该软件能真正实现跨芯片接近峰值性能,将削弱英伟达在推理环节的垄断定价权。此外,产品免费发布、先做用户规模再考虑收费的策略,也反映出 AI 基础设施领域正在从“闭源高价”向“开源免费+增值服务”转变。

对用户/开发者/创作者的影响

对于使用大模型 API 或自建推理服务的开发者而言,ZML/LLMD 意味着未来不必为单一芯片(如英伟达 H100/B200)支付高额溢价。如果达到宣传效果,企业可以在云上混合使用不同算力资源,以更低成本完成推理请求。对于创作者群体(如使用 Stable Diffusion 或 LLaMA 进行本地生成),意味着未来苹果 Mac(M系列)或英特尔 Arc 系列 GPU 可能获得与专业 AI 芯片相近的推理速度,硬件选择空间变大。目前该产品免费,但后续可能转为付费,建议早期用户测试其兼容性和性能。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

首先,ZML/LLMD 的真实跨芯片性能需要独立第三方验证,尤其是在 AMD 和英特尔 Arc 等非英伟达平台上的推理延迟和吞吐量数据。其次,英伟达自身也在加大对推理场景的投入(如推出专用推理芯片),该软件的商业威胁是否会引来英伟达的竞争或合作值得关注。最后,目前市场上已有 Baseten(估值130亿美元)、vLLM 的商业化版本 Inferact、以及 SGLang 的商业公司 RadixArk 等竞品,ZML 能否凭借“极简团队+免费策略”快速获取开发者生态仍是关键变量。

来源:TechCrunch AI

celebrityanime
celebrityanime
文章: 14596

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注