Perplexity 开源 pplx-embed-v2-late 多模态嵌入模型,9B 与 0.6B 共享同一空间

Perplexity 于 2026 年 10 月 7 日在 X 上宣布开源 pplx-embed-v2-late,一组支持文本与图像的多向量 late-interaction 嵌入模型,9B 和 0.6B 两个版本共享同一嵌入空间,权重已在 Hugging Face 发布。

一句话看懂:Perplexity 于 2026 年 10 月 7 日在 X 上宣布开源 pplx-embed-v2-late,一组支持文本与图像的多向量 late-interaction 嵌入模型,9B 和 0.6B 两个版本共享同一嵌入空间,权重已在 Hugging Face 发布。

事件核心:发生了什么

Perplexity CEO Aravind Srinivas 在 X 上表示,公司正在开源 pplx-embed-v2-late,这是面向文本和图像的多向量嵌入模型,包含 9B 和 0.6B 两个规格,二者处于同一个共享嵌入空间。按他的说法,9B 版本可用于索引多模态数据,0.6B 版本可在设备端执行查询;这套模型还支持无需 OCR 直接搜索 PDF 页面。同一时间,Perplexity 官方账号补充说这是两个 late-interaction 嵌入模型,能检索文本、图像和页面,并支持跨模型查询。Srinivas 给出的评测数据为 MADQA 92.4%、BrowseComp+ 64%,权重已上线 Hugging Face。

为什么重要

嵌入模型是检索环节的底座,决定搜索、RAG 和推荐系统能召回什么。Perplexity 这次选择开源而非闭源,并通过 late-interaction 加多向量路线切入多模态检索,等于把竞争焦点从“生成质量”延伸到“检索基础层”。大小模型共享同一嵌入空间,也让离线索引与端侧查询可以对接,降低企业把多模态数据接入检索栈的门槛。目前公开信息显示,这些成绩由 Perplexity 单方面披露,尚未看到第三方复现或同行评审,因此应视为厂商自报数据,而非行业永久排名。

对用户/开发者/创作者的影响

对开发者,最直接的价值是可在 Hugging Face 获取权重,用于构建多模态搜索、图文混合知识库或无需 OCR 的 PDF 检索流程,减少对第三方嵌入 API 的依赖。0.6B 可在设备端运行,说明端侧检索和隐私敏感场景有落地可能,但实际延迟和内存占用取决于部署硬件与量化方案。对企业和创作者,图文混合检索若成熟,会影响知识管理、内容归档和多模态素材搜索的体验。需要提醒的是,模型开源不等于产品上线,Perplexity 目前未公布调用价格、商用许可细节和托管 API,落地前仍需自行验证。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

后续可观察三点:一是 Perplexity 是否把该模型接入自有搜索或 API 产品,并公布价格与配额;二是 9B 和 0.6B 的实测检索质量是否被社区独立复现,MADQA 和 BrowseComp+ 成绩能否在不同数据集上稳定;三是竞品与云厂商是否跟进多模态 late-interaction 嵌入,以及开源权重采用何种许可证、是否允许商用。

来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)

celebrityanime
celebrityanime
文章: 27956

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注