推文
@aiclaw404 · 2026-10-09 23:43
好久好久没用过 Perplexity 了!! 最近它们开源了一个多模态模型,还是挺值得关注的!! pplx-embed-v2-late,有0.6B和9B两个尺寸! 最大的亮点就是,支持直接检索渲染成图片的 PDF 页面,不用先OCR提取文字。 两个尺寸的模型,还可以搭配着用!! 它们共享同一个向量空间。 简单理解就是:大模型提前给资料建立索引,搜索时调用小模型处理查询。 对于资料相对固定、每天要查询很多次的知识库,这个设计就非常实用了,经济高效!! 它的检索方式还不太一样。 常见的单向量方法,会把一段内容压缩成一个向量; 这套模型会保留 token 级别的多个向量,让问里的不同部分,分别去匹配文档里的细节。 我能想到最适用的场景,就是用来做相册搜索、截图搜索之类的产品,并且0.6B模型很适合放到端侧。 目前官方API还没上线,但模型可以从 Hugging Face下载部署。
曝光 60 · 评论 0 · 点赞 1 · 书签 0 · 曝光/时 13.643057012508837