Perplexity发布pplx-embed-v2-late多模态嵌入模型,提供0.6B端侧版与9B版
据MarkTechPost报道,Perplexity发布了pplx-embed-v2-late,这是一组ColBERT风格的多模态嵌入模型,分为两种规格:0.6B版本面向快速、低成本的查询,9B版本则追求最高质量,据标题所述其在MADQA基准上取得92.4%的成绩。两款模型都能检索文本、图像和渲染后的PDF页面,并共享同一个嵌入空间。在部署方面,两款模型均已在Hugging Face上以MIT许可证发布,允许商业使用,用户可自行托管;Perplexity计划推出托管API端点,但目前尚未上线。报道总结的优势包括:0.6B模型处理图像时约使用3.4亿个激活参数,表现接近80亿参数级别的竞品;用户可以用0.6B模型的查询去检索由9B模型建立的索引,在文本任务上以0.6B的查询成本弥补约一半与9B模型之间的质量差距;其每个词元向量仅128维,比维度为2048至4096的竞品窄16至32倍。不足之处在于,该模型为每个词元存储一个向量,因此索引规模会随文档长度增长。
