Products and Tools
Sentence Transformers v6.0 原生支持多向量编码器,统一 PyLate、Stanford-NLP ColBERT 与 ColPali 系列模型
Sentence Transformers v6.0 原生加入多向量编码器,统一兼容 PyLate、ColBERT 与 ColPali 检查点,并以内置 MaxSim 支持细粒度检索。
阅读 Hugging Face 原文为什么重要
多向量检索从分散实现进入常用工具链,可降低 ColBERT 类检索系统的集成成本,并拓展文本与视觉文档检索能力。
关键事实
事实 1
Sentence Transformers v6.0 需要 transformers v5.x、torch 2.2+ 和 huggingface-hub v1.x。
来源与依据
Sentence Transformers v6.0 requires transformers v5.x, torch 2.2+, and huggingface-hub v1.x.
事实 2
任何 PyLate 检查点和任何 Stanford-NLP ColBERT 检查点均可直接加载到 MultiVectorEncoder 中。
来源与依据
Any PyLate checkpoint and any Stanford-NLP ColBERT checkpoint loads straight into it
事实 3
MaxSim 运算符通过对每个查询令牌取最高相似度并对这些最大值求和来计算分数。
来源与依据
for each query token, take its highest similarity against any document token, then sum those maxima across the query.