Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
warning
此模型已被更新的模型取代。
向量模型
重排模型
Apache 2.0 许可证
open_in_new 发布博客

jina-colbert-v1-en

改进版 ColBERT 模型,支持 8K 词元长度,可用于向量化和重排任务
许可证
Apache-2.0
发布日期
calendar_month
2024-02-17
输入
abc
文本
arrow_forward
输出
apps
多向量
模型详情
参数: 137M
输入词元长度: 8K
输出维度: 128
底座模型 help_outline
link
jina-embeddings-v2-base-en
已训练语言 help_outline
1 种语言
可通过以下方式获取
Jina API
AWS SageMaker
微软云
Hugging Face
物理隔离
I/O 图 1

多个

向量

查询

jina-colbert-v1-en

I/O 图 2

多个

向量

文档

jina-colbert-v1-en

帕累托前沿 help_outline
workspace_premium
LoCo
BEIR · arguana
BEIR · climatefever
chevron_leftchevron_right
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-reranker-v1-base-enjina-reranker-v1-tiny-enjina-reranker-v1-turbo-…jina-colbert-v1-en参数量(对数)nDCG@10
本模型
在前沿上
Jina AI
其他
LoCo
83.70
参数量
137M
按分数的排名
3 / 6
帕累托前沿
在前沿之后
取值分布help_outline
AUC 0.5963
语料
翻译对
15.7801020
相关17.0%
困难负例9.3%
无关1.0%
推荐阈值
FPR 0.1 · 9.27
FPR 0.01 · 15.78
FPR 0.001 · 21.53
FPR 0.0001 · 25.48
均衡 · 7.98
AUC
0.5963
噪声上限
21.44
召回悬崖
-0.71
测量样本对
100 / 9,200
各名次得分help_outline
12345678910
各名次位置上的平均得分
选择要比较的模型

概述

jina-colbert-v1-en 是一个 137M 参数的英语迟交互(late-interaction)检索模型,生成 token 级向量(每 token 128 维),而非单个文档向量。这使得以双编码器效率获得交叉编码器质量成为可能:文档只需索引一次,相关性评分在查询时通过对 token 对的最大池化和求和完成。它支持 8,192 token 的文档,是首个将 ColBERT 风格检索引入生产的 Jina 模型。

方法

该模型采用基于改编 ColBERT 方案的迟交互架构。它不会一次性比较整个文档,而是独立处理查询和文档,直到最终匹配阶段。文档编码器处理多达 8,192 token 的文本;查询编码器生成精确的 token 级表示。查询和文档中的每个 token 都获得自己的 128 维向量,保留了单向量模型中丢失的细粒度语义信息。迟交互机制通过对查询 token 做最大池化、对文档 token 做求和来计算相关性分数,在避免交叉编码器昂贵的全对全注意力的同时捕捉 token 级匹配信号。该架构使用 137M 参数、基于 BERT 的编码器和针对 8,192 token 上下文的 ALiBi 位置编码。

性能

在 BEIR 数据集集合上,模型取得优越性能:Arguana 49.4%(ColBERTv2 为 46.5%)、FEVER 79.5%(对比 78.8%)、TREC-COVID 75.0%(对比 72.6%)。最令人印象深刻的是长上下文理解的 LoCo 基准上的大幅提升,得分 83.7%,而 ColBERTv2 为 74.3%——9.4 个百分点的增益展示了 token 级表示对长文档的价值。该模型在通过迟交互方案保持计算效率的同时,超过了传统单向量模型。137M 参数量使其适合生产部署。

最佳实践

当您需要交叉编码器的检索质量而不需要其延迟时使用此模型。最优性能需要支持 CUDA 的 GPU;开发时可用 CPU 推理。8,192 token 的文档上限约为 6,000 字,适合包括学术论文和技术文档在内的大多数文档类型。该模型仅支持英语——多语应用请使用 jina-colbert-v2。生产部署应实现适当的文档分块策略,并使用向量相似性索引(FAISS、Qdrant、Weaviate)进行高效检索。在采用 RAGatouille 等简化迟交互实现的框架的 RAG 流水线中,该模型尤其有效。如需多语支持或更高精度,请考虑 jina-colbert-v2 或 jina-embeddings-v4(多向量模式)。

提及此模型的博客
八月 30, 2024 • 10 分钟阅读
Jina ColBERT v2:用于向量检索和重排序的多语言后期交互检索器
Jina ColBERT v2 支持 89 种语言,具有卓越的检索性能、用户可控的输出维度以及 8192 的 token 长度。
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
六月 19, 2024 • 11 分钟阅读
AI 可解释性变得简单:延迟交互如何使 Jina-ColBERT 变得透明
AI 的可解释性和透明度是热门话题。如果我们看不到 AI 是如何运作的,我们又怎么能信任它呢?Jina-ColBERT 向你展示了,只要有合适的模型架构,就能轻松地让 AI 揭示其内部的秘密。
Maximilian Werk
Scott Martens
Digital representation of a golden building seen through a blue and yellow mesh pattern, evoking a technological vibe.
五月 13, 2024 • 5 分钟阅读
Albus by Springworks:为企业员工赋能的企业搜索引擎
了解领先的人力资源科技创业公司如何使用 Jina AI 的模型来处理结构化和非结构化数据。
Francesco Kruk
Saahil Ognawala
Albus logo in white on a dark blue background, surrounded by abstract blue shapes and symbols.
四月 29, 2024 • 7 分钟阅读
Jina Embeddings 和 Reranker 在 Azure 上:可扩展的企业级 AI 解决方案
Jina Embeddings 和 Rerankers 现已在 Azure Marketplace 上线。重视隐私和安全的企业现在可以在其现有的 Azure 生态系统中轻松集成 Jina AI 的最先进模型。
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
二月 20, 2024 • 16 分钟阅读
什么是 ColBERT 和延迟交互?为什么它们在搜索中很重要?
Jina AI 在 Hugging Face 上发布的 ColBERT 在 Twitter 上引起热议,凭借其 8192 token 的处理能力为搜索带来了全新视角。本文深入解析 ColBERT 和 ColBERTv2 的细节特性,展示了它们的创新设计,以及为什么它们的后期交互特性能够彻底改变搜索领域。
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。