Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login
warning
此模型已被更新的模型取代。
向量模型
重排模型
Apache 2.0 許可證
open_in_new 釋出部落格

jina-colbert-v1-en

改進版 ColBERT 模型,支援 8K 詞元長度,可用於向量化和重排任務
許可證
Apache-2.0
釋出日期
calendar_month
2024-02-17
輸入
abc
文字
arrow_forward
輸出
apps
多向量
模型詳情
參數: 137M
輸入詞元長度: 8K
輸出維度: 128
底座模型 help_outline
link
jina-embeddings-v2-base-en
已訓練語言 help_outline
1 種語言
可透過以下方式獲取
Jina API
AWS SageMaker
Microsoft Azure
Hugging Face
物理隔離
I/O 圖 1

多個

向量

查詢

jina-colbert-v1-en

I/O 圖 2

多個

向量

文件

jina-colbert-v1-en

帕累託前緣 help_outline
workspace_premium
LoCo
BEIR · arguana
BEIR · climatefever
chevron_leftchevron_right
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-reranker-v1-base-enjina-reranker-v1-tiny-enjina-reranker-v1-turbo-…jina-colbert-v1-en參數量(對數)nDCG@10
本模型
在前緣上
Jina AI
其他
LoCo
83.70
參數量
137M
按分數的排名
3 / 6
帕累託前緣
在前緣之後
取值分佈help_outline
AUC 0.5963
語料
翻譯對
15.7801020
相關17.0%
困難負例9.3%
無關1.0%
推薦閾值
FPR 0.1 · 9.27
FPR 0.01 · 15.78
FPR 0.001 · 21.53
FPR 0.0001 · 25.48
均衡 · 7.98
AUC
0.5963
噪聲上限
21.44
召回懸崖
-0.71
測量樣本對
100 / 9,200
各名次得分help_outline
12345678910
各名次位置上的平均得分
選擇要比較的模型

概述

jina-colbert-v1-en 是一個 137M 參數的英語遲交互(late-interaction)檢索模型,產生 token 級向量(每 token 128 維),而非單一文件向量。這使得以雙編碼器效率獲得交叉編碼器品質成為可能:文件只需索引一次,相關性評分在查詢時透過對 token 對的極大池化和求和完成。它支援 8,192 token 的文件,是首個將 ColBERT 風格檢索引入生產的 Jina 模型。

方法

該模型採用基於改編 ColBERT 方案的遲交互架構。它不會一次性比較整個文件,而是獨立處理查詢和文件,直到最終匹配階段。文件編碼器處理多達 8,192 token 的文字;查詢編碼器產生精確的 token 級表示。查詢和文件中的每個 token 都獲得自己的 128 維向量,保留了單向量模型中丟失的細粒度語意資訊。遲交互機制透過對查詢 token 做極大池化、對文件 token 做求和來計算相關性分數,在避免交叉編碼器昂貴的全對全注意力的同時捕捉 token 級匹配訊號。該架構使用 137M 參數、基於 BERT 的編碼器和針對 8,192 token 上下文的 ALiBi 位置編碼。

效能

在 BEIR 資料集集合上,模型取得優越性能:Arguana 49.4%(ColBERTv2 為 46.5%)、FEVER 79.5%(對比 78.8%)、TREC-COVID 75.0%(對比 72.6%)。最令人印象深刻的是長上下文理解的 LoCo 基準上的大幅提升,得分 83.7%,而 ColBERTv2 為 74.3%——9.4 個百分點的增益展示了 token 級表示對長文件的價值。該模型在透過遲交互方案保持計算效率的同時,超過了傳統單向量模型。137M 參數量使其適合生產部署。

最佳實踐

當您需要交叉編碼器的檢索品質而不需要其延遲時使用此模型。最佳性能需要支援 CUDA 的 GPU;開發時可用 CPU 推理。8,192 token 的文件上限約為 6,000 字,適合包括學術論文和技術文件在內的大多數文件類型。該模型僅支援英語——多語應用請使用 jina-colbert-v2。生產部署應實現適當的文件分塊策略,並使用向量相似度索引(FAISS、Qdrant、Weaviate)進行高效檢索。在採用 RAGatouille 等簡化遲交互實現的框架的 RAG 流水線中,該模型尤其有效。如需多語支援或更高精確度,請考慮 jina-colbert-v2 或 jina-embeddings-v4(多向量模式)。

提及此模型的部落格
八月 30, 2024 • 10 分鐘閱讀
Jina ColBERT v2:用於 Embedding 與重排序的多語言後期互動檢索器
Jina ColBERT v2 支援 89 種語言,具有卓越的檢索效能、使用者可控的輸出維度,以及 8192 的 token 長度。
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
六月 19, 2024 • 11 分鐘閱讀
AI 可解釋性變得簡單:Late Interaction 如何使 Jina-ColBERT 具備透明度
AI 的可解釋性和透明度是熱門議題。如果我們看不到 AI 是如何運作的,又怎麼能信任它呢?Jina-ColBERT 向您展示,只要有正確的模型架構,就能輕鬆讓 AI 透露其運作秘密。
Maximilian Werk
Scott Martens
Digital representation of a golden building seen through a blue and yellow mesh pattern, evoking a technological vibe.
五月 13, 2024 • 5 分鐘閱讀
Albus by Springworks:以企業搜尋賦能員工
了解一家領先的人資科技新創公司如何運用 Jina AI 的模型來處理結構化與非結構化資料。
Francesco Kruk
Saahil Ognawala
Albus logo in white on a dark blue background, surrounded by abstract blue shapes and symbols.
四月 29, 2024 • 7 分鐘閱讀
Jina Embeddings 和 Reranker 在 Azure 上的應用:可擴展的企業級 AI 解決方案
Jina Embeddings 和 Rerankers 現已在 Azure Marketplace 上架。重視隱私和安全的企業現在可以輕鬆地將 Jina AI 的最先進模型整合到其現有的 Azure 生態系統中。
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
二月 20, 2024 • 16 分鐘閱讀
什麼是 ColBERT 和晚期交互?為什麼它們在搜尋中如此重要?
Jina AI 在 Hugging Face 上推出的 ColBERT 在 Twitter 上引起熱議,其 8192 token 的處理能力為搜尋領域帶來了新視角。本文將深入解析 ColBERT 和 ColBERTv2 的細節,展示其創新設計,以及為何其後期交互特性在搜尋領域中具有革命性的意義。
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 標誌
open_in_new
下載 Elastic 標誌
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業使用,不面向消費者。