Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
warning
此模型已被更新的模型取代。
重排模型
Apache 2.0 许可证
open_in_new 发布博客

jina-reranker-v1-turbo-en

速度与准确率的最佳权衡选择
许可证
Apache-2.0
发布日期
calendar_month
2024-04-18
输入
abc
文本(查询)
abc
文本(文档)
arrow_forward
输出
format_list_numbered
排名
模型详情
参数: 37.8M
输入词元长度: 8K
底座模型 help_outline
link
jina-embeddings-v2-base-en
已训练语言 help_outline
1 种语言
相关模型
link
jina-reranker-v1-base-en
link
jina-reranker-v1-tiny-en
可通过以下方式获取
Jina API
AWS SageMaker
微软云
Hugging Face
物理隔离
I/O 图

多个

文档

查询

jina-reranker-v1

排序

帕累托前沿help_outline
BEIR
LoCo
LlamaIndex RAG · avg3emb
LlamaIndex RAG · avg3emb · MRR
chevron_leftchevron_right
30M100M300M0.810.820.830.84bge-reranker-basejina-reranker-v1-base-enjina-reranker-v1-tiny-enms-marco-MiniLM-L-4-v2ms-marco-MiniLM-L-6-v2mxbai-rerank-base-v1mxbai-rerank-xsmall-v1jina-reranker-v1-turbo-…参数量(对数)hit-rate
本模型
在前沿上
Jina AI
其他
LlamaIndex RAG · avg3emb
0.835
参数量
38M
按分数的排名
2 / 8
帕累托前沿
在前沿上
取值分布help_outline
AUC 0.8287
语料
翻译对
0.4800.000.200.400.600.80
相关29.0%
困难负例7.0%
无关1.1%
推荐阈值
FPR 0.1 · 0.223
FPR 0.01 · 0.480
FPR 0.001 · 0.753
FPR 0.0001 · 0.959
均衡 · 0.083
AUC
0.8287
噪声上限
0.731
召回悬崖
0.019
测量样本对
100 / 9,200
各名次得分help_outline
12345678910
各名次位置上的平均得分
选择要比较的模型

概述

jina-reranker-v1-turbo-en 是一个 37.8M 参数的英语 cross-encoder 重排序模型,在将文档处理速度提升 3 倍、内存使用减少 75% 的同时,提供基线模型 95% 的准确率。它面向完整 cross-encoder 的精度-延迟权衡不切实际的生产搜索系统设计,为大规模搜索优化提供一条实用路径。

方法

该模型将基线重排序器的 12 层 BERT 架构压缩为 37.8M 参数(基线为 137M)的 6 层设计。它保留了用于查询与文档间 token 级交互的核心 BERT cross-attention 机制,但通过减少层数和高效的参数分配来优化速度。训练使用知识蒸馏:更大的基线模型作为教师,引导 turbo 变体以更少的参数匹配其排序行为。该模型通过 ALiBi 位置编码支持最多 8,192 token 的序列,在保持快速推理的同时实现全面的文档分析。

性能

在 BEIR 上,turbo 变体取得 NDCG@10 49.60,保留了基线模型性能(52.45)的 95%,同时优于 bge-reranker-base(47.89,278M 参数)。在 RAG 应用中,它保持 83.51% 的命中率和 0.6498 MRR。速度优势显著:比基线模型快 3 倍,吞吐量随参数减少近乎线性扩展。内存需求从基线的 550MB 降至 turbo 的 150MB,使其能部署在更小的实例上,并在云环境中大幅节省成本。在大多数任务上性能退化极小,在极度细腻的排序场景下得分略低。

最佳实践

实现两阶段流水线:向量搜索提供初始候选,然后该模型对前 100–200 个结果重新排序。大多数应用的最佳平衡点是每个查询重新排序 100–200 个候选,兼顾质量和速度。该模型仅限英语——多语言应用请使用 jina-reranker-v2-base-multilingual 或 jina-reranker-v3.5。它需要支持 CUDA 的硬件,但可在比基线模型更小的实例上运行(GPU 内存 150MB 对比 550MB)。可通过 Jina Reranker API 和 AWS SageMaker 获取。对于新项目,推荐选择 jina-reranker-v3.5(多语言、listwise、131K 上下文)。当延迟是主要约束时,该模型 3 倍的速度优势使其适合实时搜索应用。

提及此模型的博客
五月 07, 2024 • 12 分钟阅读
When AI Makes AI: Synthetic Data, Model Distillation, And Model Collapse
AI creating AI! Is it the end of the world? Or just another tool to make models do value-adding work? Let’s find out!
Scott Martens
Abstract depiction of a brain in purple and pink hues with a fluid, futuristic design against a blue and purple background.
四月 29, 2024 • 7 分钟阅读
Jina Embeddings and Reranker on Azure: Scalable Business-Ready AI Solutions
Jina Embeddings and Rerankers are now available on Azure Marketplace. Enterprises that prioritize privacy and security can now easily integrate Jina AI's state-of-the-art models right in their existing Azure ecosystem.
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
四月 18, 2024 • 7 分钟阅读
Smaller, Faster, Cheaper: Introducing Jina Rerankers Turbo and Tiny
Jina AI announces new reranker models: Jina Rerankers Turbo (jina-reranker-v1-turbo-en) and Tiny (jina-reranker-v1-tiny-en), now available on AWS Sagemaker and Hugging Face, offering faster, memory-efficient, high-performance reranking.
Yuting Zhang
Scott Martens
Four interconnected white wireframe spheres on a deep blue background, symbolizing global networking and technological connec
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。