Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
warning
此模型已被更新的模型取代。
重排模型
Apache 2.0 许可证
open_in_new 发布博客

jina-reranker-v1-tiny-en

最快的重排模型,适合可靠地排序大量文档
许可证
Apache-2.0
发布日期
calendar_month
2024-04-18
输入
abc
文本(查询)
abc
文本(文档)
arrow_forward
输出
format_list_numbered
排名
模型详情
参数: 33M
输入词元长度: 8K
底座模型 help_outline
link
jina-embeddings-v2-base-en
已训练语言 help_outline
1 种语言
相关模型
link
jina-reranker-v1-base-en
link
jina-reranker-v1-turbo-en
可通过以下方式获取
Jina API
AWS SageMaker
微软云
Hugging Face
物理隔离
I/O 图

多个

文档

查询

jina-reranker-v1

排序

帕累托前沿help_outline
BEIR
LoCo
LlamaIndex RAG · avg3emb
LlamaIndex RAG · avg3emb · MRR
chevron_leftchevron_right
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-colbert-v1-enjina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v1-tiny-en参数量(对数)nDCG@10
本模型
在前沿上
Jina AI
其他
LoCo
70.29
参数量
33M
按分数的排名
5 / 6
帕累托前沿
在前沿上
取值分布help_outline
AUC 0.7482
语料
翻译对
0.8760.200.400.600.80
相关4.0%
困难负例2.3%
无关0.4%
推荐阈值
FPR 0.1 · 0.596
FPR 0.01 · 0.876
FPR 0.001 · 0.892
FPR 0.0001 · 0.928
均衡 · 0.280
AUC
0.7482
噪声上限
0.890
召回悬崖
0.198
测量样本对
100 / 9,200
各名次得分help_outline
12345678910
各名次位置上的平均得分
选择要比较的模型

概述

jina-reranker-v1-tiny-en 是一个 33M 参数的英语 cross-encoder 重排序模型——Jina v1 家族中最小的一个。通过激进的知识蒸馏,它在将文档处理速度提升 5 倍、内存使用比 turbo 变体少 13% 的同时,保留了基线模型 92.5% 的准确率。它面向对延迟预算要求严格的边缘计算、移动应用和高吞吐搜索系统设计。

方法

该模型采用基于 JinaBERT 的精简四层架构,使用对称双向 ALiBi 位置编码。其开发利用了来自 137M 参数 jina-reranker-v1-base-en 的知识蒸馏,该模型作为教师模型。学生模型无需大量真实训练数据即可学习最优排序行为,仅用 33M 参数即可匹配教师的软排序分布。四层设计和缩减的隐藏维度实现了对基线模型的 5 倍加速。该模型支持 1,024 token 的上下文,并对较长文档自动分块。

性能

在 BEIR 上,该模型取得 NDCG@10 48.54,保留了基线模型性能(52.45)的 92.5%,而体积仅为后者的四分之一。在 LlamaIndex RAG 基准上,它在显著更快处理文档的同时保持 83.16% 的命中率,几乎与更大的模型相当。吞吐量比基线模型快近 5 倍,内存使用比 turbo 变体少 13%。这些指标可与或超过 mxbai-rerank-base-v1(184M)和 bge-reranker-base(278M)等更大的模型。性能-体积的权衡使其特别适合资源受限的部署。

最佳实践

优先选择处理速度和资源效率至关重要的场景:边缘计算、移动应用以及对延迟预算要求严格的高吞吐搜索系统。对于需要绝对最大排序精度的应用,基线模型或 jina-reranker-v3.5 更合适。该模型需要支持 CUDA 的 GPU 才能达到最佳性能,但可在比更大模型更低的硬件上运行。它与主要向量数据库和 RAG 框架集成,可通过 Jina Reranker API 和 AWS SageMaker 获取。该模型仅限英语;多语言应用请使用 jina-reranker-v2-base-multilingual 或 jina-reranker-v3.5。针对特定领域微调时,请仔细平衡训练数据质量与模型的精简架构,以保持性能特性。

提及此模型的博客
五月 07, 2024 • 12 分钟阅读
When AI Makes AI: Synthetic Data, Model Distillation, And Model Collapse
AI creating AI! Is it the end of the world? Or just another tool to make models do value-adding work? Let’s find out!
Scott Martens
Abstract depiction of a brain in purple and pink hues with a fluid, futuristic design against a blue and purple background.
四月 29, 2024 • 7 分钟阅读
Jina Embeddings and Reranker on Azure: Scalable Business-Ready AI Solutions
Jina Embeddings and Rerankers are now available on Azure Marketplace. Enterprises that prioritize privacy and security can now easily integrate Jina AI's state-of-the-art models right in their existing Azure ecosystem.
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
四月 18, 2024 • 7 分钟阅读
Smaller, Faster, Cheaper: Introducing Jina Rerankers Turbo and Tiny
Jina AI announces new reranker models: Jina Rerankers Turbo (jina-reranker-v1-turbo-en) and Tiny (jina-reranker-v1-tiny-en), now available on AWS Sagemaker and Hugging Face, offering faster, memory-efficient, high-performance reranking.
Yuting Zhang
Scott Martens
Four interconnected white wireframe spheres on a deep blue background, symbolizing global networking and technological connec
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。