Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
重排模型
copyright CC BY-NC 4.0
open_in_new 发布博客

jina-reranker-m0

用于对视觉文档排序的多语言多模态重排模型
许可证
copyright CC-BY-NC-4.0
发布日期
calendar_month
2025-04-08
输入
abc
文本(查询)
image
图片(查询)
abc
文本(文档)
image
图片(文档)
arrow_forward
输出
format_list_numbered
排名
模型详情
参数: 2.4B
输入词元长度: 10K
输入图像尺寸: 768×28×28
底座模型 help_outline
open_in_new
Qwen2-VL-2B
open_in_new
DFN CLIP ViT
已训练语言 help_outline
24 种语言
支持的语言 help_outline
29 种语言
量化 help_outline
GGUF
相关模型
link
jina-reranker-v2-base-multilingual
可通过以下方式获取
Jina API
AWS SageMaker
微软云
谷歌云
Hugging Face
物理隔离
I/O 图 1

多个

文本

文本

jina-reranker-m0

排序

I/O 图 2

多个

图片

文本

jina-reranker-m0

排序

I/O 图 3

多个

文本

图片

jina-reranker-m0

排序

I/O 图 4

多个

图片

图片

jina-reranker-m0

排序

帕累托前沿 help_outline
workspace_premium
BEIR
MIRACL
ViDoRe v1
chevron_leftchevron_right
300M1B3.0B10B707580859095Argus-Colqwen3.5-2b-v0Argus-Colqwen3.5-9b-v0ColFlorColModernVBERTcolnomic-embed-multimod…colpali-v1.1ColPali-v1.2colpali-v1.3colqwen2-v1.0colSmol-256McolSmol-500MMonoQwen2-VL-v0.1SauerkrautLM-ColQwen3-1…SauerkrautLM-ColQwen3-2…参数量(对数)nDCG@5
本模型
在前沿上
Jina AI
其他
ViDoRe v1
91.02
参数量
2.4B
按分数的排名
7 / 24
帕累托前沿
在前沿之后
取值分布help_outline
AUC 0.9383
语料
翻译对
文档检索
代码
图片 / 头图
图片 / 标识
0.7120.200.400.600.801.00
相关83.2%
困难负例24.7%
无关9.3%
推荐阈值
FPR 0.1 · 0.712
FPR 0.01 · 0.938
FPR 0.001 · 0.968
FPR 0.0001 · 0.972
均衡 · 0.692
AUC
0.9383
噪声上限
0.965
召回悬崖
0.425
测量样本对
119 / 2,856
各名次得分help_outline
12345678910
各名次位置上的平均得分
谁排在第一位help_outline
119 个查询中有 66% 由正确结果夺得第一
选择要比较的模型

概述

jina-reranker-m0 是一个基于视觉语言模型架构的 2.4B 参数多模态多语言重排序模型。它是首个处理多语言视觉文档(文本、图片、表格、图表)的重排序器,在 ViDoRe(NDCG-5 91.02)和多语言长文档检索(MLDR)上取得 SOTA 性能。该模型支持文本-文本、文本-图像、图像-文本和混合模态的重排序。

方法

该模型基于 decoder-only VLM 架构(2.4B 参数),结合 DFN CLIP ViT 视觉编码器和 Qwen2 语言解码器。与仅处理文本的传统 cross-encoder 不同,VLM 骨干原生处理文本和图像输入,使包含视觉内容(扫描 PDF、信息图、幻灯片、带嵌入图片的表格)的文档可以进行重排序。10K token 上下文窗口可容纳每图像最多 768 个 token(以 768×28×28 的 patch 处理)。训练使用跨多语言、多种文档类型的多模态对比目标。decoder-only 架构使 listwise 重排序成为可能,并为文档去重和基于注意力机制的排序分数可解释性打开可能性——这些是 encoder-only 架构无法提供的能力。

性能

在文本-文本重排序中,该模型在 BEIR 上取得 NDCG-10 58.95,超越了 jina-embeddings-v3(55.81)和 bge-reranker-v2-m3(56.51)。对于多语言内容,它在 MIRACL(18 种语言)上取得 NDCG-10 66.75。在长文档的 MLDR 基准上,它在 13 种语言上取得 NDCG-10 59.83。代码检索在 CoIR 上达到 NDCG-10 63.55。该模型在视觉文档检索中表现出色:ViDoRe 上 NDCG-5 91.02,Winoground(视觉-语言组合推理)上平均 43.92。某些模态组合(如图像-图像)在零样本模式下受支持,无需特定训练数据。

最佳实践

该模型可通过 Jina API、AWS、Azure、GCP 市场或本地通过 Hugging Face 访问。使用 API 时,传递文本字符串、base64 图像或图像 URL——新用户获得 10M 免费 token。该模型支持最多 10K 输入 token,每图像最多 768 个 token。为了最佳效果,该模型在文本-文本、文本-图像、图像-文本和文本-混合模态任务上表现最佳;图像-图像为零样本。decoder-only 架构使简单重排序之外的能力成为可能:混合模态重排序、listwise 重排序、文档去重和基于注意力的排序可解释性。当您的文档包含文本专用重排序器无法处理的视觉内容(扫描 PDF、图表、信息图)时,请使用该模型。为了更低成本的纯文本重排序,请使用 jina-reranker-v3.5。

提及此模型的博客
十月 03, 2025 • 7 分钟阅读
Jina Reranker v3:用于 SOTA 多语言检索的 0.6B Listwise 重排器
全新 0.6B 参数的 listwise 重排器,可在单个上下文窗口中考虑查询和所有候选文档。
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
八月 13, 2025 • 15 分钟阅读
针对仅解码器向量模型的 GGUF 优化
在 L4 GPU 上,一个 30 亿参数的向量模型达到 4000 词元/秒的速度,这可能已经是使用 llama.cpp 所能达到的最快速度了。真的是这样吗?
Han Xiao
Text "DGUF for Embedding Models" written in yellow on a dark background, conveying a sleek, minimalistic, digital design.
七月 14, 2025 • 11 分钟阅读
用于文本选择、段落重排和上下文工程的子模优化
当其他人还在依赖提示词调整并祈祷好运时,你应该学习子模优化,它提供了一个有原则的框架,并具有理论保证,从而实现更好的上下文工程。
Han Xiao
Network illustration of interconnected hexagons, some solid and some hollow blue, connected by red lines indicating paths or
六月 25, 2025 • 12 分钟阅读
Jina 向量模型 (Embeddings) v4:用于多模态多语言检索的通用向量模型 (Embeddings)
Jina 向量模型 (Embeddings) v4 是一个拥有 38 亿参数的通用向量模型 (embedding model),用于多模态和多语言检索,支持单向量和多向量向量模型 (embedding) 输出。
Jina AI
Word "Embeddings" followed by a numeric or symbol representation, displayed in multiple colors on a technology-themed, colorf
五月 25, 2025 • 8 分钟阅读
使用 jina-reranker-m0 对多模态文档进行公平评分
文本相似度:0.7。图像相似度:0.5。哪个文档更相关?你根本无法判断——而这正是打破多模态搜索的核心问题。我们用统一重排 (unified reranking) 解决它。
Nan Wang
Alex C-G
Stacked glowing green ovals on a background transitioning from black to green, with the top oval having an unusual, split sha
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。