I/O 図

複数

ドキュメント

クエリ

jina-reranker-v1

ランキング

パレートフロン
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-colbert-v1-enjina-reranker-v1-tiny-enjina-reranker-v1-turbo-…jina-reranker-v1-base-enパラメータ数(対数)nDCG@10
このモデル
フロン上
Jina AI
その他
LoCo
87.31
パラメータ
137M
スコア順位
2 / 6
パレートフロン
フロン上
値の分布
AUC 0.9853
コーパス
翻訳ペア
0.4810.000.200.400.600.801.00
関連85.0%
ハードネガティブ6.3%
無関連1.1%
推奨しきい値
FPR 0.1 · 0.208
FPR 0.01 · 0.481
FPR 0.001 · 0.697
FPR 0.0001 · 0.978
バランス · 0.340
AUC
0.9853
ノイズ上限
0.691
再現率の崖
0.088
測定ペア数
100 / 9,200
順位別スコア
12345678910
各順位での平均スコア
比較するモデルを選択してください

概要

jina-reranker-v1-base-en137M パラメータの英語クロスエンコーダーリランカーで、クエリと文書のペアに対するトークンレベル解析により検索結果を精査します。ベースラインのベクトル検索に対して検索精度を 20 % 向上させ、Jina の第1世代リランカーファミリーの主力となりました。現在は、多言語 v2 とリストワイズ v3 のファミリーに取って代わられています。

方法

モデルは BERT ベースのクロスアテンションアーキテクチャ(12 層、12 アテンションヘッド、768 隠れ次元、137M パラメータ)を採用し、embeddings ベースのアプローチと根本的に異なります。事前計算された文書 embeddings の比較ではなく、クエリと文書間で動的なトークンレベルの相互作用を行い、コサイン類似度が見逃すコンテキストのニュアンスを捕捉します。1,024 トークンのコンテキストウィンドウは、長い文書の自動チャンキングとチャンク間の max-pooling をサポートします。訓練は、ハードネガティブマイニングを用いたクエリ-文書関連ペアでのコントラスティブ損失を使用しました。このモデルは最初の Jina リランカーであり、ナレッジ蒸留により turbo と tiny バリアントのパターンを確立しました。

パフォーマンス

モデルはベースラインのベクトル検索に対してヒット率 8 % 向上、平均相互順位 33 % 向上を達成します。BEIR では平均 NDCG{'@'}10 が 0.5588 で、BGE(0.5032)、BCE(0.4969)、Cohere(0.5141)を上回ります。長いコンテキスト理解の LoCo ベンチマークでは 0.873 を記録し、競合に大きく先行しています。技術コンテンツに特に強く、QASPER 要旨では 0.996、政府報告書解析では 0.962 ながら、会議要約タスクでは低め(0.466)です。レイテンシは文書長に比例します:256 トークンで 156 ms、512 トークンのクエリで 4,096 トークンでは 7,068 ms。

ベストプラクティス

二段階パイプラインを実装してください:ベクトル検索(例:jina-embeddings-v5-text-small)が初期候補を提供し、このモデルが上位 100–200 件を再ランキングして精度を向上させます。本モデルは英語のみ — 多言語アプリケーションには jina-reranker-v2-base-multilingual または jina-reranker-v3.5 を使用してください。本番のスループットには CUDA 対応ハードウェアが必要です。新規プロジェクトには jina-reranker-v3.5(多言語、リストワイズ、131K コンテキスト、BEIR NDCG{'@'}10 63.20)を推奨します。本モデルは Jina Reranker API、AWS SageMaker、Hugging Face で利用可能です。RAG システムとの統合時は、レイテンシ要件に基づいて再ランキングに渡す文書数を調整してください — 100–200 文書が通常、品質と速度のバランスを取ります。

このモデルについて言及しているブログ
6月 25, 2024 • 15 読む時間
エージェント型 RAG のための Jina Reranker v2:超高速・多言語対応・関数呼び出し&コード検索
Jina Reranker v2 は、Agentic RAG 向けに構築された最高クラスの reranker です。function-calling をサポートし、100 以上の言語に対応した多言語検索機能、コード検索機能を備え、v1 と比較して 6 倍の高速化を実現しています。
6月 03, 2024 • 6 読む時間
Jina AI と Milvus Lite を使用したチャット履歴 RAG の実装
Jina Embeddings と Reranker、そして軽量で導入が簡単な Milvus Lite を使用して、Python の検索アプリケーションを強化しましょう。
5月 13, 2024 • 5 読む時間
Albus by Springworks:エンタープライズ検索で従業員を支援する
大手 HR テック企業が、構造化データと非構造化データを扱うために Jina AI のモデルをどのように活用しているかを説明します。
5月 07, 2024 • 12 読む時間
AI が AI を生み出すとき:合成データ、モデル蒸留、モデル崩壊
AIがAIを生み出す!世界の終わりなのでしょうか?あるいは単に、モデルに価値を生み出す仕事をさせるためのもう1つのツールなのでしょうか?一緒に見ていきましょう!
4月 29, 2024 • 7 読む時間
Azure 上の Jina Embeddings と Reranker:スケーラブルなビジネス向け AI ソリューション
Jina Embeddings および Rerankers が Azure Marketplace で利用可能になりました。プライバシーとセキュリティを重視する企業は、Jina AI の最先端モデルを既存の Azure エコシステムに簡単に統合できるようになりました。