Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Reader
Convertissez n'importe quelle URL en Markdown pour un meilleur grounding des LLM.
Embeddings
Embeddings multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login
warning
Ce modèle est obsolète pour les modèles plus récents.
Reclasseur
Licence Apache 2.0
open_in_new Article de lancement

jina-reranker-v1-tiny-en

Le modèle de reclassement le plus rapide, le mieux adapté pour classer un grand nombre de documents de manière fiable
Licence
Apache-2.0
Date de sortie
calendar_month
2024-04-18
Saisie
abc
Texte (requête)
abc
Texte (Document)
arrow_forward
Sortir
format_list_numbered
Classements
Détails du modèle
Paramètres: 33M
Longueur du token d'entrée: 8K
Modèle de base help_outline
link
jina-embeddings-v2-base-en
Langues enseignées help_outline
1 langues
Modèles associés
link
jina-reranker-v1-base-en
link
jina-reranker-v1-turbo-en
Disponible via
API Jina
AWS SageMaker
Microsoft Azure
Hugging Face
Air-gapped
Graphique d'E/S

multiple

Document

Requête

jina-reranker-v1

Classement

Frontière de Paretohelp_outline
BEIR
LoCo
LlamaIndex RAG · avg3emb
LlamaIndex RAG · avg3emb · MRR
chevron_leftchevron_right
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-colbert-v1-enjina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v1-tiny-enParamètres (log)nDCG@10
Ce modèle
Sur la frontière
Jina AI
Autres
LoCo
70.29
Paramètres
33M
Rang par score
5 / 6
Frontière de Pareto
Sur elle
Distribution des valeurshelp_outline
AUC 0.7482
Corpus
Paires de traduction
0.8760.200.400.600.80
Liées4.0%
Négatif difficile2.3%
Non liées0.4%
Seuils recommandés
FPR 0.1 · 0.596
FPR 0.01 · 0.876
FPR 0.001 · 0.892
FPR 0.0001 · 0.928
équilibré · 0.280
AUC
0.7482
Plafond de bruit
0.890
Décrochage du rappel
0.198
Paires mesurées
100 / 9,200
Score par ranghelp_outline
12345678910
Score moyen à chaque position de rang
Choisissez les modèles à comparer

Aperçu

jina-reranker-v1-tiny-en est un reranker cross-encodeur anglais de 33M paramètres — le plus petit de la famille v1 de Jina. Grâce à une distillation de connaissances agressive, il conserve 92,5 % de la précision du modèle de base tout en traitant les documents cinq fois plus vite et en utilisant 13 % de mémoire en moins que la variante turbo. Il est conçu pour l'edge computing, les applications mobiles et les systèmes de recherche à fort débit avec des budgets de latence stricts.

Méthodes

Le modèle emploie une architecture allégée de quatre couches basée sur JinaBERT avec des encodings positionnels ALiBi bidirectionnels symétriques. Son développement exploite la distillation de connaissances depuis jina-reranker-v1-base-en de 137M paramètres, qui sert de modèle enseignant. Le modèle élève apprend des comportements de classement optimaux sans exiger d'amples données d'entraînement du monde réel, en égalant les distributions de classement douces de l'enseignant tout en n'utilisant que 33M paramètres. La conception en quatre couches et les dimensions cachées réduites permettent l'accélération de 5× par rapport au modèle de base. Le modèle prend en charge un contexte de 1 024 tokens avec un découpage automatique pour les documents plus longs.

Performance

Sur BEIR, le modèle atteint un NDCG@10 de 48,54, conservant 92,5 % des performances du modèle de base (52,45) tout en ne faisant qu'un quart de sa taille. Dans les benchmarks RAG de LlamaIndex, il maintient un taux de rappel de 83,16 %, rivalisant de près avec des modèles plus grands tout en traitant les documents nettement plus vite. Le débit est presque cinq fois plus rapide que le modèle de base, avec 13 % d'utilisation mémoire en moins que la variante turbo. Ces métriques rivalisent ou dépassent des modèles bien plus grands comme mxbai-rerank-base-v1 (184M) et bge-reranker-base (278M). Le compromis performance-taille le rend particulièrement adapté aux déploiements aux ressources limitées.

Conseils

Priorisez les scénarios où la vitesse de traitement et l'efficacité des ressources sont critiques : edge computing, applications mobiles et systèmes de recherche à fort débit avec des budgets de latence stricts. Pour les applications exigeant une précision de classement maximale absolue, le modèle de base ou jina-reranker-v3.5 est préférable. Le modèle requiert une GPU compatible CUDA pour des performances optimales, mais fonctionne sur un matériel moins puissant que ses homologues plus grands. Il s'intègre aux bases de données vectorielles et frameworks RAG majeurs et est disponible via l'API Reranker de Jina et AWS SageMaker. Le modèle est uniquement anglais ; pour les applications multilingues, utilisez jina-reranker-v2-base-multilingual ou jina-reranker-v3.5. Lors de l'affinage pour des domaines spécifiques, équilibrez soigneusement la qualité des données d'entraînement avec l'architecture compacte du modèle pour préserver ses caractéristiques de performance.

Blogs qui mentionnent ce modèle
mai 07, 2024 • 12 minutes lues
When AI Makes AI: Synthetic Data, Model Distillation, And Model Collapse
AI creating AI! Is it the end of the world? Or just another tool to make models do value-adding work? Let’s find out!
Scott Martens
Abstract depiction of a brain in purple and pink hues with a fluid, futuristic design against a blue and purple background.
avril 29, 2024 • 7 minutes lues
Jina Embeddings and Reranker on Azure: Scalable Business-Ready AI Solutions
Jina Embeddings and Rerankers are now available on Azure Marketplace. Enterprises that prioritize privacy and security can now easily integrate Jina AI's state-of-the-art models right in their existing Azure ecosystem.
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
avril 18, 2024 • 7 minutes lues
Smaller, Faster, Cheaper: Introducing Jina Rerankers Turbo and Tiny
Jina AI announces new reranker models: Jina Rerankers Turbo (jina-reranker-v1-turbo-en) and Tiny (jina-reranker-v1-tiny-en), now available on AWS Sagemaker and Hugging Face, offering faster, memory-efficient, high-performance reranking.
Yuting Zhang
Scott Martens
Four interconnected white wireframe spheres on a deep blue background, symbolizing global networking and technological connec
Langue / thème actuel
Search Foundation
Reader
Embeddings
Reclasseur
Obtenir la clé API Jina
Limite de débit
À propos de nous
Actualités
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.SécuritéTermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, de ses logiciels, produits et services sont destinés exclusivement à un usage professionnel. Aucun usage à des fins de consommation n'est prévu.