Elastic
Jina AI
Modelle
API
keyboard_arrow_down
Reader
Konvertieren Sie jede URL in Markdown für besseres Grounding von LLMs.
Einbettungen
Multimodale, mehrsprachige Einbettungen.
Reranker
Reranker zur Maximierung der Suchrelevanz.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenten
data_object
Schema
menu_book
Dokumente
Einloggen
login
Einbettungen
copyright CC BY-NC 4.0
open_in_new Beitrag veröffentlichen

jina-embeddings-v5-text-nano

SOTA-Mehrsprachigkeitseinbettungen für den Edge-Einsatz
Lizenz
copyright CC-BY-NC-4.0
Veröffentlichungsdatum
calendar_month
2026-02-18
Eingang
abc
Text
arrow_forward
Ausgabe
more_horiz
Vektor
Matryoshka-Dimensionen help_outline
32
64
128
256
512
768
Modelldetails
Parameter: 239M
Länge des Eingabetokens: 8K
Ausgabedimension: 768
Basismodell help_outline
open_in_new
EuroBERT-210M
Ausgebildete Sprachen help_outline
32 Sprachen
Unterstützte Sprachen help_outline
108 Sprachen
Quantisierungen help_outline
GGUF
Apple Silicon-Unterstützung help_outline
MLX
Ähnliche Modelle
link
jina-embeddings-v3
link
jina-embeddings-v5-text-small
Unterstützte Aufgaben
search Abruf
compare_arrows Textabgleich
bubble_chart Clustering
label Einstufung
Erhältlich über
Elastic Inference Service
Jina-API
AWS SageMaker
Hugging Face
Air-Gapped
E/A-Diagramm

Text

jina-embeddings-v5-text-nano

Aufgabe

Vektor

Pareto-Fronthelp_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nanoParameter (log)nDCG@10
Dieses Modell
Auf der Front
Jina AI
Andere
LongEmbed
63.65
Parameter
212M
Rang nach Score
14 / 69
Pareto-Front
Dahinter
Werteverteilunghelp_outline
AUC 0.8242
Korpus
Übersetzungspaare
Dokumentensuche
Code
Bild / Banner
Bild / Logo
Aufgabe
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.7930.400.500.600.700.80
Verwandt20.2%
Hartes Negativ1.7%
Unverwandt1.1%
Empfohlene Schwellenwerte
FPR 0.1 · 0.722
FPR 0.01 · 0.793
FPR 0.001 · 0.841
FPR 0.0001 · 0.865
ausgewogen · 0.678
AUC
0.8242
Rauschgrenze
0.840
Recall-Kante
0.557
Gemessene Paare
119 / 11k
Vektorkomponentenhelp_outline
-0.180.000.19
σ 0.0361 · 183k Werte
Einbettungsgeometriehelp_outline
0768
Mittelwert je Dimension, für den Bereich überfahren
Rauschboden
0.288
Effektive Dim.
69 / 768
Dimensionskürzunghelp_outline
3264128256512768
text-matching · Schwellenwert nach angeforderten Dimensionen
Sprachpaarehelp_outline
de-ruen-deen-koen-zhja-ko
Streuung des Schwellenwerts über die Paare: 0.027
Wählen Sie Modelle zum Vergleichen aus
Publikationen (1)
SIGIR 2026
Februar 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

Überblick

jina-embeddings-v5-text-nano ist ein mehrsprachiges Text-Embedding-Modell mit 239 Millionen Parametern, das auf dem EuroBERT-210M-Backbone basiert, einem bidirektionalen Encoder, der für 15 wichtige europäische und globale Sprachen vortrainiert wurde. Es erzeugt 768-dimensionale Embeddings mittels Last-Token-Pooling und unterstützt Kontextlängen von bis zu 32.000 Token. Das Modell umfasst vier aufgabenspezifische LoRA-Adapter (jeweils 6,7 Millionen Parameter) für Retrieval, semantische Ähnlichkeit, Clustering und Klassifizierung. Matryoshka Representation Learning ermöglicht die Reduzierung der Embedding-Dimension auf bis zu 32. Durch das Training mit Embedding-Destillation von Qwen3-Embedding-4B und anschließendem Training der aufgabenspezifischen Adapter erzielt das Modell eine mit Modellen vergleichbare Leistung, die mehr als doppelt so groß sind. Dadurch eignet es sich für latenzkritische Anwendungen und Edge-Computing.

Methoden

Das Training folgt dem gleichen zweistufigen Prozess wie jina-embeddings-v5-text-small, wird jedoch auf das EuroBERT-210M-Backbone angewendet. In der ersten Stufe, der Embedding-Destillation, wird Wissen aus Qwen3-Embedding-4B mithilfe des Cosinusdistanzverlusts und einer linearen Projektionsschicht übertragen, die die 768-dimensionalen Embeddings des Lernenden in den Raum des Lehrers abbildet. Für das Training werden diverse mehrsprachige Textpaare aus über 300 Datensätzen verwendet. In der zweiten Stufe werden vier aufgabenspezifische LoRA-Adapter (jeweils 6,7 Millionen Parameter) mit den eingefrorenen Backbone-Gewichten trainiert: Retrieval (InfoNCE + Destillation + GOR), Textvergleich (CoSENT + Destillation), Clustering (erneute Destillation mit aufgabenspezifischen Anweisungen des Lehrers) und Klassifizierung (bidirektionales InfoNCE + relationale Wissensdestillation). Das EuroBERT-Backbone bietet eine starke mehrsprachige Abdeckung für 15 wichtige europäische und globale Sprachen, darunter Englisch, Französisch, Deutsch, Spanisch, Chinesisch, Japanisch, Arabisch und Hindi.

Leistung

Auf MMTEB (mehrsprachig) erreicht jina-embeddings-v5-text-nano mit nur 239 Millionen Parametern einen Durchschnittswert von 65,5 (Aufgabenebene) und 57,7 (Typenebene) und übertrifft damit alle Modelle mit weniger als 500 Millionen Parametern, darunter KaLM-mini-v2.5 (60,1, 494 Millionen Parameter), voyage-4-nano (58,9, 480 Millionen Parameter) und Gemma-300M (61,1, 308 Millionen Parameter). Die Werte liegen bei 69,2 für Klassifizierung, 52,7 für Clustering, 81,9 für Paarklassifizierung, 64,6 für Reranking, 63,3 für Retrieval und 78,2 für STS. Auf englischem MTEB erzielt es einen Durchschnittswert von 71,0 und erreicht damit nahezu den Wert des deutlich größeren Modells jina-embeddings-v5-text-small (71,7). Bei Retrieval-Benchmarks erzielt es 63,26 Punkte bei MTEB-M, 64,08 Punkte bei RTEB, 56,06 Punkte bei BEIR und 63,65 Punkte bei LongEmbed. Die Einbettungen bleiben auch unter binärer Quantisierung robust, wobei die GOR-Regularisierung den Leistungsabfall beim MTEB-Retrieval auf unter 2 Punkte begrenzt.

Anleitung

Wählen Sie den passenden LoRA-Adapter für Ihre Aufgabe: „retrieval“ für die asymmetrische Query-Dokument-Suche (fügen Sie „Query:“ vor Suchanfragen und „Document:“ vor Passagen ein), „text-matching“ für symmetrische Ähnlichkeitsaufgaben (verwendet das Präfix „Document:“ für beide Eingaben), „clustering“ zum Gruppieren verwandter Dokumente und „classification“ zur Kategorisierung. Das Nano-Modell ist für latenzkritische und ressourcenbeschränkte Umgebungen optimiert und bietet dabei eine vergleichbare Genauigkeit wie Modelle, die mehr als doppelt so groß sind. Die Matryoshka-Trunkierung ermöglicht die Reduzierung der Embeddings von 768 auf bis zu 32 Dimensionen; für optimale Ergebnisse sollten die Dimensionen über 256 liegen. Binäre Quantisierung wird unterstützt. Das EuroBERT-Backbone bietet eine umfassende Abdeckung für 15 wichtige Sprachen, darunter Englisch, Französisch, Deutsch, Spanisch, Chinesisch, Japanisch, Arabisch und Hindi. Verwenden Sie die Kosinusähnlichkeit für den Embedding-Vergleich. Verfügbar über die Jina AI API, Hugging Face (Sentence Transformers und vLLM) sowie quantisierte Varianten für llama.cpp.
Blogs, die dieses Modell erwähnen
Mai 12, 2026 • 7 Minuten gelesen
jina-embeddings-v5-omni: Embeddings for Text, Image, Audio and Video
One model, four modalities: text, image, audio, video. Best-in-class omni embeddings in 1.6B and 0.9B.
Han Xiao
März 06, 2026 • 6 Minuten gelesen
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
Februar 19, 2026 • 7 Minuten gelesen
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
Aktuelle Sprache / Design
Search Foundation
Reader
Einbettungen
Reranker
Jina API-Schlüssel abrufen
Ratenbegrenzung
Über uns
Pressemitteilungen
Jina-Logo herunterladen
open_in_new
Elastic-Logo herunterladen
open_in_new
API-Status
Elastic © 2026.SicherheitAGBPrivatsphäreCookie-EinstellungenMeine persönlichen Daten nicht verkaufen oder weitergeben
Diese Website und alle zugehörigen Inhalte, Software, Produkte und Dienstleistungen sind ausschließlich für den professionellen Gebrauch bestimmt. Eine Nutzung durch Endverbraucher ist weder vorgesehen noch empfohlen.