Elastic
Jina AI
Modelli
API
keyboard_arrow_down
Reader
Converti qualsiasi URL in Markdown per un migliore ancoraggio dei LLM.
Embeddings
Embeddings multimodali e multilingue.
Reranker
Reranker per massimizzare la pertinenza dei risultati di ricerca.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenti
data_object
Schema
menu_book
Documenti
Login
login
Embeddings
copyright CC BY-NC 4.0
open_in_new Pubblicazione post

jina-embeddings-v5-text-nano

Incorporamenti multilingue SOTA per l'implementazione edge
Licenza
copyright CC-BY-NC-4.0
Data di rilascio
calendar_month
2026-02-18
Ingresso
abc
Testo
arrow_forward
Produzione
more_horiz
Vettore
Dimensioni Matryoshka help_outline
32
64
128
256
512
768
Dettagli del modello
Parametri: 239M
Lunghezza del token di input: 8K
Dimensione di uscita: 768
Modello base help_outline
open_in_new
EuroBERT-210M
Lingue addestrate help_outline
32 lingue
Lingue supportate help_outline
108 lingue
Quantizzazioni help_outline
GGUF
Supporto Apple Silicon help_outline
MLX
Modelli correlati
link
jina-embeddings-v3
link
jina-embeddings-v5-text-small
Attività supportate
search Recupero
compare_arrows Corrispondenza del testo
bubble_chart Raggruppamento
label Classificazione
Disponibile tramite
Elastic Inference Service
API di Jina
AWS SageMaker
Hugging Face
Air-gapped
Grafico I/O

Testo

jina-embeddings-v5-text-nano

Compito

Vettore

Frontiera di Paretohelp_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nanoParametri (log)nDCG@10
Questo modello
Sulla frontiera
Jina AI
Altri
LongEmbed
63.65
Parametri
212M
Classifica per punteggio
14 / 69
Frontiera di Pareto
Dietro
Distribuzione dei valorihelp_outline
AUC 0.8242
Corpus
Coppie di traduzione
Ricerca documentale
Codice
Immagine / banner
Immagine / logo
Attività
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.7930.400.500.600.700.80
Correlate20.2%
Negativo difficile1.7%
Non correlate1.1%
Soglie consigliate
FPR 0.1 · 0.722
FPR 0.01 · 0.793
FPR 0.001 · 0.841
FPR 0.0001 · 0.865
bilanciata · 0.678
AUC
0.8242
Soglia del rumore
0.840
Crollo del richiamo
0.557
Coppie misurate
119 / 11k
Componenti del vettorehelp_outline
-0.180.000.19
σ 0.0361 · 183k valori
Geometria dell'embeddinghelp_outline
0768
Media per dimensione, passa il cursore per l'intervallo
Rumore di fondo
0.288
Dim. effettive
69 / 768
Troncamento delle dimensionihelp_outline
3264128256512768
text-matching · Soglia per dimensioni richieste
Coppie linguistichehelp_outline
de-ruen-deen-koen-zhja-ko
Dispersione della soglia tra le coppie: 0.027
Scegli i modelli da confrontare
Pubblicazioni (1)
SIGIR 2026
febbraio 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

Panoramica

jina-embeddings-v5-text-nano è un modello di embedding di testo multilingue a 239 milioni di parametri basato sul backbone EuroBERT-210M, un codificatore bidirezionale preaddestrato su 15 delle principali lingue europee e globali. Produce embedding a 768 dimensioni tramite il pooling dell'ultimo token e supporta lunghezze di contesto fino a 32.000 token. Il modello include quattro adattatori LoRA specifici per attività (6,7 milioni di parametri ciascuno) per il recupero, la similarità semantica, il clustering e la classificazione. La tecnologia Matryoshka Representation Learning consente il troncamento dell'embedding a dimensioni ridotte fino a 32. Addestrato utilizzando la distillazione dell'embedding da Qwen3-Embedding-4B seguita dall'addestramento dell'adattatore specifico per attività, il modello raggiunge prestazioni competitive con modelli di dimensioni più che doppie, rendendolo adatto per implementazioni edge e sensibili alla latenza.

Metodi

L'addestramento segue lo stesso processo in due fasi di jina-embeddings-v5-text-small, ma applicato al backbone EuroBERT-210M. La distillazione dell'embedding nella prima fase trasferisce la conoscenza da Qwen3-Embedding-4B utilizzando la perdita di distanza del coseno con un livello di proiezione lineare che mappa gli embedding a 768 dimensioni dello studente nello spazio dell'insegnante. L'addestramento utilizza diverse coppie di testo multilingue provenienti da oltre 300 set di dati. Nella seconda fase, quattro adattatori LoRA specifici per attività (6,7 milioni di parametri ciascuno) vengono addestrati su pesi del backbone congelati: recupero (InfoNCE + distillazione + GOR), corrispondenza del testo (CoSENT + distillazione), clustering (ridistillazione con istruzioni specifiche per l'attività dell'insegnante) e classificazione (InfoNCE bidirezionale + distillazione della conoscenza relazionale). Il backbone EuroBERT offre un'ampia copertura multilingue in 15 principali lingue europee e globali, tra cui inglese, francese, tedesco, spagnolo, cinese, giapponese, arabo e hindi.

Prestazione

Su MMTEB (multilingue), jina-embeddings-v5-text-nano raggiunge una media di 65,5 (a livello di attività) e 57,7 (a livello di tipo) con soli 239 milioni di parametri, superando tutti i modelli con meno di 500 milioni di parametri, inclusi KaLM-mini-v2.5 (60,1, 494 milioni di parametri), voyage-4-nano (58,9, 480 milioni di parametri) e Gemma-300M (61,1, 308 milioni di parametri). Ottiene un punteggio di 69,2 nella classificazione, 52,7 nel clustering, 81,9 nella classificazione di coppie, 64,6 nel reranking, 63,3 nel recupero e 78,2 in STS. Su MTEB inglese, raggiunge una media di 71,0, quasi eguagliando il ben più ampio jina-embeddings-v5-text-small (71,7). Nei benchmark di recupero, ottiene un punteggio di 63,26 su MTEB-M, 64,08 su RTEB, 56,06 su BEIR e 63,65 su LongEmbed. Gli embedding rimangono robusti sotto quantizzazione binaria, con la regolarizzazione GOR che limita il degrado delle prestazioni a meno di 2 punti nel recupero MTEB.

Orientamento

Seleziona l'adattatore LoRA appropriato per la tua attività: "recupero" per la ricerca asimmetrica di query-documenti (anteponi "Query:" alle query e "Documento:" ai passaggi), "corrispondenza di testo" per attività di similarità simmetrica (usa il prefisso "Documento:" per entrambi gli input), "clustering" per raggruppare documenti correlati e "classificazione" per la categorizzazione. Il modello nano è ottimizzato per implementazioni sensibili alla latenza e con risorse limitate, mantenendo al contempo un'accuratezza competitiva con modelli di dimensioni più che doppie. Il troncamento Matryoshka consente di ridurre gli embedding da 768 a un massimo di 32 dimensioni; mantieni le dimensioni superiori a 256 per risultati ottimali. È supportata la quantizzazione binaria. Il backbone EuroBERT offre un'ampia copertura per 15 lingue principali, tra cui inglese, francese, tedesco, spagnolo, cinese, giapponese, arabo e hindi. Utilizza la similarità del coseno per il confronto degli embedding. Disponibile tramite Jina AI API, Hugging Face (Sentence Transformers e vLLM) e varianti quantizzate per llama.cpp.
Blog che menzionano questo modello
maggio 12, 2026 • 7 minuti letti
jina-embeddings-v5-omni: Embeddings for Text, Image, Audio and Video
One model, four modalities: text, image, audio, video. Best-in-class omni embeddings in 1.6B and 0.9B.
Han Xiao
marzo 06, 2026 • 6 minuti letti
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
febbraio 19, 2026 • 7 minuti letti
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
Lingua / tema attuale
Search Foundation
Reader
Embeddings
Reranker
Ottieni la chiave API Jina
Limite di velocità
Chi siamo
Notizia
Scarica il logo Jina
open_in_new
Scarica il logo Elastic
open_in_new
Stato dell'API
Elastic © 2026.SicurezzaTermini & CondizioniPrivacyGestisci i cookieNon vendere né condividere le mie informazioni personali
Questo sito web e tutti i contenuti, software, prodotti e servizi ad esso associati sono destinati esclusivamente all'uso professionale. Non è previsto né raccomandato alcun utilizzo da parte dei consumatori.