Elastic
Jina AI
Modelli
API
keyboard_arrow_down
Reader
Converti qualsiasi URL in Markdown per un migliore ancoraggio dei LLM.
Embeddings
Embeddings multimodali e multilingue.
Reranker
Reranker per massimizzare la pertinenza dei risultati di ricerca.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenti
data_object
Schema
menu_book
Documenti
Login
login
warning
Questo modello è obsoleto nei modelli più recenti.
Embeddings
Licenza Apache 2.0
open_in_new Post di rilascio

jina-embeddings-v2-base-en

Alla pari con text-embedding-ada002 di OpenAI
Licenza
Apache-2.0
Data di rilascio
calendar_month
2023-10-28
Ingresso
abc
Testo
arrow_forward
Produzione
more_horiz
Vettore
Chunking tardivo help_outline
check_circle
Yes
Dettagli del modello
Parametri: 137M
Lunghezza del token di input: 8K
Dimensione di uscita: 768
Lingue addestrate help_outline
1 lingue
Modelli correlati
link
jina-embedding-b-en-v1
link
jina-embeddings-v3
Disponibile tramite
API di Jina
AWS SageMaker
Microsoft Azure
Hugging Face
Air-gapped
Grafico I/O

Testo

jina-embeddings-v2-base-en

Vettore

Frontiera di Paretohelp_outline
MTEB English
RTEB public
LongEmbed
LoCo
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nanojina-embeddings-v2-base…Parametri (log)nDCG@10
Questo modello
Sulla frontiera
Jina AI
Altri
LongEmbed
58.12
Parametri
137M
Classifica per punteggio
18 / 69
Frontiera di Pareto
Dietro
Distribuzione dei valorihelp_outline
AUC 0.8376
Corpus
Coppie di traduzione
Ricerca documentale
0.8500.600.700.800.90
Correlate26.9%
Negativo difficile2.7%
Non correlate1.1%
Soglie consigliate
FPR 0.1 · 0.793
FPR 0.01 · 0.850
FPR 0.001 · 0.894
FPR 0.0001 · 0.914
bilanciata · 0.762
AUC
0.8376
Soglia del rumore
0.893
Crollo del richiamo
0.691
Coppie misurate
119 / 11k
Componenti del vettorehelp_outline
-0.14-0.000.14
σ 0.0361 · 183k valori
Geometria dell'embeddinghelp_outline
0768
Media per dimensione, passa il cursore per l'intervallo
Rumore di fondo
0.751
Dim. effettive
59 / 768
Scegli i modelli da confrontare
Pubblicazioni (1)
arXiv
ottobre 30, 2023
Jina Embeddings 2: 8192-Token General-Purpose Text Embeddings for Long Documents

Panoramica

jina-embeddings-v2-base-en è un modello di embedding del testo inglese da 137M parametri con una finestra di contesto di 8.192 token: 16 volte il limite standard di 512 token della sua epoca. Costruito su un backbone BERT-small con ALiBi bidirezionale simmetrica (Attention with Linear Biases), è stato il primo embedding Jina open source in grado di gestire nativamente documenti lunghi senza troncatura né chunking. Produce vettori a 768 dimensioni e resta una scelta solida per la retrieval solo in inglese quando non sono necessarie le funzionalità multilingua o di lungo contesto di v3/v5.

Metodi

L'architettura abbina un transformer BERT-small (12 layer, 12 teste di attenzione, 768 dimensioni nascoste) a codifiche posizionali ALiBi bidirezionali simmetriche. ALiBi sostituisce gli embedding posizionali appresi con un bias di attenzione a decadimento lineare, permettendo al modello di estrapolare ben oltre la sua lunghezza di addestramento di 512 token fino a 8.192 token senza degradazione delle prestazioni. L'addestramento ha seguito una pipeline a due stadi: pre-addestramento su C4, poi fine-tuning sulla collezione curata da Jina di 40+ dataset di coppie di frasi specializzate con mining di negativi difficili. L'attenzione bidirezionale simmetrica assicura che ogni token presti attenzione sia al contesto precedente che a quello successivo, producendo rappresentazioni che catturano il significato globale della frase. Il mean pooling su tutte le rappresentazioni di token produce l'embedding finale a 768 dimensioni.

Prestazione

Al rilascio, il modello ha superato text-embedding-ada-002 di OpenAI su diversi sotto-task MTEB in inglese: classificazione (73,45 % vs 70,93 %), reranking (85,38 % vs 84,89 %), retrieval (56,98 % vs 56,32 %) e riassunto (31,6 % vs 30,8 %). Il suo contesto di 8.192 token è stato un vantaggio significativo rispetto ai modelli concorrenti limitati a 512–2.048 token, abilitando la retrieval a livello di documento senza chunking. Il compatto footprint di 307MB lo rese deployabile su GPU di fascia consumer. Nel 2026, jina-embeddings-v5-text-small (677M parametri, contesto di 32K, adattatori LoRA specifici per il task) lo supera per la maggior parte dei carichi di lavoro di produzione, ma resta rilevante per pipeline leggere solo in inglese.

Orientamento

Usa questo modello per la retrieval solo in inglese quando la finestra di contesto di 8K è sufficiente e non sono necessari adattatori multilingua o specifici per il task. Per documenti che superano 8.192 token, applica il chunking semantico prima dell'embedding. Il modello si integra con i principali database vettoriali (Qdrant, Weaviate, MongoDB Atlas, Milvus) e framework RAG (LangChain, LlamaIndex, Haystack). Per nuovi progetti che richiedono supporto multilingua, contesto di 32K o ottimizzazione specifica per il task, preferisci jina-embeddings-v5-text-small. GPU con supporto CUDA consigliata per il throughput di produzione; l'inferenza su CPU è possibile ma nettamente più lenta.

Blog che menzionano questo modello
dicembre 17, 2024 • 12 minuti letti
Text Embeddings Fail to Capture Word Order and How to Fix It
Text embedding models struggle with capturing subtle linguistic nuances like word order, directional relationships, temporal sequences, causal connections, comparisons, and negation. Understanding these challenges is key to improving model performance.
Bo Wang
Alex C-G
Three abstract figures in white, gray, and pink on matching cubes placed on a colorful checkered surface against a green back
ottobre 25, 2024 • 19 minuti letti
Finding Optimal Breakpoints in Long Documents Using Small Language Models
We trained three small language models to better segment long documents into chunks, and here are the key lessons we learned.
Andrei Ungureanu
Alex C-G
A pattern of yellow file icons on a blue background with one icon displaying a smiley face creating an emotive contrast.
ottobre 15, 2024 • 9 minuti letti
Fact-Checking with New Grounding API in Jina Reader
With the new g.jina.ai, you can easily ground statements to reduce LLM hallucinations or improve the integrity of human-written content.
Jina AI
Jina developer interface showing "Jina AI was founded in 2020" with controls labeled true and false, and web address on top.
settembre 27, 2024 • 15 minuti letti
Migration From Jina Embeddings v2 to v3
We collected some tips to help you migrate from Jina Embeddings v2 to v3.
Alex C-G
Scott Martens
A digital upgrade theme with "V3" and a white "2", set against a green and black binary code background, with "Upgrade" centr
settembre 18, 2024 • 10 minuti letti
Jina Embeddings v3: A Frontier Multilingual Embedding Model
jina-embeddings-v3 is a frontier multilingual text embedding model with 570M parameters and 8192 token-length, outperforming the latest proprietary embeddings from OpenAI and Cohere on MTEB.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
Lingua / tema attuale
Search Foundation
Reader
Embeddings
Reranker
Ottieni la chiave API Jina
Limite di velocità
Chi siamo
Notizie
Scarica il logo Jina
open_in_new
Scarica il logo Elastic
open_in_new
Stato dell'API
Elastic © 2026.SicurezzaTermini & CondizioniPrivacyGestisci i cookieNon vendere né condividere le mie informazioni personali
Questo sito web e tutti i contenuti, software, prodotti e servizi ad esso associati sono destinati esclusivamente all'uso professionale. Non è previsto né raccomandato alcun utilizzo da parte dei consumatori.