Elastic
Jina AI
Modelli
API
keyboard_arrow_down
Lettore
Leggi gli URL e cerca sul web per ottenere LLM più approfonditi.
Incorporamenti
Incorporamenti multimodali multilingue.
Riclassificazione
Strumento di riordinamento per massimizzare la pertinenza dei risultati di ricerca.
Elastic Inference Service
Esegui i modelli Jina in modo nativo all'interno di Elasticsearch.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenti
data_object
Schema
menu_book
Documenti
Login
login

Riclassificazione

Massimizza la pertinenza della ricerca e la precisione del RAG con la nostra API di riclassificazione all'avanguardia.

API di riclassificazione

Prova la nostra API di riclassificazione all'avanguardia per massimizzare la pertinenza della ricerca e la precisione del RAG. A partire gratis!
keyChiave API e fatturazione
codeUtilizzo
more_horizDi più
chevron_leftchevron_right

home
speedLimite di velocità
bug_reportSollevare la questione
help_outlineFAQ
Stato
chevron_leftchevron_right

Numero di documenti restituiti
top_n
top_k
Numero massimo di documenti di alto livello da restituire.

upload
Richiesta
POST
curl "https://api.jina.ai/v1/rerank" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{ "model": null, "query": "Organic skincare products for sensitive skin", "top_n": 3, "documents": [ text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.", text_fieldsclose"New makeup trends focus on bold colors and innovative techniques: Step into the world of cutting-edg…atement with every look.", text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.", text_fieldsclose"Neue Make-up-Trends setzen auf kräftige Farben und innovative Techniken: Tauchen Sie ein in die Welt…jedes Mal ein Statement.", text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.", text_fieldsclose"Las nuevas tendencias de maquillaje se centran en colores vivos y técnicas innovadoras: Entra en el … y destaca en cada look.", text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。", text_fieldsclose"新的化妆趋势注重鲜艳的颜色和创新的技巧:进入化妆艺术的新纪元,本季的化妆趋势以大胆的颜色和创新的技巧为主。无论是霓虹眼线还是全息高光,每一款妆容都能让您脱颖而出,展现独特魅力。", text_fieldsclose"敏感肌のために特別に設計された天然有機スキンケア製品: アロエベラとカモミールのやさしい力で、自然の抱擁を感じてください。敏感肌用に特別に設計された私たちのスキンケア製品は、肌に優しく栄養を与え、保護します。肌トラブルにさようなら、輝く健康な肌にこんにちは。", text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。" + aggiungere input ], "return_documents": false }
EOFEOF


v3.5: Riordinamento più veloce delle liste con attenzione ibrida e auto-distillazione

jina-reranker-v3.5 is a 0.6B parameter multilingual listwise reranker with a 131K context window. Hybrid attention and self-distillation make it both faster and more robust across domains than v3, and it is a drop-in replacement: the request schema is unchanged.
Leggi la nota di rilascioarrow_forward

m0: Reranker di documenti multimodali multilingue

Il nostro nuovo reranker multimodale e multilingue per il recupero di documenti visivi in più lingue, con prestazioni SOTA su documenti lunghi multilingue e attività di ricerca di codice.
Leggi la nota di rilascioarrow_forward

Cos'è un reranker?

L'obiettivo di un sistema di ricerca è trovare i risultati più pertinenti in modo rapido ed efficiente. Tradizionalmente, metodi come BM25 o tf-idf sono stati utilizzati per classificare i risultati di ricerca in base alla corrispondenza delle parole chiave. Metodi recenti, come la somiglianza del coseno basata sull'incorporamento, sono stati implementati in molti database vettoriali. Questi metodi sono semplici ma a volte possono non cogliere le sottigliezze del linguaggio e, soprattutto, l'interazione tra i documenti e l'intento di una query. È qui che brilla il "reranker". Un reranker è un modello di intelligenza artificiale avanzato che prende il set iniziale di risultati da una ricerca, spesso forniti da una ricerca basata su incorporamenti/token, e li rivaluta per garantire che siano più allineati con l'intento dell'utente. Si guarda oltre la corrispondenza superficiale dei termini per considerare l'interazione più profonda tra la query di ricerca e il contenuto dei documenti.
account_tree
Ecco come funziona:

1
Recupero iniziale
Un sistema di ricerca utilizza embeddings/BM25 per trovare un'ampia serie di documenti potenzialmente rilevanti in base alla query dell'utente.

2
Riclassificazione
Il reranker prende quindi questi risultati e li analizza a un livello più granulare, considerando le sfumature di come i termini della query interagiscono con il contenuto del documento.

3
Risultati migliorati
Riordina i risultati della ricerca, posizionando quelli che ritiene più rilevanti in alto, sulla base di questa analisi più approfondita.

Il reranker può migliorare significativamente la qualità della ricerca perché opera a livello di sottodocumento e sottoquery, il che significa che esamina le singole parole e frasi, i loro significati e il modo in cui si relazionano tra loro all'interno della query e dei documenti. Ciò si traduce in un insieme di risultati di ricerca più precisi e contestualmente pertinenti.
Jina Reranker v2 è un reranker rilasciato il 25 giugno 2024; è stato creato per Agentic RAG. Offre supporto per le chiamate di funzione, recupero multilingue per oltre 100 lingue, funzionalità di ricerca del codice e una velocità 6 volte superiore rispetto alla versione 1. Scopri di più sul modello v2.
Recupero multilingue
Reranker v2 consente il recupero di documenti in oltre 100 lingue, indipendentemente dalla lingua della query.

Chiamata di funzioni e ricerca di codici
Reranker v2 classifica i frammenti di codice e le firme delle funzioni in base a query in linguaggio naturale, ideali per le applicazioni Agentic RAG.

Supporto dati tabulari e strutturati
Reranker v2 classifica le tabelle più rilevanti in base a query in linguaggio naturale, aiutando a ordinare diversi schemi di tabelle e a identificare quello più rilevante prima di generare una query SQL.

Due modi per acquistare

Iscriviti alla nostra API o acquista tramite i provider cloud.
radio_button_unchecked
cloud
Con 3 fornitori di servizi cloud
La tua azienda utilizza AWS o Azure? Quindi distribuisci direttamente i nostri modelli di base di ricerca su queste piattaforme nella tua azienda, in modo che i tuoi dati rimangano sicuri e conformi.
AWS SageMaker
Incorporamenti
Riclassificazione
Microsoft Azure
Incorporamenti
Riclassificazione
Google Cloud
Incorporamenti
radio_button_checked
Con l'API Jina Search Foundation
Il modo più semplice per accedere a tutti i nostri prodotti. Ricarica i token man mano che procedi.
Ricarica questa chiave API con più token
A seconda della tua posizione, l'addebito potrebbe essere effettuato in USD, EUR o altre valute. Potrebbero essere applicate tasse.
Inserisci la chiave API corretta per ricaricare
Comprendere il limite di velocità
I limiti di velocità sono il numero massimo di richieste che possono essere effettuate a un'API entro un minuto per indirizzo IP/chiave API (RPM). Scopri di più sui limiti di velocità per ogni prodotto e livello di seguito.
keyboard_arrow_down
Limite di velocità
I limiti di velocità vengono monitorati in tre modi: RPM (richieste al minuto) e TPM (token al minuto). I limiti vengono applicati per IP/chiave API e vengono attivati al raggiungimento della soglia RPM o TPM. Quando si fornisce una chiave API nell'intestazione della richiesta, i limiti di velocità vengono monitorati per chiave anziché per indirizzo IP.
ProdottoPunto finale APIDescrizionearrow_upwardsenza chiave APIkey_offcon chiave API gratuitakeycon chiave API a pagamentokeycon chiave API PremiumkeyLatenza mediaConteggio dell'utilizzo del tokenRichiesta consentita
API del lettorehttps://r.jina.aiConvertire l'URL in testo compatibile con LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sContare il numero di token nella risposta di output.GET/POST
API del lettorehttps://s.jina.aiCerca sul web e converti i risultati in testo compatibile con LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sOgni richiesta costa un numero fisso di token, a partire da 10000 tokenGET/POST
API di riclassificazionehttps://api.jina.ai/v1/rerankClassifica i documenti per queryblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dipende dalla dimensione dell'input
help
Conta il numero di token nella richiesta di input.POST
Incorporamento dell'APIhttps://api.jina.ai/v1/embeddingsConvertire testo/immagini in vettori di lunghezza fissablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dipende dalla dimensione dell'input
help
Conta il numero di token nella richiesta di input.POST

Distribuzione locale

Distribuisci Jina Reranker su AWS Sagemaker e Microsoft Azure e presto nei servizi cloud di Google, oppure contatta il nostro team di vendita per ottenere distribuzioni Kubernetes personalizzate per il tuo cloud privato virtuale e i server locali.
AWS SageMaker
Incorporamenti
Riclassificazione
Microsoft Azure
Incorporamenti
Riclassificazione
Google Cloud
Incorporamenti

Confronto tra Reranker, Ricerca vettoriale e BM25

La tabella seguente fornisce un confronto completo tra Reranker, ricerca di vettori/incorporamenti e BM25, evidenziandone i punti di forza e di debolezza nelle varie categorie.
RiclassificazioneRicerca vettorialeBM25
Ideale perMaggiore precisione e pertinenza della ricercaFiltraggio iniziale rapidoRecupero generale del testo attraverso query ad ampio raggio
GranularitàDettagliato: documento secondario e segmento di queryAmpio: interi documentiIntermedio: vari segmenti di testo
Complessità temporale delle queryAltomedioBasso
Complessità temporale dell'indicizzazioneNon richiestoAltoBasso, utilizza un indice predefinito
Complessità del tempo di allenamentoAltoAltoNon richiesto
Ricerca di qualitàSuperiore per query sfumateIn equilibrio tra efficienza e precisioneCoerente e affidabile per un'ampia gamma di query
Punti di forzaAltamente accurato con una profonda comprensione del contestoVeloce ed efficiente, con una precisione moderataAltamente scalabile, con efficacia consolidata
Prova gratuitamente l'API rerankerProva a incorporare l'API gratuitamente

Imparare a conoscere Reranker

Cos'è un reranker? Perché la ricerca vettoriale o la somiglianza del coseno non sono sufficienti? Scopri i reranker da zero con la nostra guida completa.
agosto 03, 2026 • 11 minuti letti
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
luglio 20, 2026
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
Listwise rerankers are the discriminative core of agentic retrieval pipelines, yet production deployment demands efficiency, domain robustness, and fluency on semi-structured data at the same time. We present jina-reranker-v3.5, a 0.6B-parameter listwise reranker that meets these demands together without sacrificing the cross-document comparison that makes its predecessor jina-reranker-v3 effective. It replaces uniform global attention with a hybrid schedule of three sliding-window layers followed by two global layers, pinning the terminal layer to global as last-but-not-late readout requires. It trains on a curated multi-domain mixture spanning legal, medical, financial, multilingual, and structured retrieval, and transfers quality through a three-stage self-distillation recipe in which a full-attention teacher sets an upper bound that a sparse-attention student then recovers. jina-reranker-v3.5 reaches 63.20 nDCG@10 on BEIR, matching a 4B model at roughly 7x fewer parameters, and lifts semi-structured retrieval by 9.6 nDCG@10 over jina-reranker-v3 while cutting listwise inference latency by up to 1.56x.
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
ottobre 03, 2025 • 7 minuti letti
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
ottobre 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
jina-reranker-v3 is a 0.6B parameter multilingual document reranker that introduces a novel last but not late interaction. Unlike late interaction models such as ColBERT that perform separate encoding followed by multi-vector matching, our approach conducts causal self-attention between query and documents within the same context window, enabling rich cross-document interactions before extracting contextual embeddings from the last token of each document. This compact architecture achieves state-of-the-art BEIR performance with 61.94 nDCG@10 while being significant smaller than generative listwise rerankers.

FAQ

Quanto costa l'API Reranker?
keyboard_arrow_down
Il prezzo dell'API Reranker segue la stessa struttura basata su token dell'API Embeddings e i token sono condivisi tra tutte le API Jina sulla stessa chiave. Le nuove chiavi API includono token gratuiti per iniziare; in seguito, sono disponibili pacchetti di token a pagamento. Per maggiori dettagli, consultare la sezione prezzi.
Quali sono le differenze tra i Jina Rerankers?
keyboard_arrow_down
jina-reranker-v3.5 è il nostro prodotto di punta attuale: un reranker multilingue listwise da 0,6 miliardi di parametri con 131.000 contesti e un sostituto diretto per jina-reranker-v3. Migliora la versione 3 in ogni aspetto che misuriamo, con i maggiori vantaggi nel recupero di dati strutturati e legali, ed è da 1,22 a 1,56 volte più veloce. jina-reranker-v3 rimane disponibile. jina-reranker-m0 è il reranker multimodale per il ranking di documenti visivi. jina-reranker-v2-base-multilingual è un cross-encoder più piccolo che supporta oltre 100 lingue, utile quando è necessario un modello non derivato da Qwen. jina-colbert-v2 utilizza l'interazione tardiva su 89 lingue.
Come sono autorizzate le aziende che effettuano il reranking di Jina?
keyboard_arrow_down
jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual e jina-colbert-v2 sono rilasciati sotto licenza CC-BY-NC 4.0. È possibile utilizzarli, condividerli e adattarli liberamente per scopi non commerciali. L'utilizzo in ambito commerciale richiede una licenza commerciale, che Elastic vende come proprio SKU dal 10 agosto 2026 con il nome Jina On-Prem. Contattare Elastic Sales per un preventivo. I modelli legacy jina-reranker-v1-* rimangono Apache-2.0.
I riclassificatori supportano più lingue?
keyboard_arrow_down
Sì, tutti gli attuali algoritmi di riordinamento sono multilingue. jina-reranker-v3.5 migliora la versione 3 in termini di MIRACL e di recupero multilingue in generale. jina-reranker-v3 e jina-reranker-v2-base-multilingual supportano oltre 100 lingue, jina-reranker-m0 gestisce l'ordinamento visivo multilingue dei documenti e jina-colbert-v2 supporta 89 lingue.
Qual è la lunghezza massima del contesto per ciascun algoritmo di reranking?
keyboard_arrow_down
La lunghezza del contesto varia in base al modello:

jina-reranker-v3.5: 131.072 token (query più tutti i documenti combinati) con troncamento automatico
jina-reranker-v3: 131.072 token con troncamento automatico
jina-reranker-m0: 10.000 token
jina-reranker-v2-base-multilingual: 1.024 token, con suddivisione automatica in blocchi per documenti più lunghi
jina-colbert-v2: 8.192 token

Per i reranker v1 e v2, le query vengono troncate automaticamente e i documenti lunghi vengono suddivisi in blocchi con max-pooling tra i blocchi.
Esiste un limite al numero di documenti che posso riclassificare per ogni query?
keyboard_arrow_down
Non esiste un limite massimo al numero di documenti per richiesta. Come la nostra API Embeddings, l'API Reranker elabora internamente gli input in base al numero di token per un utilizzo ottimale della GPU. È possibile inviare tutti i documenti necessari in un'unica richiesta.
Quale latenza posso aspettarmi quando riclassifico 100 documenti?
keyboard_arrow_down
La latenza varia da 100 millisecondi a 7 secondi, a seconda in gran parte della lunghezza dei documenti e della query. Ad esempio, la riclassificazione di 100 documenti di 256 token ciascuno con una query da 64 token richiede circa 150 millisecondi. Aumentando la lunghezza del documento a 4096 token, il tempo aumenta a 3,5 secondi. Se la lunghezza della query viene aumentata a 512 token, il tempo aumenta ulteriormente a 7 secondi.
Di seguito è riportato il tempo impiegato per riclassificare una query e 100 documenti in millisecondi:
Numero di token in ciascun documento
Numero di token nella query256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
È possibile ospitare gli strumenti di riordinamento in privato, sulla mia infrastruttura o nel mio account cloud?
keyboard_arrow_down
Sì. Gli strumenti di reranking sono disponibili sui marketplace di AWS, Azure e GCP per la distribuzione nel proprio account cloud. Per infrastrutture autogestite, on-premise o isolate, Elastic vende una licenza commerciale (Jina On-Prem) che include i modelli come container Docker completamente offline. Contatta il team vendite di Elastic per un preventivo.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Offrite un algoritmo di riordinamento ottimizzato per dati specifici del settore?
keyboard_arrow_down
Prima di commissionare un fine-tuning, prova jina-reranker-v3.5: è stato addestrato con auto-distillazione specificamente per la robustezza del dominio e mostra notevoli miglioramenti nel recupero di dati legali e strutturati rispetto alla v3. Un reranker standard ben scelto, unito a una migliore suddivisione in blocchi, di solito colma il divario in misura maggiore rispetto a un fine-tuning, e testarlo non costa nulla. Se dovesse ancora risultare insufficiente per i tuoi dati, un reranker specifico per il dominio è un servizio personalizzato: contatta Elastic Sales per definirne i dettagli.
Contatto
Qual è la dimensione minima delle immagini per i documenti?
keyboard_arrow_down
La dimensione minima accettabile dell'immagine per il modello jina-reranker-m0 è 28x28 pixel.
Che cos'è il riclassificazione listwise e in che cosa differisce da quella pointwise?
keyboard_arrow_down
jina-reranker-v3 e jina-reranker-v3.5 utilizzano un'architettura listwise: la query e tutti i candidati condividono una finestra di contesto e vengono valutati in un singolo passaggio in avanti, in modo che il modello possa confrontare i documenti tra loro. I tradizionali reranker pointwise, incluso jina-reranker-v2-base-multilingual, valutano ogni documento indipendentemente rispetto alla query. La valutazione listwise è più accurata perché la rilevanza è spesso relativa a ciò che è presente nell'insieme dei candidati.
Perché l'API impone una lunghezza del contesto diversa da quella supportata dal modello?
keyboard_arrow_down
Alcuni algoritmi di reranking sono architettonicamente in grado di gestire contesti più lunghi di quelli accettati dall'API ospitata. Sequenze molto lunghe consumano una quantità considerevole di memoria GPU e ottimizziamo la configurazione di erogazione per bilanciare throughput, latenza e costi per la maggior parte dei casi d'uso. Se hai bisogno della lunghezza completa del contesto architetturale, esegui il modello nella tua infrastruttura e contatta Elastic Sales per informazioni su una licenza commerciale.
Quali sono i limiti di velocità per l'API Reranker?
keyboard_arrow_down
I limiti di frequenza dipendono dal tipo di chiave API:

Gratuita: 100 RPM, 100.000 TPM
A pagamento: 500 RPM, 2 milioni di TPM
Premium: 5.000 RPM, 50 milioni di TPM

Esiste anche un limite basato sull'IP di 10.000 richieste ogni 60 secondi. Gli stessi limiti si applicano alle API Embeddings e Reranker e i token sono condivisi tra tutte le API Jina sulla stessa chiave.
Quale strumento di riordinamento dovrei scegliere?
keyboard_arrow_down
Utilizza jina-reranker-v3.5 per il testo. È un sostituto diretto di jina-reranker-v3: lo schema della richiesta rimane invariato, quindi la modifica della stringa del modello rappresenta l'intera migrazione. Utilizza jina-reranker-m0 quando i tuoi candidati sono immagini o documenti ricchi di elementi visivi. Utilizza jina-reranker-v2-base-multilingual quando hai bisogno di un modello più piccolo o di uno che non derivi da un'infrastruttura Qwen.

Come posso ottenere la mia chiave API?

video_not_supported

Qual è il limite di tariffa?

Limite di velocità
I limiti di velocità vengono monitorati in tre modi: RPM (richieste al minuto) e TPM (token al minuto). I limiti vengono applicati per IP/chiave API e vengono attivati al raggiungimento della soglia RPM o TPM. Quando si fornisce una chiave API nell'intestazione della richiesta, i limiti di velocità vengono monitorati per chiave anziché per indirizzo IP.
ProdottoPunto finale APIDescrizionearrow_upwardsenza chiave APIkey_offcon chiave API gratuitakeycon chiave API a pagamentokeycon chiave API PremiumkeyLatenza mediaConteggio dell'utilizzo del tokenRichiesta consentita
API del lettorehttps://r.jina.aiConvertire l'URL in testo compatibile con LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sContare il numero di token nella risposta di output.GET/POST
API del lettorehttps://s.jina.aiCerca sul web e converti i risultati in testo compatibile con LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sOgni richiesta costa un numero fisso di token, a partire da 10000 tokenGET/POST
API di riclassificazionehttps://api.jina.ai/v1/rerankClassifica i documenti per queryblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dipende dalla dimensione dell'input
help
Conta il numero di token nella richiesta di input.POST
Incorporamento dell'APIhttps://api.jina.ai/v1/embeddingsConvertire testo/immagini in vettori di lunghezza fissablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dipende dalla dimensione dell'input
help
Conta il numero di token nella richiesta di input.POST

Ho bisogno di una licenza commerciale?

Autoverifica della licenza CC BY-NC

play_arrow
Stai utilizzando la nostra API ospitata o le nostre immagini ufficiali su Azure, AWS o GCP?
play_arrow
SÌ
Non è necessaria una licenza separata. L'utilizzo commerciale è regolato dai termini di servizio: registrati e paga tramite questo sito o il marketplace cloud.
play_arrow
NO
play_arrow
Gestisci tu stesso i pesi del modello, all'interno di un prodotto o servizio commerciale?
play_arrow
NO
Niente da acquistare. Il download, la valutazione, il benchmarking e l'utilizzo a fini di ricerca sono consentiti da ogni licenza con cui pubblichiamo, a condizione che venga citata la fonte.
play_arrow
SÌ
play_arrow
Quale licenza possiede la modella? È indicato sulla pagina della modella su Hugging Face.
play_arrow
Apache-2.0
Apache-2.0 consente l'uso commerciale. Non è necessario acquistare nulla. Questo include i nostri modelli precedenti di generazione v1 e v2.
play_arrow
CC BY-NC 4.0
È necessaria una licenza commerciale. Dal 10 agosto 2026, Elastic vende una licenza per i modelli Jina come SKU a sé stante, denominata Jina On-Prem. Questa licenza copre implementazioni self-managed, on-premise e air-gapped e non richiede un abbonamento a Elasticsearch.
Se sei già cliente Elastic, il tuo team di riferimento può aggiungerlo al tuo contratto esistente.
Contatta Elastic Sales
play_arrow
Licenza di ricerca Qwen
Una licenza di ricerca non consente l'uso commerciale e una licenza commerciale per gli altri nostri modelli non si estende a questo. Non esiste un'opzione commerciale per questo modello, né in locale né tramite API. Scegli invece un modello con una delle altre due licenze.
Domande comuni relative all'API
code
Posso utilizzare la stessa chiave API per tutte le API di Jina?
keyboard_arrow_down
Sì. Una singola chiave API è valida per tutti i prodotti della piattaforma di ricerca Jina AI, inclusi Reader, Embeddings, Reranker, Classifier e Segmenter, con token condivisi tra tutti.
code
Posso monitorare l'utilizzo del token della mia chiave API?
keyboard_arrow_down
Sì, l'utilizzo del token può essere monitorato nella scheda "API Key & Billing" inserendo la tua chiave API, consentendoti di visualizzare la cronologia di utilizzo recente e i token rimanenti. Se hai effettuato l'accesso alla dashboard API, questi dettagli possono essere visualizzati anche nella scheda "Manage API Key".
code
Cosa devo fare se dimentico la mia chiave API?
keyboard_arrow_down
Se hai smarrito una chiave ricaricata e desideri recuperarla, contatta il supporto AT jina.ai con la tua email registrata per ricevere assistenza. Si consiglia di effettuare l'accesso per conservare la tua chiave API in modo sicuro e facilmente accessibile.
Contatto
code
Le chiavi API scadono?
keyboard_arrow_down
No, le nostre chiavi API non hanno una data di scadenza. Se una chiave viene compromessa, revocala tu stesso nella dashboard di gestione delle chiavi API, con effetto immediato; emetti prima una chiave sostitutiva se vuoi evitare tempi di inattività. Il saldo rimanente dei token resta sul tuo account anziché sulla chiave revocata. Se non riesci ad accedere alla dashboard o ritieni che l'account stesso sia stato compromesso, segnalalo al supporto Elastic.
Contatto
code
Posso trasferire token tra chiavi API?
keyboard_arrow_down
Sì, puoi trasferire token da una chiave premium a un'altra. Dopo aver effettuato l'accesso al tuo account sulla dashboard API Key Management, usa le impostazioni della chiave che vuoi trasferire per spostare tutti i token a pagamento rimanenti.
code
Posso revocare la mia chiave API?
keyboard_arrow_down
Sì, puoi revocare la tua chiave API se ritieni che sia stata compromessa. La revoca di una chiave la disabiliterà immediatamente per tutti gli utenti che l'hanno archiviata e tutto il saldo rimanente e le proprietà associate saranno permanentemente inutilizzabili. Se la chiave è una chiave premium, hai la possibilità di trasferire il saldo pagato rimanente a un'altra chiave prima della revoca. Nota che questa azione non può essere annullata. Per revocare una chiave, vai alle impostazioni della chiave nella dashboard Gestione chiavi API.
code
Perché la prima richiesta per alcuni modelli è lenta?
keyboard_arrow_down
Questo perché la nostra architettura serverless scarica determinati modelli durante i periodi di basso utilizzo. La richiesta iniziale attiva o "riscalda" il modello, il che potrebbe richiedere alcuni secondi. Dopo questa attivazione iniziale, le richieste successive vengono elaborate molto più rapidamente.
code
I miei dati API vengono utilizzati per addestrare i vostri modelli?
keyboard_arrow_down
No. Non utilizziamo mai le vostre richieste API, input o output per addestrare i nostri modelli di embedding, reranker o altri modelli. I vostri dati restano vostri.
code
Quali sono i limiti di velocità per le API Jina?
keyboard_arrow_down
Si applicano limiti di frequenza per chiave API:

Gratuito: 100 RPM, 100.000 TPM
A pagamento: 500 RPM, 2 milioni di TPM
Premium: 5.000 RPM, 50 milioni di TPM

Esiste anche un limite basato su IP di 10.000 richieste ogni 60 secondi. I limiti variano in base all'endpoint; consultare la tabella dei limiti di frequenza sopra riportata per i valori per endpoint.
code
Esistono limiti alle dimensioni dei batch per le API?
keyboard_arrow_down
Non esiste alcun limite di dimensione del batch per le API Embeddings o Reranker. È possibile inviare tutti gli elementi o documenti necessari per richiesta. Entrambe le API elaborano internamente gli input in batch in base al numero di token, per un utilizzo ottimale della GPU.
code
Le API di Jina corrispondono ai modelli Jina all'interno di Elastic?
keyboard_arrow_down
No, si tratta di tre percorsi separati. Le API Jina su questo sito sono self-service e a consumo con una chiave API Jina. L'Elastic Inference Service (EIS) esegue i modelli Jina all'interno di Elastic Cloud, con fatturazione tramite l'abbonamento Elastic, senza che sia necessaria la gestione di alcuna infrastruttura. Jina On-Prem è una licenza commerciale, venduta da Elastic come SKU a sé stante dal 10 agosto 2026, per l'esecuzione dei modelli nella propria infrastruttura autogestita, on-premise o isolata dalla rete. Per i percorsi EIS e On-Prem, contattare il reparto vendite Elastic.
Domande comuni relative alla fatturazione
attach_money
La fatturazione è basata sul numero di frasi o richieste?
keyboard_arrow_down
Il nostro modello di prezzo si basa sul numero totale di token elaborati, consentendo agli utenti la flessibilità di allocare questi token su qualsiasi numero di frasi, offrendo una soluzione economicamente vantaggiosa per diversi requisiti di analisi del testo.
attach_money
È disponibile una prova gratuita per i nuovi utenti?
keyboard_arrow_down
Sì. I nuovi utenti ricevono una chiave API generata automaticamente con token gratuiti utilizzabili su tutti i nostri modelli. Una volta esauriti i token gratuiti, è possibile acquistarne altri per la chiave nella sezione "Acquista token".
attach_money
Vengono addebitati i token per le richieste non riuscite?
keyboard_arrow_down
No, i token non vengono detratti per le richieste non riuscite.
attach_money
Quali metodi di pagamento sono accettati?
keyboard_arrow_down
I pagamenti vengono elaborati tramite Stripe, che supporta una varietà di metodi di pagamento tra cui carte di credito, Google Pay e PayPal per la tua comodità.
attach_money
È disponibile la fatturazione per gli acquisti di token?
keyboard_arrow_down
Per gli acquisti di token self-service, Stripe emette una fattura all'indirizzo email associato al tuo account Stripe al momento dell'acquisto. Se hai bisogno di un ordine di acquisto formale, un contratto negoziato, documenti di approvvigionamento o fatturazione consolidata, che vengono gestiti tramite Elastic anziché Stripe: contatta il team vendite di Elastic.
attach_money
Come posso acquistare una licenza commerciale anziché token API?
keyboard_arrow_down
L'acquisto di token su questo sito copre l'utilizzo delle API Jina ospitate. Non ti autorizza a eseguire i pesi del modello nella tua infrastruttura. Per questo, Elastic vende una licenza commerciale come SKU a sé stante dal 10 agosto 2026, con un prezzo annuale anziché per token. Contatta il team vendite di Elastic per un preventivo.
attach_money
Posso pagare tramite fattura o ordine d'acquisto anziché con carta di credito?
keyboard_arrow_down
Gli acquisti di token self-service vengono elaborati tramite Stripe e fatturati automaticamente all'indirizzo email associato al tuo account Stripe. Per ordini di acquisto, processi di approvvigionamento o volumi superiori a quelli supportati dalla ricarica self-service, contatta il team vendite di Elastic.
attach_money
Ho effettuato il pagamento, ma il mio saldo o il limite di spesa non sono cambiati. Cosa devo controllare?
keyboard_arrow_down
Il saldo e i limiti tariffari appartengono a una chiave API, non all'account, quindi la prima cosa da verificare è la chiave stessa piuttosto che la pagina dell'account: inseriscila nella scheda Chiave API e fatturazione e verifica il saldo e il livello tariffario. Se l'account possiede più di una chiave, i token si trovano sulla chiave che è stata ricaricata, che potrebbe non essere la chiave inviata dalla tua applicazione. L'attivazione di un nuovo livello tariffario può richiedere un breve periodo di tempo dopo il pagamento. Se la chiave mostra il saldo corretto ma il limite rimane al livello tariffario precedente, contatta l'assistenza.
attach_money
Come faccio ad annullare, interrompere la ricarica automatica o rimuovere un metodo di pagamento salvato?
keyboard_arrow_down
La gestione della fatturazione self-service avviene tramite il portale clienti, accessibile attraverso la scheda "Chiave API e fatturazione", dove è possibile disattivare la ricarica automatica e rimuovere i metodi di pagamento salvati. Disattivando la ricarica automatica si interromperanno gli addebiti futuri, ma il saldo già acquistato rimarrà utilizzabile. Se si desidera anche la rimozione dell'account e dei relativi dati, o una richiesta di rimborso, è necessario inviare la richiesta all'assistenza; la cancellazione dell'account viene gestita manualmente e richiede alcuni giorni lavorativi. Al termine dell'operazione, si riceverà una conferma scritta.
Lingua / tema attuale
Search Foundation
Lettore
Incorporamenti
Riclassificazione
Ottieni la chiave API Jina
Limite di velocità
Chi siamo
Notizia
Scarica il logo Jina
open_in_new
Scarica il logo Elastic
open_in_new
Stato dell'API
Elastic © 2026.SicurezzaTermini & CondizioniPrivacyGestisci i cookieNon vendere né condividere le mie informazioni personali
Questo sito web e tutti i contenuti, software, prodotti e servizi ad esso associati sono destinati esclusivamente all'uso professionale. Non è previsto né raccomandato alcun utilizzo da parte dei consumatori.