Embeddings
Embeddings multimodali multilingue a contesto lungo ad alte prestazioni per applicazioni di ricerca, RAG e agenti.
API di embedding
Prova i nostri modelli di embedding per migliorare i tuoi sistemi di ricerca e RAG. Inizia con una prova gratuita!
curl "https://api.jina.ai/v1/embeddings" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{
"model": null,
"normalized": true,
"embedding_type": "float",
"input": [
text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.",
text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.",
text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.",
text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。",
text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。"
+ aggiungere input
]
}
EOFEOFkey
Chiave API
visibility_off
Token disponibili
0
v5-omni: Un unico embedding per tutti
Testo, immagini, audio, video: un unico spazio di embedding condiviso, due dimensioni. v5-omni-small (1,6 B) è il modello omni a pesi aperti con le migliori prestazioni con parametri inferiori a 2 B. v5-omni-nano (0,9 B) offre un recupero competitivo con meno di 1 B. Entrambi sono compatibili byte per byte con v5-text: non è necessaria alcuna reindicizzazione.
v5-text: Nuovi piccoli embeddings multilingue SOTA
jina-embeddings-v5-text offre una qualità di embedding di quinta generazione in due dimensioni efficienti, un modello piccolo da 677 M e un modello nano da 239 M, con adattatori LoRA specifici per attività, dimensioni Matryoshka, contesto da 32 K e quantizzazione GGUF/MLX per l'implementazione edge, stabilendo nuovi parametri di riferimento per attività MMTEB, MTEB English e di recupero.
Due modi per acquistare
Iscriviti alla nostra API o acquista tramite i provider cloud.
radio_button_unchecked
cloud
Con 3 fornitori di servizi cloud
La tua azienda utilizza AWS o Azure? Puoi distribuire i nostri modelli direttamente sulla piattaforma cloud della tua azienda e gestire la fatturazione tramite l'account CSP.
Distribuzione locale
Distribuisci i modelli Jina Embeddings in AWS SageMaker e Microsoft Azure, e presto anche nei servizi Google Cloud, oppure contatta il nostro team di vendita per ottenere distribuzioni Kubernetes personalizzate per il tuo cloud privato virtuale e i server locali.
Integrazioni API
La nostra API di embedding è integrata nativamente con vari database rinomati, archivi di vettori, framework RAG e LLMOps. Per iniziare, copia e incolla la tua chiave API in una qualsiasi delle integrazioni elencate per un avvio rapido e senza intoppi.
Negozio di vettore
LLMOps
RAG
Osservabilità
MongoDB
DataStax
Qdrant
Pinecone
Chroma
Weaviate
Milvus
Epsilla
MyScale
LlamaIndex
Haystack
Langchain
Dify
SuperDuperDB
DashVector
Portkey
Baseten
TiDB
LanceDB
Carbon
Le nostre pubblicazioni
Scopri come i nostri modelli di ricerca di frontiera sono stati addestrati da zero, dai un'occhiata alle nostre ultime pubblicazioni. Incontra il nostro team presso EMNLP, SIGIR, ICLR, NeurIPS e ICML!
luglio 20, 2026
SIGIR 2026
maggio 11, 2026
SIGIR 2026
febbraio 17, 2026
ICLR 2026
gennaio 22, 2026
dicembre 29, 2025
ICLR 2026
dicembre 04, 2025
AAAI 2026
ottobre 01, 2025
NeurIPS 2025
agosto 31, 2025
EMNLP 2025
giugno 24, 2025
ICLR 2025
marzo 04, 2025
ACL 2025
dicembre 17, 2024
ICLR 2025
dicembre 12, 2024
ECIR 2025
settembre 18, 2024
SIGIR 2025
settembre 07, 2024
EMNLP 2024
agosto 30, 2024
WWW 2025
giugno 21, 2024
ICML 2024
maggio 30, 2024
febbraio 26, 2024
ottobre 30, 2023
EMNLP 2023
luglio 20, 2023
20 pubblicazioni in totale.
Conoscere gli embeddings
Da dove cominciare con gli embeddings? Ti abbiamo coperto. Scopri di più sugli embeddings con la nostra guida completa.
Poster L'evoluzione degli embeddings
Scopri il poster ideale per il tuo spazio, con infografiche accattivanti o immagini mozzafiato che tracciano l'evoluzione dei modelli di embedding del testo dal 1950.
Come sono stati addestrati i modelli di embedding Jina?
keyboard_arrow_down
Quali sono i tuoi modelli di embedding multimodale?
keyboard_arrow_down
Quali lingue supportano i vostri modelli?
keyboard_arrow_down
Qual è la lunghezza massima del contesto per un singolo input?
keyboard_arrow_down
Qual è il numero massimo di input che posso includere in una singola richiesta?
keyboard_arrow_down
Come faccio a inviare immagini, audio, video o PDF ai modelli multimodali?
keyboard_arrow_down
Come si confrontano gli embedding di Jina con i modelli più recenti di OpenAI, Cohere e Voyage?
keyboard_arrow_down
Quanto è semplice il passaggio dal text-embedding-3-large di OpenAI alla vostra soluzione?
keyboard_arrow_down
Come vengono calcolati i token per le immagini e altri input non testuali?
keyboard_arrow_down
Fornite modelli per l'embedding di immagini, audio o video?
keyboard_arrow_down
È possibile ottimizzare i modelli di embedding di Jina utilizzando dati privati o aziendali?
keyboard_arrow_down
È possibile ospitare i modelli privatamente, sulla mia infrastruttura o nel mio account cloud?
keyboard_arrow_down
Cos'è il parametro "task" e quando dovrei utilizzarlo?
keyboard_arrow_down
Che cos'è il recupero tardivo delle interazioni e quali modelli lo supportano?
keyboard_arrow_down
Cos'è il late chunking e quando dovrei utilizzarlo?
keyboard_arrow_down
Perché l'API impone una lunghezza del contesto diversa da quella supportata dal modello?
keyboard_arrow_down
Perché jina-embeddings-v4 è gratuito e perché è lento?
keyboard_arrow_down
Quali sono i limiti di velocità per l'API Embeddings?
keyboard_arrow_down
Quale modello di embedding dovrei scegliere?
keyboard_arrow_down
Quali sono i limiti di dimensione dei file per immagini e PDF?
keyboard_arrow_down
Limite di velocità
I limiti di velocità vengono monitorati in due modi: RPM (richieste al minuto) e TPM (token al minuto). I limiti vengono applicati per IP/chiave API e vengono attivati al raggiungimento della soglia RPM o TPM. Quando si fornisce una chiave API nell'intestazione della richiesta, i limiti di velocità vengono monitorati per chiave anziché per indirizzo IP.
Colonne
arrow_drop_down
| Prodotto | Punto finale API | Descrizionearrow_upward | senza chiave APIkey_off | con chiave API gratuitakey | con chiave API a pagamentokey | con chiave API Premiumkey | Latenza media | Conteggio dell'utilizzo del token | Richiesta consentita | |
|---|---|---|---|---|---|---|---|---|---|---|
| API del Reader | https://r.jina.ai | Convertire l'URL in testo compatibile con LLM | 20 RPM | 500 RPM | 500 RPM | trending_up5000 RPM | 7.9s | Contare il numero di token nella risposta di output. | GET/POST | |
| API del Reader | https://s.jina.ai | Cercare sul web e convertire i risultati in testo compatibile con LLM | block | 100 RPM | 100 RPM | trending_up1000 RPM | 2.5s | Ogni richiesta costa un numero fisso di token, a partire da 10000 token | GET/POST | |
| API di embedding | https://api.jina.ai/v1/embeddings | Convertire testo/immagini in vettori di lunghezza fissa | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart dipende dalla dimensione dell'input help | Contare il numero di token nella richiesta di input. | POST | |
| API Reranker | https://api.jina.ai/v1/rerank | Classificare i documenti per query | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart dipende dalla dimensione dell'input help | Contare il numero di token nella richiesta di input. | POST |
Autoverifica della licenza CC BY-NC
play_arrow
Stai utilizzando la nostra API ospitata o le nostre immagini ufficiali su Azure, AWS o GCP?
play_arrow
SÌ
play_arrow
NO
Domande comuni relative all'API
code
Posso utilizzare la stessa chiave API per tutte le API di Jina?
keyboard_arrow_down
code
Posso monitorare l'utilizzo del token della mia chiave API?
keyboard_arrow_down
code
Cosa devo fare se dimentico la mia chiave API?
keyboard_arrow_down
code
Le chiavi API scadono?
keyboard_arrow_down
code
Posso trasferire token tra chiavi API?
keyboard_arrow_down
code
Posso revocare la mia chiave API?
keyboard_arrow_down
code
Perché la prima richiesta per alcuni modelli è lenta?
keyboard_arrow_down
code
I miei dati API vengono utilizzati per addestrare i vostri modelli?
keyboard_arrow_down
code
Quali sono i limiti di velocità per le API Jina?
keyboard_arrow_down
code
Esistono limiti alle dimensioni dei batch per le API?
keyboard_arrow_down
code
Le API di Jina corrispondono ai modelli Jina all'interno di Elastic?
keyboard_arrow_down
Domande comuni relative alla fatturazione
attach_money
La fatturazione è basata sul numero di frasi o richieste?
keyboard_arrow_down
attach_money
È disponibile una prova gratuita per i nuovi utenti?
keyboard_arrow_down
attach_money
Vengono addebitati i token per le richieste non riuscite?
keyboard_arrow_down
attach_money
Quali metodi di pagamento sono accettati?
keyboard_arrow_down
attach_money
È disponibile la fatturazione per gli acquisti di token?
keyboard_arrow_down
attach_money
Come posso acquistare una licenza commerciale anziché token API?
keyboard_arrow_down
attach_money
Posso pagare tramite fattura o ordine d'acquisto anziché con carta di credito?
keyboard_arrow_down
attach_money
Ho effettuato il pagamento, ma il mio saldo o il limite di spesa non sono cambiati. Cosa devo controllare?
keyboard_arrow_down
attach_money
Come faccio ad annullare, interrompere la ricarica automatica o rimuovere un metodo di pagamento salvato?
keyboard_arrow_down
























