Incorporamenti
Incorporamenti multimodali multilingue a contesto lungo ad alte prestazioni per applicazioni di ricerca, RAG e agenti.
Incorporamento dell'API
Prova i nostri modelli di embedding per migliorare i tuoi sistemi di ricerca e RAG. Inizia con una prova gratuita!
chevron_leftchevron_right
curl "https://api.jina.ai/v1/embeddings" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{
"model": null,
"normalized": true,
"embedding_type": "float",
"input": [
text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.",
text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.",
text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.",
text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。",
text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。"
+ aggiungere input
]
}
EOFEOFkey
Chiave API
visibility_off
Gettoni disponibili
0
v5-omni: Un unico sistema di integrazione per tutti
Testo, immagini, audio, video: un unico spazio di embedding condiviso, due dimensioni. v5-omni-small (1,6 B) è il modello omni a pesi aperti con le migliori prestazioni con parametri inferiori a 2 B. v5-omni-nano (0,9 B) offre un recupero competitivo con meno di 1 B. Entrambi sono compatibili byte per byte con v5-text: non è necessaria alcuna reindicizzazione.
v5-text: Nuovi piccoli incorporamenti multilingue SOTA
jina-embeddings-v5-text offre una qualità di incorporamento di quinta generazione in due dimensioni efficienti, un modello piccolo da 677 M e un modello nano da 239 M, con adattatori LoRA specifici per attività, dimensioni Matryoshka, contesto da 32 K e quantizzazione GGUF/MLX per l'implementazione edge, stabilendo nuovi parametri di riferimento per attività MMTEB, MTEB English e di recupero.
Due modi per acquistare
Iscriviti alla nostra API o acquista tramite i provider cloud.
radio_button_unchecked
cloud
Con 3 fornitori di servizi cloud
La tua azienda utilizza AWS o Azure? Quindi distribuisci direttamente i nostri modelli di base di ricerca su queste piattaforme nella tua azienda, in modo che i tuoi dati rimangano sicuri e conformi.
Distribuzione locale
Distribuisci i modelli Jina Embeddings in AWS Sagemaker e Microsoft Azure, e presto anche nei servizi Google Cloud, oppure contatta il nostro team di vendita per ottenere distribuzioni Kubernetes personalizzate per il tuo cloud privato virtuale e i server locali.
Integrazioni API
La nostra API di incorporamento è integrata nativamente con vari database rinomati, archivi di vettori, framework RAG e LLMOps. Per iniziare, copia e incolla la tua chiave API in una qualsiasi delle integrazioni elencate per un avvio rapido e senza intoppi.
Negozio di vettore
LLMOps
STRACCIO
Osservabilità
MongoDB
DataStax
Qdrant
Pinecone
Chroma
Weaviate
Milvus
Epsilla
MyScale
LlamaIndex
Haystack
Langchain
Dify
SuperDuperDB
DashVector
Portkey
Baseten
TiDB
LanceDB
Carbon
Le nostre pubblicazioni
Scopri come i nostri modelli di ricerca di frontiera sono stati addestrati da zero, dai un'occhiata alle nostre ultime pubblicazioni. Incontra il nostro team presso EMNLP, SIGIR, ICLR, NeurIPS e ICML!
luglio 20, 2026
SIGIR 2026
maggio 11, 2026
SIGIR 2026
febbraio 17, 2026
ICLR 2026
gennaio 22, 2026
dicembre 29, 2025
ICLR 2026
dicembre 04, 2025
AAAI 2026
ottobre 01, 2025
NeurIPS 2025
agosto 31, 2025
EMNLP 2025
giugno 24, 2025
ICLR 2025
marzo 04, 2025
ACL 2025
dicembre 17, 2024
ICLR 2025
dicembre 12, 2024
ECIR 2025
settembre 18, 2024
SIGIR 2025
settembre 07, 2024
EMNLP 2024
agosto 30, 2024
WWW 2025
giugno 21, 2024
ICML 2024
maggio 30, 2024
febbraio 26, 2024
ottobre 30, 2023
EMNLP 2023
luglio 20, 2023
20 pubblicazioni in totale.
Conoscere gli incorporamenti
Da dove cominciare con gli incorporamenti? Ti abbiamo coperto. Scopri di più sugli incorporamenti con la nostra guida completa.
Poster L'evoluzione degli incorporamenti
Scopri il poster ideale per il tuo spazio, con infografiche accattivanti o immagini mozzafiato che tracciano l'evoluzione dei modelli di incorporamento del testo dal 1950.
Come sono stati addestrati i modelli di incorporamento Jina?
keyboard_arrow_down
Quali sono i tuoi modelli di incorporamento multimodale?
keyboard_arrow_down
Quali lingue supportano i vostri modelli?
keyboard_arrow_down
Qual è la lunghezza massima per una singola frase inserita?
keyboard_arrow_down
Qual è il numero massimo di frasi che posso includere in una singola richiesta?
keyboard_arrow_down
Come posso inviare immagini ai modelli di incorporamento multimodale?
keyboard_arrow_down
Come si confrontano i modelli Jina Embeddings con gli ultimi embedding di OpenAI e Cohere?
keyboard_arrow_down
Quanto è semplice il passaggio dal text-embedding-3-large di OpenAI alla vostra soluzione?
keyboard_arrow_down
Come vengono calcolati i token quando si utilizzano i modelli jina-clip?
keyboard_arrow_down
Fornite modelli per incorporare immagini o audio?
keyboard_arrow_down
I modelli Jina Embedding possono essere ottimizzati con dati privati o aziendali?
keyboard_arrow_down
I tuoi endpoint possono essere ospitati privatamente su AWS, Azure o GCP?
keyboard_arrow_down
Cos'è il parametro "task" e quando dovrei utilizzarlo?
keyboard_arrow_down
Che cos'è il recupero tardivo delle interazioni e quali modelli lo supportano?
keyboard_arrow_down
Cos'è il late chunking e quando dovrei utilizzarlo?
keyboard_arrow_down
Perché l'API supporta una lunghezza del contesto diversa dalla capacità massima del modello?
keyboard_arrow_down
Perché jina-embeddings-v4 è gratuito e perché è lento?
keyboard_arrow_down
Quali sono i limiti di velocità per l'API Embeddings?
keyboard_arrow_down
Quali sono i limiti di lunghezza del contesto per ciascun modello di incorporamento?
keyboard_arrow_down
Quali sono i limiti di dimensione dei file per immagini e PDF?
keyboard_arrow_down
Limite di velocità
I limiti di velocità vengono monitorati in tre modi: RPM (richieste al minuto) e TPM (token al minuto). I limiti vengono applicati per IP/chiave API e vengono attivati al raggiungimento della soglia RPM o TPM. Quando si fornisce una chiave API nell'intestazione della richiesta, i limiti di velocità vengono monitorati per chiave anziché per indirizzo IP.
Colonne
arrow_drop_down
| Prodotto | Punto finale API | Descrizionearrow_upward | senza chiave APIkey_off | con chiave API gratuitakey | con chiave API a pagamentokey | con chiave API Premiumkey | Latenza media | Conteggio dell'utilizzo del token | Richiesta consentita | |
|---|---|---|---|---|---|---|---|---|---|---|
| API del lettore | https://r.jina.ai | Convertire l'URL in testo compatibile con LLM | 20 RPM | 500 RPM | 500 RPM | trending_up5000 RPM | 7.9s | Contare il numero di token nella risposta di output. | GET/POST | |
| API del lettore | https://s.jina.ai | Cerca sul web e converti i risultati in testo compatibile con LLM | block | 100 RPM | 100 RPM | trending_up1000 RPM | 2.5s | Ogni richiesta costa un numero fisso di token, a partire da 10000 token | GET/POST | |
| API di riclassificazione | https://api.jina.ai/v1/rerank | Classifica i documenti per query | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart dipende dalla dimensione dell'input help | Conta il numero di token nella richiesta di input. | POST | |
| Incorporamento dell'API | https://api.jina.ai/v1/embeddings | Convertire testo/immagini in vettori di lunghezza fissa | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart dipende dalla dimensione dell'input help | Conta il numero di token nella richiesta di input. | POST | |
| API del classificatore | https://api.jina.ai/v1/train | Addestrare un classificatore utilizzando esempi etichettati | block | 25 RPM & 25,000 TPM | 125 RPM & 500,000 TPM | 1,250 RPM & 12,000,000 TPM | ssid_chart dipende dalla dimensione dell'input | I token vengono conteggiati come: input_tokens × num_iters | POST | |
| API del classificatore (Colpo zero) | https://api.jina.ai/v1/classify | Classificare gli input utilizzando la classificazione zero-shot | block | 25 RPM & 25,000 TPM | 125 RPM & 500,000 TPM | 1,250 RPM & 12,000,000 TPM | ssid_chart dipende dalla dimensione dell'input | I token vengono conteggiati come: input_tokens + label_tokens | POST | |
| API del classificatore (Pochi colpi) | https://api.jina.ai/v1/classify | Classificare gli input utilizzando un classificatore addestrato a pochi scatti | block | 25 RPM & 25,000 TPM | 125 RPM & 500,000 TPM | 1,250 RPM & 12,000,000 TPM | ssid_chart dipende dalla dimensione dell'input | I token sono conteggiati come: input_tokens | POST | |
| API del segmentatore | https://api.jina.ai/v1/segment | Tokenizzare e segmentare il testo lungo | 20 RPM | 200 RPM | 200 RPM | 1,000 RPM | 0.3s | Il token non viene conteggiato come utilizzo. | GET/POST | |
| DeepSearch | https://deepsearch.jina.ai/v1/chat/completions | Ragiona, cerca e ripeti per trovare la risposta migliore | block | 50 RPM | 50 RPM | 500 RPM | 56.7s | Contare il numero totale di token nell'intero processo. | POST |
Autoverifica della licenza CC BY-NC
play_arrow
Stai utilizzando la nostra API ufficiale o le immagini ufficiali su Azure, AWS o GCP?
play_arrow
SÌ
play_arrow
NO
Domande comuni relative all'API
code
Posso usare la stessa chiave API per le API di lettura, incorporamento, riclassificazione, classificazione e messa a punto?
keyboard_arrow_down
code
Posso monitorare l'utilizzo del token della mia chiave API?
keyboard_arrow_down
code
Cosa devo fare se dimentico la mia chiave API?
keyboard_arrow_down
code
Le chiavi API scadono?
keyboard_arrow_down
code
Posso trasferire token tra chiavi API?
keyboard_arrow_down
code
Posso revocare la mia chiave API?
keyboard_arrow_down
code
Perché la prima richiesta per alcuni modelli è lenta?
keyboard_arrow_down
code
I miei dati API vengono utilizzati per addestrare i vostri modelli?
keyboard_arrow_down
code
Quali sono i limiti di velocità per le API Jina?
keyboard_arrow_down
code
Esistono limiti alle dimensioni dei batch per le API?
keyboard_arrow_down
Domande comuni relative alla fatturazione
attach_money
La fatturazione è basata sul numero di frasi o richieste?
keyboard_arrow_down
attach_money
È disponibile una prova gratuita per i nuovi utenti?
keyboard_arrow_down
attach_money
Vengono addebitati i token per le richieste non riuscite?
keyboard_arrow_down
attach_money
Quali metodi di pagamento sono accettati?
keyboard_arrow_down
attach_money
È disponibile la fatturazione per gli acquisti di token?
keyboard_arrow_down


























