Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
Elastic Inference Service
在 Elasticsearch 中原生執行 Jina 模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login

重排模型

用我們前沿的 Reranker API,把搜尋相關性和 RAG 準確率推到極致。

Reranker API

試試我們前沿的 Reranker API,把搜尋相關性和 RAG 準確率推到極致。免費開始!
keyAPI 金鑰與計費
code用量
more_horiz更多
chevron_leftchevron_right

home
speed速率限制
bug_report問題反饋
help_outline常見問題
服務狀態
chevron_leftchevron_right

返回文件數量
top_n
top_k
最多返回多少篇排名靠前的文件。

upload
請求
POST
curl "https://api.jina.ai/v1/rerank" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{ "model": null, "query": "Organic skincare products for sensitive skin", "top_n": 3, "documents": [ text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.", text_fieldsclose"New makeup trends focus on bold colors and innovative techniques: Step into the world of cutting-edg…atement with every look.", text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.", text_fieldsclose"Neue Make-up-Trends setzen auf kräftige Farben und innovative Techniken: Tauchen Sie ein in die Welt…jedes Mal ein Statement.", text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.", text_fieldsclose"Las nuevas tendencias de maquillaje se centran en colores vivos y técnicas innovadoras: Entra en el … y destaca en cada look.", text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。", text_fieldsclose"新的化妆趋势注重鲜艳的颜色和创新的技巧:进入化妆艺术的新纪元,本季的化妆趋势以大胆的颜色和创新的技巧为主。无论是霓虹眼线还是全息高光,每一款妆容都能让您脱颖而出,展现独特魅力。", text_fieldsclose"敏感肌のために特別に設計された天然有機スキンケア製品: アロエベラとカモミールのやさしい力で、自然の抱擁を感じてください。敏感肌用に特別に設計された私たちのスキンケア製品は、肌に優しく栄養を与え、保護します。肌トラブルにさようなら、輝く健康な肌にこんにちは。", text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。" + 新增輸入 ], "return_documents": false }
EOFEOF


v3.5:用混合注意力與自蒸餾實現更快的列表式重排

jina-reranker-v3.5 is a 0.6B parameter multilingual listwise reranker with a 131K context window. Hybrid attention and self-distillation make it both faster and more robust across domains than v3, and it is a drop-in replacement: the request schema is unchanged.
閱讀釋出說明arrow_forward

m0:多語言多模態文件重排模型

全新的多模態多語言重排模型,可跨語言檢索視覺文件,在多語言長文件和程式碼搜尋任務上效能業界領先。
閱讀釋出說明arrow_forward

什麼是重排模型?

搜尋系統的目標,是又快又準地找到最相關的結果。傳統做法是用 BM25 或 tf-idf 這類關鍵詞匹配演算法給結果排序;近年來基於向量的餘弦相似度也被廣泛採用,成為眾多向量資料庫的標配。這些方法都很直接,但常常會漏掉語言的微妙之處,更重要的是,漏掉文件與查詢意圖之間的關聯。 重排模型正是為此而生。它是一種高階 AI 模型,接過搜尋的初始候選集(通常來自向量檢索或基於詞元的檢索),重新評估這些結果與使用者意圖的貼合程度。它不止步於字面匹配,而是深入挖掘查詢與文件內容之間更深層的互動。
account_tree
在搜尋系統中,重排模型的工作方式如下:

1
初始檢索
搜尋系統先根據使用者查詢,用向量或 BM25 粗篩出一批可能相關的文件。

2
重排
重排模型接手這批初篩結果,在更精細的粒度上分析文件,關注查詢詞與文件內容之間互動的細微差別。

3
結果更優
基於這層更深入的分析,重排模型重新排列搜尋結果,把它認為最相關的排到最前面。

重排模型能大幅提升搜尋品質,因為它在子文件和子查詢的粒度上工作:逐個考察詞與短語的含義,以及它們在查詢和文件內部的相互關係。由此得到的搜尋結果更精確,也更貼合上下文。
Jina Reranker v2 於 2024 年 6 月 25 日發布,專為 Agentic RAG 打造。它支援函式呼叫、100 多種語言的多語言檢索和程式碼搜尋,速度達到 v1 的 6 倍。瞭解更多 v2 模型資訊。
多語言檢索
Reranker v2 支援超過 100 種語言的文件檢索,無論查詢語言是什麼。

函式呼叫和程式碼搜尋
Reranker v2 可根據自然語言查詢對程式碼片段和函式簽名排序,非常適合 Agentic RAG 應用。

表格和結構化資料支援
Reranker v2 可根據自然語言查詢排出最相關的表,在生成 SQL 查詢前幫您從多種表結構中找出最匹配的一個。

兩種購買方式

訂閱我們的 API,或透過雲服務商購買。
radio_button_unchecked
cloud
攜手 3 家雲服務商
在用 AWS 或 Azure?您可以直接在公司的雲平臺上部署我們的模型,並透過雲服務商帳戶統一結算。
AWS SageMaker
Embeddings
Reranker
Microsoft Azure
Embeddings
Reranker
Google Cloud
Embeddings
radio_button_checked
使用 Jina Search Foundation API
訪問我們全部產品最簡單的方式,按需儲值詞元。
為此 API 金鑰儲值更多詞元
根據您所在的地區,扣款幣種可能為美元、歐元或其他貨幣,並可能需要繳納稅費。
請輸入正確的 API 金鑰以儲值
瞭解速率限制
速率限制指每個 IP 地址/API 金鑰每分鐘可發起的最大請求數(RPM)。各產品和各檔位的速率限制詳見下表。
keyboard_arrow_down
速率限制
速率限制按以下維度統計:RPM(每分鐘請求數)和 TPM(每分鐘詞元數)。限制按 IP/API 金鑰分別計算,RPM 或 TPM 任一先達到閾值即觸發限制。若您在請求頭中提供了 API 金鑰,我們將按金鑰而非 IP 地址統計速率限制。
產品API 端點描述arrow_upward無 API 金鑰key_off免費 API 金鑰key付費 API 金鑰key高級 API 金鑰key平均延遲詞元用量計算方式允許的請求
Reader APIhttps://r.jina.ai將 URL 轉換為大模型友好文字20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s按輸出響應中的詞元數計算。GET/POST
Reader APIhttps://s.jina.ai搜尋網路並將結果轉換為大模型友好文字block100 RPM100 RPMtrending_up1000 RPM2.5s每次請求消耗固定數量的詞元,起步 10000 個詞元GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank按查詢對文件重排block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取決於輸入大小
help
按輸入請求中的詞元數計算。POST
向量模型 APIhttps://api.jina.ai/v1/embeddings將文字/圖片轉為定長向量block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取決於輸入大小
help
按輸入請求中的詞元數計算。POST

私有化部署

可在 AWS Sagemaker 和 Microsoft Azure 上部署 Jina Reranker,Google Cloud Services 也即將支援;也可以聯絡我們的銷售團隊,為您的虛擬私有云和私有化部署伺服器定製 Kubernetes 部署方案。
AWS SageMaker
Embeddings
Reranker
Microsoft Azure
Embeddings
Reranker
Google Cloud
Embeddings

重排模型、向量搜尋與 BM25 對比

下表全面對比了重排模型、向量搜尋和 BM25,逐項列出它們各自的長處與不足。
重排模型向量搜尋BM25
適用場景提升搜尋精度與相關性初步快速篩選面向各類查詢的通用文字檢索
粒度精細:子文件與查詢片段級粗放:整篇文件級居中:各類文字片段級
查詢時間複雜度高中低
索引時間複雜度無需高低,可複用預建索引
訓練時間複雜度高高無需
搜尋品質處理細微差別的查詢更出色兼顧效率與準確性面向各類查詢表現穩定可靠
優勢準確率高,能深入理解上下文快速高效,準確度中等擴充套件性強,效果久經驗證
免費試用 Reranker API免費使用向量模型 API

瞭解重排模型

什麼是重排模型?為什麼向量搜尋或餘弦相似度還不夠?讀我們的完整指南,從零開始瞭解重排模型。
八月 03, 2026 • 11 分鐘閱讀
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
七月 20, 2026
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
Listwise rerankers are the discriminative core of agentic retrieval pipelines, yet production deployment demands efficiency, domain robustness, and fluency on semi-structured data at the same time. We present jina-reranker-v3.5, a 0.6B-parameter listwise reranker that meets these demands together without sacrificing the cross-document comparison that makes its predecessor jina-reranker-v3 effective. It replaces uniform global attention with a hybrid schedule of three sliding-window layers followed by two global layers, pinning the terminal layer to global as last-but-not-late readout requires. It trains on a curated multi-domain mixture spanning legal, medical, financial, multilingual, and structured retrieval, and transfers quality through a three-stage self-distillation recipe in which a full-attention teacher sets an upper bound that a sparse-attention student then recovers. jina-reranker-v3.5 reaches 63.20 nDCG@10 on BEIR, matching a 4B model at roughly 7x fewer parameters, and lifts semi-structured retrieval by 9.6 nDCG@10 over jina-reranker-v3 while cutting listwise inference latency by up to 1.56x.
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
十月 03, 2025 • 7 分鐘閱讀
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
十月 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
jina-reranker-v3 is a 0.6B parameter multilingual document reranker that introduces a novel last but not late interaction. Unlike late interaction models such as ColBERT that perform separate encoding followed by multi-vector matching, our approach conducts causal self-attention between query and documents within the same context window, enabling rich cross-document interactions before extracting contextual embeddings from the last token of each document. This compact architecture achieves state-of-the-art BEIR performance with 61.94 nDCG@10 while being significant smaller than generative listwise rerankers.

常見問題

Reranker API 的費用是多少?
keyboard_arrow_down
Reranker API 的定價與向量模型 API 一致。每個新 API 金鑰可獲贈 1000 萬免費詞元,用完後可另行購買不同套餐。詳情請查看我們的定價頁面。
Jina 重排器之間有什麼區別?
keyboard_arrow_down
jina-reranker-v3.5 是我們目前的旗艦產品:一個擁有 0.6 億引數、13.1 萬上下文的多語言列表重排序器,可直接替代 jina-reranker-v3。它在所有衡量指標上都優於 v3,尤其在結構化資料和法律檢索方面提升最為顯著,執行速度也提升了 1.22 倍到 1.56 倍。jina-reranker-v3 仍然可用。jina-reranker-m0 是一個用於對視覺文件進行排序的多模態重排序器。jina-reranker-v2-base-multilingual 是一個較小的交叉編碼器,支援 100 多種語言,當您需要一個非 Qwen 衍生模型時非常有用。jina-colbert-v2 使用 89 種語言的後期互動。
Jina排名器是如何獲得授權的?
keyboard_arrow_down
jina-reranker-v3.5、jina-reranker-v3、jina-reranker-m0、jina-reranker-v2-base-multilingual 和 jina-colbert-v2 均以 CC-BY-NC 4.0 許可釋出。您可以免費使用、分享和改編它們用於非商業用途。商業生產用途需要商業許可,Elastic 自 2026 年 8 月 10 日起以 Jina On-Prem 的名稱作為其獨立 SKU 進行銷售。請聯絡 Elastic Sales 獲取報價。舊版 jina-reranker-v1-* 模型仍使用 Apache-2.0 許可。
重排模型支援多種語言嗎?
keyboard_arrow_down
是的,目前所有重排序工具都支援多語言。jina-reranker-v3.5 在 MIRACL 和多語言檢索方面都比 v3 版本有所改進。jina-reranker-v3 和 jina-reranker-v2-base-multilingual 支援 100 多種語言,jina-reranker-m0 處理多語言視覺化文件排序,而 jina-colbert-v2 支援 89 種語言。
每個重排序器的最大上下文長度是多少?
keyboard_arrow_down
上下文長度因模型而異:

jina-reranker-v3.5: 131,072 個詞元(查詢加上所有文件的總和),啟用自動截斷
jina-reranker-v3: 131,072 個詞元,啟用自動截斷
jina-reranker-m0: 10,000 個詞元
jina-reranker-v2-base-multilingual: 1,024 個詞元,對較長的文件啟用自動分塊
jina-colbert-v2: 8,192 個詞元

對於 v1 和 v2 重排序器,查詢會自動截斷,長文件會使用跨塊最大池化進行分塊。
每次查詢可重排的文件數量有上限嗎?
keyboard_arrow_down
單次請求的文件數量沒有硬性上限。與向量模型 API 一樣,Reranker API 會按詞元數在內部自動分批,以充分利用 GPU。您可以在一次請求中傳送任意數量的文件。
對 100 個文件重排時,預計延遲會是多少?
keyboard_arrow_down
延遲從 100 毫秒到 7 秒不等,主要取決於文件和查詢的長度。例如,使用 64 個詞元的查詢對 100 個包含 256 個詞元的文件進行重排大約需要 150 毫秒。將文件長度增加到 4096 個詞元將使時間增加到 3.5 秒。如果查詢長度增加到 512 個詞元,則時間進一步增加到 7 秒。
以下是對一個查詢和 100 個文件進行重排的時間成本(以毫秒為單位):
每個文件中的詞元數量
查詢中的詞元數量256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
重新排名工具可以私有託管嗎?例如,託管在我自己的基礎架構或我自己的雲賬戶中?
keyboard_arrow_down
是的。您可以在 AWS、Azure 和 GCP Marketplace 上找到這些重新排序工具,並將它們部署到您自己的雲賬戶中。對於自管理、本地部署或物理隔離的基礎設施,Elastic 提供商業許可(Jina On-Prem),該許可將模型以完全離線的 Docker 容器形式交付。請聯絡 Elastic Sales 獲取報價。
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
你們是否提供基於特定領域資料進行微調的重新排名工具?
keyboard_arrow_down
在委託進行微調之前,不妨先試試 jina-reranker-v3.5:它採用自蒸餾技術專門針對特定領域進行了訓練,具有很強的魯棒性,並且在法律和結構化資料檢索方面比 v3 版本有了顯著提升。一個精心挑選的現成重排序器加上更最佳化的分塊處理通常比微調更能有效彌補差距,而且測試是免費的。如果它仍然無法滿足您的資料需求,您可以考慮定製一個特定領域的重排序器:請聯絡 Elastic Sales 來了解具體需求。
聯絡我們
文件圖片的最小尺寸是多少?
keyboard_arrow_down
jina-reranker-m0 模型可接受的最小影象尺寸為 28x28 畫素。
什麼是列表式重排?它和逐點式重排有何不同?
keyboard_arrow_down
jina-reranker-v3 和 jina-reranker-v3.5 採用列表式架構:查詢和所有候選文件共享一個上下文視窗,並在一次前向傳播中完成評分,因此模型可以相互比較文件。傳統的逐點重排序器,例如 jina-reranker-v2-base-multilingual,則獨立地對每個文件與查詢進行評分。列表式評分更加準確,因為相關性通常是相對於候選集中其他文件而言的。
為什麼 API 強制執行的上下文長度與模型支援的上下文長度不同?
keyboard_arrow_down
某些重排序器架構上能夠處理比託管 API 所接受的更長的上下文。非常長的序列會消耗大量的 GPU 記憶體,我們會針對大多數使用場景調整服務配置,以平衡吞吐量、延遲和成本。如果您需要完整的架構上下文長度,請在您自己的基礎設施上執行模型,並聯系 Elastic Sales 獲取商業許可。
Reranker API 的速率限制是多少?
keyboard_arrow_down
速率限制取決於您的 API 金鑰類型:

免費版: 100 RPM,100K TPM,2 個併發請求
付費版: 500 RPM,2M TPM,50 個併發請求
高級版: 5,000 RPM,50M TPM,500 個併發請求

此外還有基於 IP 的速率限制:每 60 秒 10,000 次請求。向量模型 API 和 Reranker API 適用同一套速率限制。
我應該選擇哪款重新排名工具?
keyboard_arrow_down
對於文字,請使用 jina-reranker-v3.5。它可直接替代 jina-reranker-v3:請求模式保持不變,因此只需切換模型字串即可完成整個遷移。當候選物件是影象或包含豐富視覺內容的文件時,請使用 jina-reranker-m0。當您需要更小的模型或並非基於 Qwen 主幹架構的模型時,請使用 jina-reranker-v2-base-multilingual。

如何獲取我的 API 金鑰?

video_not_supported

速率限制是多少?

速率限制
速率限制按以下維度統計:RPM(每分鐘請求數)和 TPM(每分鐘詞元數)。限制按 IP/API 金鑰分別計算,RPM 或 TPM 任一先達到閾值即觸發限制。若您在請求頭中提供了 API 金鑰,我們將按金鑰而非 IP 地址統計速率限制。
產品API 端點描述arrow_upward無 API 金鑰key_off免費 API 金鑰key付費 API 金鑰key高級 API 金鑰key平均延遲詞元用量計算方式允許的請求
Reader APIhttps://r.jina.ai將 URL 轉換為大模型友好文字20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s按輸出響應中的詞元數計算。GET/POST
Reader APIhttps://s.jina.ai搜尋網路並將結果轉換為大模型友好文字block100 RPM100 RPMtrending_up1000 RPM2.5s每次請求消耗固定數量的詞元,起步 10000 個詞元GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank按查詢對文件重排block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取決於輸入大小
help
按輸入請求中的詞元數計算。POST
向量模型 APIhttps://api.jina.ai/v1/embeddings將文字/圖片轉為定長向量block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取決於輸入大小
help
按輸入請求中的詞元數計算。POST

我需要商業許可證嗎?

CC BY-NC 授權自查

play_arrow
您使用的是我們託管的 API,還是我們在 Azure、AWS 或 GCP 上的官方映像?
play_arrow
是
無需單獨購買授權。商業用途已包含在服務條款中:透過本網站或雲市集註冊並付費即可。
play_arrow
否
play_arrow
您是否在自己執行模型權重,並用於商業產品或服務?
play_arrow
否
無需購買授權。下載、評估、跑基準測試和研究用途,在我們釋出模型所用的每一種授權下都是允許的,註明出處即可。
play_arrow
是
play_arrow
該模型採用哪種授權條款?模型在 Hugging Face 上的頁面會寫明。
play_arrow
Apache-2.0
Apache-2.0 允許商業用途,無需購買授權。我們早期的 v1、v2 代模型採用這一授權。
play_arrow
CC BY-NC 4.0
您需要商業授權。自 2026 年 8 月 10 日起,Elastic 以獨立 SKU 的形式銷售 Jina 模型的商業授權,名為 Jina On-Prem。它涵蓋自託管、地端部署和實體隔離(air-gapped)部署,且無需 Elasticsearch 訂閱。
如果您已經是 Elastic 客戶,您的客戶團隊可以把它併入現有合同。
聯絡 Elastic Sales
play_arrow
Qwen Research License
研究授權不允許任何商業用途,我們為其他模型提供的商業授權也不涵蓋它。這個模型沒有商業選項,自託管和走 API 都不行。請改用另外兩種授權下的模型。
API 相關常見問題
code
我可以在所有 Jina API 中使用同一個 API 金鑰嗎?
keyboard_arrow_down
可以,同一個 API 金鑰適用於 Jina AI 的所有搜尋底座產品,包括 Reader、向量模型、重排、分類和微調 API,詞元額度在各項服務之間共享。
code
我可以查看 API 金鑰的詞元用量嗎?
keyboard_arrow_down
可以,在「API 金鑰與計費」標籤頁輸入您的 API 金鑰,即可查看近期用量記錄和剩餘詞元。如果您已登入 API 控制面板,也可以在「管理 API 金鑰」標籤頁查看這些資訊。
code
如果我忘記了 API 金鑰,該怎麼辦?
keyboard_arrow_down
如果您弄丟了已儲值的金鑰並希望找回,請用註冊郵箱聯繫 support AT jina.ai。建議登入帳戶,這樣 API 金鑰可以安全保存、隨時取用。
聯絡我們
code
API 金鑰會過期嗎?
keyboard_arrow_down
不會,我們的 API 金鑰沒有有效期。但如果您懷疑金鑰已洩漏並希望停用,請聯繫我們的支援團隊。您也可以在 API 金鑰控制面板中自行銷毀金鑰。
聯絡我們
code
可以在不同 API 金鑰之間轉移詞元嗎?
keyboard_arrow_down
可以,您能把詞元從一個高級金鑰轉到另一個金鑰。在 API 金鑰控制面板登入帳戶後,進入待轉出金鑰的設置頁,即可轉移全部剩餘的付費詞元。
code
我可以銷毀我的 API 金鑰嗎?
keyboard_arrow_down
可以,如果您認為金鑰已洩漏,可以銷毀它。銷毀後,所有保存該金鑰的使用者都會立即無法使用,剩餘額度和關聯屬性也將永久失效。如果是高級金鑰,您可以在銷毀前把剩餘的付費額度轉移到另一個金鑰。請注意,此操作無法撤銷。要銷毀金鑰,請前往 API 金鑰控制面板中的金鑰設置。
code
為什麼有些模型的首次請求比較慢?
keyboard_arrow_down
這是因為我們的無伺服器架構會在使用率較低時解除安裝部分模型。首次請求會啟用或“預熱”模型,需要幾秒鐘。啟用之後,後續請求的處理速度會快得多。
code
我的 API 資料會被用來訓練你們的模型嗎?
keyboard_arrow_down
不會。我們絕不會用您的 API 請求、輸入或輸出來訓練向量模型、重排模型或任何其他模型。您的資料始終屬於您。
code
Jina API 的速率限制是多少?
keyboard_arrow_down
速率限制按 API 金鑰計算:

免費版:100 RPM,100K TPM,2 個併發請求
付費版:500 RPM,2M TPM,50 個併發請求
高級版:5,000 RPM,50M TPM,500 個併發請求

此外還有基於 IP 的速率限制,每 60 秒 10,000 個請求。以上限制適用於所有 Jina API(Embeddings、Reranker、Reader 等)。
code
API 有批次大小限制嗎?
keyboard_arrow_down
Embeddings 和 Reranker API 都沒有批次大小限制,每次請求可以傳送任意數量的條目或文件。兩個 API 都會在內部按詞元數對輸入分批,以充分利用 GPU。
code
Jina API 與 Elastic 中的 Jina 模型是同一回事嗎?
keyboard_arrow_down
不,這是三種不同的路徑。本網站上的 Jina API 是自助式的,採用按需付費模式,需要 Jina API 金鑰。Elastic Inference Service (EIS) 在 Elastic Cloud 中執行 Jina 模型,費用透過您的 Elastic 訂閱收取,無需您管理任何基礎設施。Jina On-Prem 是 Elastic 自 2026 年 8 月 10 日起作為其獨立 SKU 銷售的商業許可證,用於在您自己的自管理本地或物理隔離的基礎設施中執行模型。有關 EIS 和 On-Prem 路徑的更多資訊,請聯絡 Elastic Sales。
與計費相關的常見問題
attach_money
API 是按句子數還是按請求數計費?
keyboard_arrow_down
我們按處理的詞元總數計費,您可以把這些詞元靈活分配到任意數量的句子上,用更低的成本滿足各種文字分析需求。
attach_money
新使用者可以免費試用嗎?
keyboard_arrow_down
我們為新使用者提供免費試用:系統自動生成的 API 金鑰內含一千萬詞元,可用於我們的任何模型。免費額度用完後,您可以在「儲值」標籤頁為金鑰購買更多詞元。
attach_money
失敗的請求是否會扣除詞元?
keyboard_arrow_down
不,失敗的請求不會扣除詞元。
attach_money
接受哪些付款方式?
keyboard_arrow_down
付款透過 Stripe 處理,支援信用卡、Google Pay、PayPal 等多種方式,方便您選擇。
attach_money
儲值後可以開具發票嗎?
keyboard_arrow_down
可以,儲值後發票會傳送到與您 Stripe 帳戶關聯的郵箱。
attach_money
如何購買商業授權證而不是API令牌?
keyboard_arrow_down
在本站購買代幣僅涵蓋使用託管的 Jina API。這些代幣不包含您在自有基礎設施上執行模型權重的許可。為此,Elastic 自 2026 年 8 月 10 日起以商業授權的形式單獨銷售,按年收費,而非按代幣收費。如需報價,請聯絡 Elastic Sales。
attach_money
我可以用發票或採購訂單付款,而不是用信用卡嗎?
keyboard_arrow_down
自助代幣購買透過 Stripe 處理,發票將自動傳送到您的 Stripe 帳戶郵箱。對於採購訂單、採購流程或超出自助儲值支援的交易量,請聯絡 Elastic Sales。
attach_money
我已付款,但餘額或速率限制沒有變化,該檢查什麼?
keyboard_arrow_down
餘額和速率限制屬於 API key,不屬於帳號,所以先查 key 本身而不是帳號頁面:在「API Key & Billing」分頁中輸入該 key,確認餘額和級距。如果帳號下有多個 key,token 充在了已儲值的那個 key 上,未必是您應用實際在用的那個。另外付款後新級距生效可能有短暫延遲。如果 key 已顯示餘額、但過後仍被限制在原級距,請聯絡支援。
attach_money
如何取消、關閉自動儲值或刪除已儲存的付款方式?
keyboard_arrow_down
自助計費在客戶門戶中管理,入口在「API Key & Billing」分頁,可在那裡關閉自動儲值、移除已儲存的付款方式。關閉自動儲值只是停止後續扣款,已購買的餘額仍可繼續使用。如果您還需要刪除帳號及其資料,或希望申請退款,請把請求發給支援;帳號刪除為人工處理,需要幾個工作日,完成後會有書面確認。
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 徽標
open_in_new
下載 Elastic 徽標
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業人士使用。不面向任何消費者,也不鼓勵任何消費者使用。