Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
Elastic Inference Service
在 Elasticsearch 中原生运行 Jina 模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login

重排模型

用我们前沿的 Reranker API,把搜索相关性和 RAG 准确率推到极致。

Reranker API

试试我们前沿的 Reranker API,把搜索相关性和 RAG 准确率推到极致。免费开始!
keyAPI 密钥与计费
code用量
more_horiz更多
chevron_leftchevron_right

home
speed速率限制
bug_report问题反馈
help_outline常见问题
服务状态
chevron_leftchevron_right

返回文档数量
top_n
top_k
最多返回多少篇排名靠前的文档。

upload
请求
POST
curl "https://api.jina.ai/v1/rerank" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{ "model": null, "query": "Organic skincare products for sensitive skin", "top_n": 3, "documents": [ text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.", text_fieldsclose"New makeup trends focus on bold colors and innovative techniques: Step into the world of cutting-edg…atement with every look.", text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.", text_fieldsclose"Neue Make-up-Trends setzen auf kräftige Farben und innovative Techniken: Tauchen Sie ein in die Welt…jedes Mal ein Statement.", text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.", text_fieldsclose"Las nuevas tendencias de maquillaje se centran en colores vivos y técnicas innovadoras: Entra en el … y destaca en cada look.", text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。", text_fieldsclose"新的化妆趋势注重鲜艳的颜色和创新的技巧:进入化妆艺术的新纪元,本季的化妆趋势以大胆的颜色和创新的技巧为主。无论是霓虹眼线还是全息高光,每一款妆容都能让您脱颖而出,展现独特魅力。", text_fieldsclose"敏感肌のために特別に設計された天然有機スキンケア製品: アロエベラとカモミールのやさしい力で、自然の抱擁を感じてください。敏感肌用に特別に設計された私たちのスキンケア製品は、肌に優しく栄養を与え、保護します。肌トラブルにさようなら、輝く健康な肌にこんにちは。", text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。" + 添加输入 ], "return_documents": false }
EOFEOF


v3.5:用混合注意力与自蒸馏实现更快的列表式重排

jina-reranker-v3.5 is a 0.6B parameter multilingual listwise reranker with a 131K context window. Hybrid attention and self-distillation make it both faster and more robust across domains than v3, and it is a drop-in replacement: the request schema is unchanged.
阅读发布说明arrow_forward

m0:多语言多模态文档重排模型

全新的多模态多语言重排模型,可跨语言检索视觉文档,在多语言长文档和代码搜索任务上性能业界领先。
阅读发布说明arrow_forward

什么是重排模型?

搜索系统的目标,是又快又准地找到最相关的结果。传统做法是用 BM25 或 tf-idf 这类关键词匹配算法给结果排序;近年来基于向量的余弦相似度也被广泛采用,成为众多向量数据库的标配。这些方法都很直接,但常常会漏掉语言的微妙之处,更重要的是,漏掉文档与查询意图之间的关联。 重排模型正是为此而生。它是一种高级 AI 模型,接过搜索的初始候选集(通常来自向量检索或基于词元的检索),重新评估这些结果与用户意图的贴合程度。它不止步于字面匹配,而是深入挖掘查询与文档内容之间更深层的交互。
account_tree
在搜索系统中,重排模型的工作方式如下:

1
初始检索
搜索系统先根据用户查询,用向量或 BM25 粗筛出一批可能相关的文档。

2
重排
重排模型接手这批初筛结果,在更精细的粒度上分析文档,关注查询词与文档内容之间交互的细微差别。

3
结果更优
基于这层更深入的分析,重排模型重新排列搜索结果,把它认为最相关的排到最前面。

重排模型能大幅提升搜索质量,因为它在子文档和子查询的粒度上工作:逐个考察词与短语的含义,以及它们在查询和文档内部的相互关系。由此得到的搜索结果更精确,也更贴合上下文。
Jina Reranker v2 于 2024 年 6 月 25 日发布,专为 Agentic RAG 打造。它支持函数调用、100 多种语言的多语言检索和代码搜索,速度比 v1 提升 6 倍。了解更多 v2 模型信息。
多语言检索
Reranker v2 支持超过 100 种语言的文档检索,无论查询语言是什么。

函数调用和代码搜索
Reranker v2 可根据自然语言查询对代码片段和函数签名排序,非常适合 Agentic RAG 应用。

表格和结构化数据支持
Reranker v2 可根据自然语言查询排出最相关的表,在生成 SQL 查询前帮您从多种表结构中找出最匹配的一个。

两种购买方式

订阅我们的 API,或通过云服务商购买。
radio_button_unchecked
cloud
携手 3 家云服务商
在用 AWS 或 Azure?您可以直接在公司的云平台上部署我们的模型,并通过云服务商账户统一结算。
AWS SageMaker
Embeddings
Reranker
Microsoft Azure
Embeddings
Reranker
Google Cloud
Embeddings
radio_button_checked
使用 Jina Search Foundation API
访问我们全部产品最简单的方式,按需充值词元。
为此 API 密钥充值更多词元
根据您所在的地区,扣款币种可能为美元、欧元或其他货币,并可能需要缴纳税费。
请输入正确的 API 密钥以充值
了解速率限制
速率限制指每个 IP 地址/API 密钥每分钟可发起的最大请求数(RPM)。各产品和各档位的速率限制详见下表。
keyboard_arrow_down
速率限制
速率限制按以下维度统计:RPM(每分钟请求数)和 TPM(每分钟词元数)。限制按 IP/API 密钥分别计算,RPM 或 TPM 任一先达到阈值即触发限制。若您在请求头中提供了 API 密钥,我们将按密钥而非 IP 地址统计速率限制。
产品API 端点描述arrow_upward无 API 密钥key_off免费 API 密钥key付费 API 密钥key高级 API 密钥key平均延迟词元用量计算方式允许的请求
Reader APIhttps://r.jina.ai将 URL 转换为大模型友好文本20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s按输出响应中的词元数计算。GET/POST
Reader APIhttps://s.jina.ai搜索网络并将结果转换为大模型友好文本block100 RPM100 RPMtrending_up1000 RPM2.5s每次请求消耗固定数量的词元,起步 10000 个词元GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank按查询对文档重排block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST
向量模型 APIhttps://api.jina.ai/v1/embeddings将文本/图片转为定长向量block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST

私有化部署

可在 AWS Sagemaker 和 Microsoft Azure 上部署 Jina Reranker,Google Cloud Services 也即将支持;也可以联系我们的销售团队,为您的虚拟私有云和私有化部署服务器定制 Kubernetes 部署方案。
AWS SageMaker
Embeddings
Reranker
Microsoft Azure
Embeddings
Reranker
Google Cloud
Embeddings

重排模型、向量搜索与 BM25 对比

下表全面对比了重排模型、向量搜索和 BM25,逐项列出它们各自的长处与不足。
重排模型向量搜索BM25
适用场景提升搜索精度与相关性初步快速筛选面向各类查询的通用文本检索
粒度精细:子文档与查询片段级粗放:整篇文档级居中:各类文本片段级
查询时间复杂度高中低
索引时间复杂度无需高低,可复用预建索引
训练时间复杂度高高无需
搜索质量处理细微差别的查询更出色兼顾效率与准确性面向各类查询表现稳定可靠
优势准确率高,能深入理解上下文快速高效,准确度中等扩展性强,效果久经验证
免费试用 Reranker API免费使用向量模型 API

了解重排模型

什么是重排模型?为什么向量搜索或余弦相似度还不够?读我们的完整指南,从零开始了解重排模型。
八月 03, 2026 • 11 分钟阅读
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
七月 20, 2026
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
Listwise rerankers are the discriminative core of agentic retrieval pipelines, yet production deployment demands efficiency, domain robustness, and fluency on semi-structured data at the same time. We present jina-reranker-v3.5, a 0.6B-parameter listwise reranker that meets these demands together without sacrificing the cross-document comparison that makes its predecessor jina-reranker-v3 effective. It replaces uniform global attention with a hybrid schedule of three sliding-window layers followed by two global layers, pinning the terminal layer to global as last-but-not-late readout requires. It trains on a curated multi-domain mixture spanning legal, medical, financial, multilingual, and structured retrieval, and transfers quality through a three-stage self-distillation recipe in which a full-attention teacher sets an upper bound that a sparse-attention student then recovers. jina-reranker-v3.5 reaches 63.20 nDCG@10 on BEIR, matching a 4B model at roughly 7x fewer parameters, and lifts semi-structured retrieval by 9.6 nDCG@10 over jina-reranker-v3 while cutting listwise inference latency by up to 1.56x.
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
十月 03, 2025 • 7 分钟阅读
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
十月 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
jina-reranker-v3 is a 0.6B parameter multilingual document reranker that introduces a novel last but not late interaction. Unlike late interaction models such as ColBERT that perform separate encoding followed by multi-vector matching, our approach conducts causal self-attention between query and documents within the same context window, enabling rich cross-document interactions before extracting contextual embeddings from the last token of each document. This compact architecture achieves state-of-the-art BEIR performance with 61.94 nDCG@10 while being significant smaller than generative listwise rerankers.

常见问题

Reranker API 的费用是多少?
keyboard_arrow_down
Reranker API 的定价与 Embeddings API 一样,均采用基于代币的定价结构,所有 Jina API 使用同一密钥共享代币。新开通的 API 密钥包含免费代币,方便用户快速上手;此外,用户还可以购买代币包。详情请参阅定价部分。
Jina 重排器之间有什么区别?
keyboard_arrow_down
jina-reranker-v3.5 是我们目前的旗舰产品:一个拥有 0.6 亿参数、13.1 万上下文的多语言列表重排序器,可直接替代 jina-reranker-v3。它在所有衡量指标上都优于 v3,尤其在结构化数据和法律检索方面提升最为显著,运行速度也提升了 1.22 倍到 1.56 倍。jina-reranker-v3 仍然可用。jina-reranker-m0 是一个用于对视觉文档进行排序的多模态重排序器。jina-reranker-v2-base-multilingual 是一个较小的交叉编码器,支持 100 多种语言,当您需要一个非 Qwen 衍生模型时非常有用。jina-colbert-v2 使用 89 种语言的后期交互。
Jina排名器是如何获得授权的?
keyboard_arrow_down
jina-reranker-v3.5、jina-reranker-v3、jina-reranker-m0、jina-reranker-v2-base-multilingual 和 jina-colbert-v2 均以 CC-BY-NC 4.0 许可发布。您可以免费使用、分享和改编它们用于非商业用途。商业生产用途需要商业许可,Elastic 自 2026 年 8 月 10 日起以 Jina On-Prem 的名称作为其独立 SKU 进行销售。请联系 Elastic Sales 获取报价。旧版 jina-reranker-v1-* 模型仍使用 Apache-2.0 许可。
重排模型支持多种语言吗?
keyboard_arrow_down
是的,目前所有重排序工具都支持多语言。jina-reranker-v3.5 在 MIRACL 和多语言检索方面都比 v3 版本有所改进。jina-reranker-v3 和 jina-reranker-v2-base-multilingual 支持 100 多种语言,jina-reranker-m0 处理多语言可视化文档排序,而 jina-colbert-v2 支持 89 种语言。
每个重排序器的最大上下文长度是多少?
keyboard_arrow_down
上下文长度因模型而异:

jina-reranker-v3.5: 131,072 个词元(查询加上所有文档的总和),启用自动截断
jina-reranker-v3: 131,072 个词元,启用自动截断
jina-reranker-m0: 10,000 个词元
jina-reranker-v2-base-multilingual: 1,024 个词元,对较长的文档启用自动分块
jina-colbert-v2: 8,192 个词元

对于 v1 和 v2 重排序器,查询会自动截断,长文档会使用跨块最大池化进行分块。
每次查询可重排的文档数量有上限吗?
keyboard_arrow_down
单次请求的文档数量没有硬性上限。与向量模型 API 一样,Reranker API 会按词元数在内部自动分批,以充分利用 GPU。您可以在一次请求中发送任意数量的文档。
对 100 个文档重排时,预计延迟会是多少?
keyboard_arrow_down
延迟从 100 毫秒到 7 秒不等,主要取决于文档和查询的长度。例如,使用 64 个词元的查询对 100 个包含 256 个词元的文档进行重排大约需要 150 毫秒。将文档长度增加到 4096 个词元将使时间增加到 3.5 秒。如果查询长度增加到 512 个词元,则时间进一步增加到 7 秒。
以下是对一个查询和 100 个文档进行重排的时间成本(以毫秒为单位):
每个文档中的词元数量
查询中的词元数量256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
重新排名工具可以私有托管吗?例如,托管在我自己的基础架构或我自己的云账户中?
keyboard_arrow_down
是的。您可以在 AWS、Azure 和 GCP Marketplace 上找到这些重新排序工具,并将它们部署到您自己的云账户中。对于自管理、本地部署或物理隔离的基础设施,Elastic 提供商业许可(Jina On-Prem),该许可将模型以完全离线的 Docker 容器形式交付。请联系 Elastic Sales 获取报价。
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
你们是否提供基于特定领域数据进行微调的重新排名工具?
keyboard_arrow_down
在委托进行微调之前,不妨先试试 jina-reranker-v3.5:它采用自蒸馏技术专门针对特定领域进行了训练,具有很强的鲁棒性,并且在法律和结构化数据检索方面比 v3 版本有了显著提升。一个精心挑选的现成重排序器加上更优化的分块处理通常比微调更能有效弥补差距,而且测试是免费的。如果它仍然无法满足您的数据需求,您可以考虑定制一个特定领域的重排序器:请联系 Elastic Sales 来了解具体需求。
联系我们
文档图片的最小尺寸是多少?
keyboard_arrow_down
jina-reranker-m0 模型可接受的最小图像尺寸为 28x28 像素。
什么是列表式重排?它和逐点式重排有何不同?
keyboard_arrow_down
jina-reranker-v3 和 jina-reranker-v3.5 采用列表式架构:查询和所有候选文档共享一个上下文窗口,并在一次前向传播中完成评分,因此模型可以相互比较文档。传统的逐点重排序器,例如 jina-reranker-v2-base-multilingual,则独立地对每个文档与查询进行评分。列表式评分更加准确,因为相关性通常是相对于候选集中其他文档而言的。
为什么 API 强制执行的上下文长度与模型支持的上下文长度不同?
keyboard_arrow_down
某些重排序器架构上能够处理比托管 API 所接受的更长的上下文。非常长的序列会消耗大量的 GPU 内存,我们会针对大多数使用场景调整服务配置,以平衡吞吐量、延迟和成本。如果您需要完整的架构上下文长度,请在您自己的基础设施上运行模型,并联系 Elastic Sales 获取商业许可。
Reranker API 的速率限制是多少?
keyboard_arrow_down
速率限制取决于您的 API 密钥类型:

免费版: 100 RPM,100K TPM
付费版: 500 RPM,2M TPM
高级版: 5,000 RPM,50M TPM

此外,还有基于 IP 地址的限制,每 60 秒最多 10,000 次请求。这些限制同样适用于 Embeddings 和 Reranker API,并且所有 Jina API 使用同一密钥共享token。
我应该选择哪款重新排名工具?
keyboard_arrow_down
对于文本,请使用 jina-reranker-v3.5。它可直接替代 jina-reranker-v3:请求模式保持不变,因此只需切换模型字符串即可完成整个迁移。当候选对象是图像或包含丰富视觉内容的文档时,请使用 jina-reranker-m0。当您需要更小的模型或并非基于 Qwen 主干架构的模型时,请使用 jina-reranker-v2-base-multilingual。

如何获取我的 API 密钥?

video_not_supported

速率限制是多少?

速率限制
速率限制按以下维度统计:RPM(每分钟请求数)和 TPM(每分钟词元数)。限制按 IP/API 密钥分别计算,RPM 或 TPM 任一先达到阈值即触发限制。若您在请求头中提供了 API 密钥,我们将按密钥而非 IP 地址统计速率限制。
产品API 端点描述arrow_upward无 API 密钥key_off免费 API 密钥key付费 API 密钥key高级 API 密钥key平均延迟词元用量计算方式允许的请求
Reader APIhttps://r.jina.ai将 URL 转换为大模型友好文本20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s按输出响应中的词元数计算。GET/POST
Reader APIhttps://s.jina.ai搜索网络并将结果转换为大模型友好文本block100 RPM100 RPMtrending_up1000 RPM2.5s每次请求消耗固定数量的词元,起步 10000 个词元GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank按查询对文档重排block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST
向量模型 APIhttps://api.jina.ai/v1/embeddings将文本/图片转为定长向量block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST

我需要商业许可证吗?

CC BY-NC 许可自查

play_arrow
您使用的是我们托管的 API,还是我们在 Azure、AWS 或 GCP 上的官方镜像?
play_arrow
是
无需单独购买许可。商业用途已包含在服务条款中:通过本网站或云市场注册并付费即可。
play_arrow
否
play_arrow
您是否在自己运行模型权重,并用于商业产品或服务?
play_arrow
否
无需购买许可。下载、评估、跑基准测试和研究用途,在我们发布模型所用的每一种许可下都是允许的,注明出处即可。
play_arrow
是
play_arrow
该模型采用哪种许可协议?模型在 Hugging Face 上的页面会写明。
play_arrow
Apache-2.0
Apache-2.0 允许商业用途,无需购买许可。我们早期的 v1、v2 代模型采用这一许可。
play_arrow
CC BY-NC 4.0
您需要商业许可。自 2026 年 8 月 10 日起,Elastic 以独立 SKU 的形式销售 Jina 模型的商业许可,名为 Jina On-Prem。它覆盖自托管、本地部署和物理隔离(air-gapped)部署,且无需 Elasticsearch 订阅。
如果您已经是 Elastic 客户,您的客户团队可以把它并入现有合同。
联系 Elastic Sales
play_arrow
Qwen Research License
研究许可不允许任何商业用途,我们为其他模型提供的商业许可也不覆盖它。这个模型没有商业选项,自托管和走 API 都不行。请改用另外两种许可下的模型。
API 相关常见问题
code
我可以在所有 Jina API 中使用同一个 API 密钥吗?
keyboard_arrow_down
是的。一个 API 密钥可用于 Jina AI 搜索基础产品的所有功能,包括 Reader、Embeddings、Reranker、Classifier 和 Segmenter API,所有功能共享相同的token。
code
我可以查看 API 密钥的词元用量吗?
keyboard_arrow_down
可以,在“API 密钥与计费”标签页输入您的 API 密钥,即可查看近期用量记录和剩余词元。如果您已登录 API 控制面板,也可以在“管理 API 密钥”标签页查看这些信息。
code
如果我忘记了 API 密钥,该怎么办?
keyboard_arrow_down
如果您弄丢了已充值的密钥并希望找回,请用注册邮箱联系 support AT jina.ai。建议登录账户,这样 API 密钥可以安全保存、随时取用。
联系我们
code
API 密钥会过期吗?
keyboard_arrow_down
不会,API 密钥没有过期日期。如果密钥泄露,请在 API 密钥控制面板 中自行撤销,立即生效;想避免服务中断可以先申请一个替代密钥。任何剩余的 token 余额都留在账户里,而不是随撤销的密钥一起没了。如果您无法访问控制面板,或者怀疑账户本身被盗用,请联系 Elastic Support。
联系我们
code
可以在不同 API 密钥之间转移词元吗?
keyboard_arrow_down
可以,您能把词元从一个高级密钥转到另一个密钥。在 API 密钥控制面板登录账户后,进入待转出密钥的设置页,即可转移全部剩余的付费词元。
code
我可以销毁我的 API 密钥吗?
keyboard_arrow_down
可以,如果您认为密钥已泄露,可以销毁它。销毁后,所有保存该密钥的用户都会立即无法使用,剩余额度和关联属性也将永久失效。如果是高级密钥,您可以在销毁前把剩余的付费额度转移到另一个密钥。请注意,此操作无法撤销。要销毁密钥,请前往 API 密钥控制面板中的密钥设置。
code
为什么有些模型的首次请求比较慢?
keyboard_arrow_down
这是因为我们的无服务器架构会在使用率较低时卸载部分模型。首次请求会激活或“预热”模型,需要几秒钟。激活之后,后续请求的处理速度会快得多。
code
我的 API 数据会被用来训练你们的模型吗?
keyboard_arrow_down
不会。我们绝不会用您的 API 请求、输入或输出来训练向量模型、重排模型或任何其他模型。您的数据始终属于您。
code
Jina API 的速率限制是多少?
keyboard_arrow_down
每个 API 密钥均有速率限制:

免费版: 100 RPM,100K TPM
付费版: 500 RPM,2M TPM
高级版: 5,000 RPM,50M TPM

此外,每 60 秒还存在 10,000 次请求的 IP 地址限制。不同端点的限制有所不同;请参阅上方的速率限制表,了解每个端点的具体限制。
code
API 有批量大小限制吗?
keyboard_arrow_down
Embeddings 和 Reranker API 都没有批量大小限制,每次请求可以发送任意数量的条目或文档。两个 API 都会在内部按词元数对输入分批,以充分利用 GPU。
code
Jina API 与 Elastic 中的 Jina 模型是同一回事吗?
keyboard_arrow_down
不,这是三种不同的路径。本网站上的 Jina API 是自助式的,采用按需付费模式,需要 Jina API 密钥。Elastic Inference Service (EIS) 在 Elastic Cloud 中运行 Jina 模型,费用通过您的 Elastic 订阅收取,无需您管理任何基础设施。Jina On-Prem 是 Elastic 自 2026 年 8 月 10 日起作为其独立 SKU 销售的商业许可证,用于在您自己的自管理本地或物理隔离的基础设施中运行模型。有关 EIS 和 On-Prem 路径的更多信息,请联系 Elastic Sales。
与计费相关的常见问题
attach_money
API 是按句子数还是按请求数计费?
keyboard_arrow_down
我们按处理的词元总数计费,您可以把这些词元灵活分配到任意数量的句子上,用更低的成本满足各种文本分析需求。
attach_money
新用户可以免费试用吗?
keyboard_arrow_down
是的。新用户将获得一个自动生成的 API 密钥,其中包含可在我们所有模型中使用的免费代币。免费代币用完后,您可以在“购买代币”选项卡中为该密钥购买更多代币。
attach_money
失败的请求是否会扣除词元?
keyboard_arrow_down
不,失败的请求不会扣除词元。
attach_money
接受哪些付款方式?
keyboard_arrow_down
付款通过 Stripe 处理,支持信用卡、Google Pay、PayPal 等多种方式,方便您选择。
attach_money
充值后可以开具发票吗?
keyboard_arrow_down
对于自助代币购买,Stripe 会在购买时向您 Stripe 账户关联的电子邮件地址发送发票。如果您需要正式的采购订单、协商合同、采购文件或通过 Elastic 而非 Stripe 处理的合并账单,请联系 Elastic Sales。
attach_money
如何购买商业许可证而不是API令牌?
keyboard_arrow_down
在本站购买代币仅涵盖使用托管的 Jina API。这些代币不包含您在自有基础设施上运行模型权重的许可。为此,Elastic 自 2026 年 8 月 10 日起以商业许可的形式单独销售,按年收费,而非按代币收费。如需报价,请联系 Elastic Sales。
attach_money
我可以用发票或采购订单付款,而不是用信用卡吗?
keyboard_arrow_down
自助代币购买通过 Stripe 处理,发票将自动发送到您的 Stripe 帐户邮箱。对于采购订单、采购流程或超出自助充值支持的交易量,请联系 Elastic Sales。
attach_money
我已付款,但余额或速率限制没有变化,该检查什么?
keyboard_arrow_down
余额和速率限制属于 API key,不属于账号,所以先查 key 本身而不是账号页面:在「API Key & Billing」标签里输入该 key,确认余额和档位。如果账号下有多个 key,token 充在了被充值的那个 key 上,未必是您应用实际在用的那个。另外付款后新档位生效可能有短暂延迟。如果 key 已显示余额、但过后仍被限制在原档位,请联系支持。
attach_money
如何取消、关闭自动充值或删除已保存的付款方式?
keyboard_arrow_down
自助计费在客户门户中管理,入口在「API Key & Billing」标签,可在那里关闭自动充值、移除已保存的付款方式。关闭自动充值只是停止后续扣款,已购买的余额仍可继续使用。如果您还需要删除账号及其数据,或希望申请退款,请把请求发给支持;账号删除为人工处理,需要几个工作日,完成后会有书面确认。
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 徽标
open_in_new
下载 Elastic 徽标
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业人士使用。不面向任何消费者,也不鼓励任何消费者使用。