Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login

联系销售

与 Jina AI 一起拓展您的业务。

nights_stay 销售团队暂时离开,53 小时后返回。

两种购买方式

订阅我们的 API,或通过云服务商购买。
radio_button_unchecked
cloud
携手 3 家云服务商
在用 AWS 或 Azure?您可以直接在公司的云平台上部署我们的模型,并通过云服务商账户统一结算。
AWS SageMaker
向量模型
重排模型
Microsoft Azure
向量模型
重排模型
Google Cloud
向量模型
radio_button_checked
使用 Jina Search Foundation API
访问我们全部产品最简单的方式,按需充值词元。
为此 API 密钥充值更多词元
根据您所在的地区,扣款币种可能为美元、欧元或其他货币,并可能需要缴纳税费。
请输入正确的 API 密钥以充值
了解速率限制
速率限制指每个 IP 地址/API 密钥每分钟可发起的最大请求数(RPM)。各产品和各档位的速率限制详见下表。
keyboard_arrow_down
速率限制
速率限制按以下维度统计:RPM(每分钟请求数)和 TPM(每分钟词元数)。限制按 IP/API 密钥分别计算,RPM 或 TPM 任一先达到阈值即触发限制。若您在请求头中提供了 API 密钥,我们将按密钥而非 IP 地址统计速率限制。
产品API 端点描述arrow_upward无 API 密钥key_off免费 API 密钥key付费 API 密钥key高级 API 密钥key平均延迟词元用量计算方式允许的请求
Reader APIhttps://r.jina.ai将 URL 转换为大模型友好文本20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s按输出响应中的词元数计算。GET/POST
Reader APIhttps://s.jina.ai搜索网络并将结果转换为大模型友好文本block100 RPM100 RPMtrending_up1000 RPM2.5s每次请求消耗固定数量的词元,起步 10000 个词元GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank按查询对文档重排block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST
向量模型 APIhttps://api.jina.ai/v1/embeddings将文本/图片转为定长向量block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST

常见问题

Jina AI × Elastic

handshake
Jina 品牌会保留吗?
keyboard_arrow_down
是的。Jina 是 Elastic 旗下的一个模型品牌。您可以把它想象成 Qwen 之于阿里巴巴、GPT 之于 OpenAI,或者 Kimi 之于 Moonshot。其法律身份已转移至 Elastic,这使得 Jina AI 可以专注于搜索基础模型这一品牌本身。
handshake
Jina AI 今后会专注于什么?
keyboard_arrow_down
我们提供词向量、重排序器和小型模型,以优化搜索体验,其中包括多模态模型和阅读器模型。我们的使命尚未完成,但我们始终目标明确:成为领先的搜索模型提供商。
handshake
API 和云市场的产品还会继续吗?
keyboard_arrow_down
是的。Reader API、Embeddings API 和 Reranker API 仍在持续开发和维护,模型也继续发布到云市场平台。您可以像以前一样使用我们的 API 服务。唯一的例外是我们无法为受美国出口管制的实体或国家/地区提供服务。
handshake
你们还会在 Hugging Face 上发布开放权重模型吗?
keyboard_arrow_down
是的。在 Elastic,Jina 不断推进搜索基础模型的前沿发展,我们也持续发布开放权重模型。
handshake
这些开放模型会以哪种许可协议发布?
keyboard_arrow_down
目前大多数模型采用 CC-BY-NC 4.0 许可,预计会延续下去。早期的 v1、v2 代模型采用 Apache-2.0,可直接商用。其中 jina-embeddings-v4 沿用其基座模型的 Qwen Research License:该许可完全不允许商业用途,任何商业许可也不覆盖它。模型适用哪种许可,一律以其 Hugging Face 页面上标注的为准,不要按模型代次推断。在 CC-BY-NC 4.0 下,权重可免费下载、评估、跑基准测试和用于研究,注明出处即可;要在商业产品中运行则需要商业许可,Elastic 以独立 SKU 的形式销售。请联系 Elastic Sales 办理。
handshake
你们还会继续发表研究论文吗?
keyboard_arrow_down
是的。我们发布的每个模型都有严谨的论文作为支撑,我们也持续向 ICLR、EMNLP、SIGIR、NeurIPS 和 ICML 等顶级会议投稿。
handshake
我目前还不是 Jina 或 Elastic 的客户,但我想要使用 Reader API、模型 API 或云市场镜像。我应该怎么做?
keyboard_arrow_down
只需像以前一样,通过我们的网站或相关的云市场注册并付款即可。
handshake
我可以从 Elastic 购买 Jina 模型的商业许可吗?
keyboard_arrow_down
是的。自 2026 年 8 月 10 日起,Elastic 将以自有 SKU 的形式直接销售 Jina 模型的商业许可证。该许可证支持在您自行管理的本地部署或物理隔离的基础设施中运行 Jina 模型,可通过 Elastic 直销渠道、联邦政府渠道以及云服务提供商 (CSP) 获取。该产品名为 Jina On-Prem。如需获取报价,请联系 Elastic Sales。
handshake
Jina On-Prem 是什么?
keyboard_arrow_down
Jina On-Prem 是一个商业许可证,外加一套独立的 Docker 容器,让您可以在自己的基础设施内完全运行 Jina 模型。这些容器不建立任何外部连接:无需调用 Hugging Face 或任何模型注册表,也无需许可证服务器、遥测或日志记录端点,因此可以在物理隔离的网络中使用。它们涵盖了 Jina 的所有模型,包括向量模型、重排序模型和阅读器模型,并公开了 Elastic Inference Service (EIS)、OpenAI、Cohere、Voyage AI 和 Gemini 的 API 模式,因此现有应用程序无需更改代码即可运行。它是一个独立的 SKU:它不基于 Elastic Resource Units (ERU),您也无需运行 Elasticsearch 即可使用它。它还可以与开源 Elasticsearch 协同工作。自 2026 年 8 月 10 日起即可订购。如需了解供货情况和条款,请联系 Elastic Sales。
handshake
Jina On-Prem 的定价是多少?
keyboard_arrow_down
这是年度许可费,按您部署的模型以及运行推理的硬件规模计价,不按席位、节点或模型大小收费,也没有按 token 计费。纯 CPU 部署同样按用于推理的处理器数量计算。定价不走自助渠道:请联系 Elastic Sales 获取针对您部署规模的报价。
handshake
Jina On-Prem 的目标用户是谁?
keyboard_arrow_down
有些组织无法或不愿将数据发送到云端 AI 服务。典型案例包括:物理隔离且安全性高的环境、公共部门和国防领域、金融服务和医疗保健等受监管行业、对延迟要求极高或离线的系统,以及希望获得固定、可预测的推理成本而非按token计费的团队。如果您的部署符合上述情况,Elastic Sales 可以与您详细探讨相关细节。
handshake
我是 Elastic 的客户。我可以在不部署任何内容的情况下在 Elastic Cloud 中使用 Jina 模型吗?
keyboard_arrow_down
是的。Jina 模型可通过Elastic Inference Service (EIS) 获取,因此您无需配置机器学习节点或管理 GPU 基础设施即可使用它们进行数据摄取和搜索。EIS 上通常提供的模型包括:jina-embeddings-v5-text-small、jina-embeddings-v5-text-nano、jina-embeddings-v5-omni-small、jina-embeddings-v5-omni-nano、jina-embeddings-v3、jina-clip-v2,以及 jina-reranker-v3.5、jina-reranker-v3、jina-reranker-v2-base-multilingual 和 jina-reranker-m0 重排序器。请查阅 Elastic 文档,了解当前型号列表、支持的区域以及每个型号的最低堆栈版本。
handshake
我从Hugging Face下载了权重文件。我需要获得授权才能在生产环境中使用它们吗?
keyboard_arrow_down
取决于该模型采用哪种许可,以其 Hugging Face 页面上标注的为准。Apache-2.0 允许商业用途,无需另行购买。CC-BY-NC 4.0 下评估、跑基准测试和研究都是免费的,但商业生产用途需要商业许可,也就是 Jina On-Prem 提供的东西。研究许可则完全不允许商业用途,我们为其他模型提供的商业许可也不覆盖它,因此这类模型无论预算多少都不适合上生产。请注意这里说的是权重:商业调用托管 API 或官方云市场镜像无需单独购买许可。如需购买,请联系 Elastic Sales。
handshake
我想签署一份涵盖Jina模型的合同或定制协议。我应该怎么做?
keyboard_arrow_down
联系 Elastic Sales。Jina 模型的商业许可、合同签订和支持现在都通过 Elastic 的标准销售和支持流程进行。
handshake
我以中国企业的身份购买贵公司的服务。请问我可以拿到中文发票吗?
keyboard_arrow_down
自助 API 充值无法开具:这类付款由处理支付的主体自动开票,无法开中国发票(发票)。如果是合同采购(包括 Jina On-Prem),请联系 Elastic Sales 沟通可选的签约主体与开票安排。
handshake
我是 Elastic 的客户,想学习向量和重排序的最佳实践,或者我对 Jina AI 的发展很感兴趣。我应该怎么做?
keyboard_arrow_down
请联系 Elastic Sales,我们可以安排您、Jina AI 团队和 Elastic 之间的会议。
handshake
如果在我的许可期内你们发布了新模型,是否包含在内?
keyboard_arrow_down
许可期内发布的同类别模型都包含在内:无需重新签约或另行购买,许可密钥也不变,因为密钥是按类别而非单个模型签发的。例外是那些本身不允许商业用途的许可下的模型,任何商业许可都不覆盖它们。具体合同覆盖范围请与 Elastic Sales 确认。
handshake
商业许可包含哪些支持?由谁提供?
keyboard_arrow_down
许可包含企业级支持,遵循标准服务级别协议(SLA)。部署完全在您手里:您拉取容器镜像,在自己的环境里运行;安装遇到问题支持团队可以协助。支持和一切合同事项都走 Elastic 的标准流程。具体协议对应的服务级别请与 Elastic Sales 确认。
handshake
Jina 并入 Elastic 后,适用哪一份数据处理条款?
keyboard_arrow_down
数据处理适用 Elastic 的数据处理协议,而非此前 Jina AI GmbH 的条款。这一点对采购文件很关键,收购前起草、仍引用旧协议的文档建议重新核对。当前条款以及您所在司法管辖区的具体适用,请联系 Elastic Sales。

如何获取我的 API 密钥?

video_not_supported

速率限制是多少?

速率限制
速率限制按以下维度统计:RPM(每分钟请求数)和 TPM(每分钟词元数)。限制按 IP/API 密钥分别计算,RPM 或 TPM 任一先达到阈值即触发限制。若您在请求头中提供了 API 密钥,我们将按密钥而非 IP 地址统计速率限制。
产品API 端点描述arrow_upward无 API 密钥key_off免费 API 密钥key付费 API 密钥key高级 API 密钥key平均延迟词元用量计算方式允许的请求
Reader APIhttps://r.jina.ai将 URL 转换为大模型友好文本20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s按输出响应中的词元数计算。GET/POST
Reader APIhttps://s.jina.ai搜索网络并将结果转换为大模型友好文本block100 RPM100 RPMtrending_up1000 RPM2.5s每次请求消耗固定数量的词元,起步 10000 个词元GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank按查询对文档重排block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST
向量模型 APIhttps://api.jina.ai/v1/embeddings将文本/图片转为定长向量block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
取决于输入大小
help
按输入请求中的词元数计算。POST

我需要商业许可证吗?

CC BY-NC 许可自查

play_arrow
您使用的是我们托管的 API,还是我们在 Azure、AWS 或 GCP 上的官方镜像?
play_arrow
是
无需单独购买许可。商业用途已包含在服务条款中:通过本网站或云市场注册并付费即可。
play_arrow
否
play_arrow
您是否在自己运行模型权重,并用于商业产品或服务?
play_arrow
否
无需购买许可。下载、评估、跑基准测试和研究用途,在我们发布模型所用的每一种许可下都是允许的,注明出处即可。
play_arrow
是
play_arrow
该模型采用哪种许可协议?模型在 Hugging Face 上的页面会写明。
play_arrow
Apache-2.0
Apache-2.0 允许商业用途,无需购买许可。我们早期的 v1、v2 代模型采用这一许可。
play_arrow
CC BY-NC 4.0
您需要商业许可。自 2026 年 8 月 10 日起,Elastic 以独立 SKU 的形式销售 Jina 模型的商业许可,名为 Jina On-Prem。它覆盖自托管、本地部署和物理隔离(air-gapped)部署,且无需 Elasticsearch 订阅。
如果您已经是 Elastic 客户,您的客户团队可以把它并入现有合同。
联系 Elastic Sales
play_arrow
Qwen 研究许可证
研究许可不允许任何商业用途,我们为其他模型提供的商业许可也不覆盖它。这个模型没有商业选项,自托管和走 API 都不行。请改用另外两种许可下的模型。

其他问题

Reader 常见问题
使用 Reader API 需要多少费用?
keyboard_arrow_down
阅读器可免费用于基本用途:只需在 URL 前添加“https://r.jina.ai/”即可。提供 API 密钥会提高速率限制,并按内容长度计收词元费用。有关速率限制的详细信息,请参阅问题 16。
Reader API 是怎么工作的?
keyboard_arrow_down
Reader API 从服务器端获取 URL,并返回干净的、可直接用于 LLM 的文本。您可以使用 X-Engine 标头选择获取引擎:direct 会发出普通的 HTTP 获取请求,速度最快;默认引擎会在无头浏览器中渲染页面,因此客户端 JavaScript 会在提取之前执行;cf-browser-rendering 是一个实验性的、由 Cloudflare 支持的渲染器。导航、页眉、页脚和广告等样板内容会被移除,主要内容会被转换为 Markdown 格式。使用 X-Respond-With 可以获取同一页面的其他形状,使用 X-Target-Selector 或 X-Remove-Selector 可以保留或移除特定的 CSS 选择器。
Reader API 开源吗?
keyboard_arrow_down
Reader 服务代码可在 Jina AI GitHub 组织中找到。Reader 使用的模型,包括 ReaderLM-v2 和 jina-vlm,均采用 CC-BY-NC 4.0 许可,该许可并非开源许可:您可以免费下载并用于非商业用途,但商业生产用途需要商业许可。Elastic 自 2026 年 8 月 10 日起单独出售该许可;请联系 Elastic Sales 进行购买。
Reader API 的典型延迟是多少?
keyboard_arrow_down
这主要取决于引擎和页面本身。直接获取一个简单的页面通常只需几百毫秒,而默认浏览器引擎需要先加载并执行页面才能提取,因此通常需要几秒钟。大型单页应用、速度较慢的源服务器和大型 PDF 文件则需要更长时间。在 5 分钟内重复访问同一个 URL 会从缓存中获取,几乎立即返回结果,因此“热 URL”比“冷 URL”快得多。
我为什么要用 Reader API,而不是自己抓页面?
keyboard_arrow_down
自己抓取既麻烦又不稳定,遇到复杂或动态页面尤其如此。Reader API 直接给出干净、可靠、适合大模型阅读的文本。
Reader API 支持多种语言吗?
keyboard_arrow_down
Reader API 与语言无关,并以页面原始语言返回内容;它不会进行翻译。内容协商可通过 X-Locale 标头实现,该标头设置渲染时使用的浏览器区域设置,因此,对于针对不同区域提供不同标记的网站,可以将其定向到所需的版本。
Reader API 是否遵循网站访问控制?
keyboard_arrow_down
遵循。Reader 作为标准网页客户端运行,会遵循网站的访问控制。如果网站拒绝了请求,我们就尊重这一结果。您有责任确保使用 Reader 时符合所访问网站的条款,且不侵犯第三方知识产权。
Reader API 能提取 PDF 文件的内容吗?
keyboard_arrow_down
可以,Reader API 原生支持从 PDF 文件中提取内容。
Reader API 能处理网页中的媒体内容吗?
keyboard_arrow_down
可以,Reader 支持通过 x-with-generated-alt 请求头为网页图片生成描述。它会给缺少 alt 标签的图片补上描述性文字,让大模型也能理解视觉内容。视频摘要功能计划在后续版本中推出。
可以用 Reader API 处理本地 HTML 文件吗?
keyboard_arrow_down
不可以,Reader API 只能处理可公开访问的 URL。
Reader API 会缓存内容吗?
keyboard_arrow_down
如果您在 5 分钟内重复请求同一个 URL,Reader API 会返回缓存内容。
可以用 Reader API 访问需要登录才能看的内容吗?
keyboard_arrow_down
是的,适用于接受基于 Cookie 的会话的页面。使用 X-Set-Cookie 标头传递您的会话 Cookie,读取器会在获取 URL 时转发这些 Cookie,使用与普通 Set-Cookie 相同的 <name>=<value> 格式,还可以选择使用 ; domain= 指定作用域。携带 Cookie 的请求不会被缓存,因此每次请求都是一次全新的获取。这不会为您执行登录操作:它会重放您已持有的凭据,因此您需要自行获取这些凭据并遵守目标网站的服务条款。需要交互式登录、多因素身份验证 (MFA) 或页面自身获取的持有者token的流程不在此范围内。
可以用 Reader API 访问 arXiv 上的 PDF 吗?
keyboard_arrow_down
可以,您既能用 Reader 的原生 PDF 支持(https://r.jina.ai/https://arxiv.org/pdf/2310.19923v4),也能改用 arXiv 的 HTML 版本(https://r.jina.ai/https://arxiv.org/html/2310.19923v4)
Reader 的图片描述功能是怎么工作的?
keyboard_arrow_down
Reader 会为目标 URL 上的所有图片生成描述,并以 Image [idx]: [caption] 的形式补充为 alt 标签(前提是图片原本没有)。这样下游大模型就能在推理、摘要等环节用上这些图片。
Reader 的可扩展性如何?可以用在生产环境吗?
keyboard_arrow_down
Reader API 在设计上具备很强的扩展性,会根据实时流量自动扩容,目前最大并发请求数约为 4000。它是 Jina AI 的核心产品之一,我们一直在积极维护,请放心用于生产环境。
Reader API 的速率限制是多少?
keyboard_arrow_down
最新的速率限制信息见下表。请注意,我们仍在持续优化 Reader API 的速率限制和性能,该表会随之更新。
speed速率限制
ReaderLM是什么?我该如何使用它?
keyboard_arrow_down
ReaderLM-v2 是一个 15.4 亿参数的小型语言模型,可将原始 HTML 转换为简洁的 Markdown 或 JSON,并可使用 JSON 模式或自然语言指令提取结构化数据。您可以通过 Reader API 并添加 x-respond-with: readerlm-v2 请求头来使用它,也可以从 AWS、Azure 或 GCP Marketplace 部署它。对于包含大量图像或扫描文档的情况,jina-vlm 是我们拥有 24 亿参数的视觉语言阅读器模型。
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
如何从网页中提取结构化数据?
keyboard_arrow_down
加上 x-json-schema 请求头并给出 JSON schema 定义,或者加上 x-instruction 请求头并给出自然语言指令。这两种方式都由 ReaderLM-v2 支撑,可以把任意网页中的价格、标题、日期等字段抽取成结构化 JSON。
Reader 是否会主动绕过网站的反机器人保护?
keyboard_arrow_down
不会。Reader 不会主动规避或绕过任何网站的防御机制、反爬系统或访问控制。如果网站把我们的服务识别为机器人并拒绝请求,我们就尊重这一结果。我们作为标准网页客户端运行,不使用任何逃避检测的技术。您仍需自行确保使用 Reader 时尊重第三方知识产权和所访问网站的条款。
从免费 API 密钥升级到付费 API 密钥后,我能访问更多网站吗?
keyboard_arrow_down
不会。从免费套餐升级到付费 API 密钥,并不会让您访问更多网站,也不会绕过任何站点限制。套餐之间的区别主要在速率限制和性能优化:付费密钥的请求吞吐量更高、处理更快,但无法访问那些屏蔽我们服务的网站。
我可以在自己的基础设施内运行 Reader 吗?
keyboard_arrow_down
是的。读取器模型以独立的离线 Docker 容器形式交付,并采用 Elastic 自 2026 年 8 月 10 日起作为其独立 SKU 销售的 Jina On-Prem 商业许可。这适用于物理隔离和防火墙环境,容器不会建立任何类型的出站连接。请注意,获取任意公共网页仍然需要网络访问权限;本地部署的优势在于可以在本地运行提取模型。如需报价,请联系 Elastic Sales。
向量模型相关的常见问题
Jina 向量模型是如何训练的?
keyboard_arrow_down
有关我们的训练流程、数据来源和评估的详细信息,请参阅 arXiv 上的技术报告。jina-embeddings-v5 文本模型的训练分为两个阶段:首先从更大的教师模型中提取向量,然后在冻结的主干权重上进行特定任务的 LoRA 适配器训练。v5-omni 多模态变体增加了一个第三阶段,该阶段仅训练跨模态投影器,而文本主干和适配器保持冻结状态。
launcharXiv
你们的多模态向量模型是什么?
keyboard_arrow_down
jina-embeddings-v5-omni-small(约 17.4 亿参数,1024 维,3.2 万上下文)和 jina-embeddings-v5-omni-nano(约 10.4 亿参数,768 维,8 千上下文)是我们目前的多模态模型。它们在一个共享的向量空间中接受文本、图像、音频、视频和 PDF 文件,因此您可以在一种模态中建立索引,然后在另一种模态中查询,而无需重新索引。它们的纯文本输出分别与 jina-embeddings-v5-text-small 和 jina-embeddings-v5-text-nano 相同,这意味着您可以将多模态输入添加到现有的文本索引中,而无需重新嵌入。jina-clip-v2(8.65 亿参数)仍然可用,作为一种更轻量级的文本和图像选项。
launcharXiv
你们的模型支持哪些语言?
keyboard_arrow_down
自 2024 年起发布的所有模型均支持多语言。jina-embeddings-v5-text-small 和 v5-omni 模型基于 Qwen3 骨干网构建,具有广泛的多语言覆盖;jina-embeddings-v5-text-nano 基于 EuroBERT-210M 构建,涵盖 15 种主要的欧洲和全球语言,包括英语、法语、德语、西班牙语、中文、日语、阿拉伯语和印地语。jina-embeddings-v3 和 jina-clip-v2 支持 89 种语言。有关每种语言的基准测试数据,请参阅各模型技术报告中的 MMTEB 结果。
launcharXiv
单个输入的最大上下文长度是多少?
keyboard_arrow_down
上下文长度因模型而异:jina-embeddings-v5-text-small 和 jina-embeddings-v5-omni-small 最多支持 32,768 个 token,而 jina-embeddings-v5-text-nano 和 jina-embeddings-v5-omni-nano 支持 8,192 个 token。jina-embeddings-v4 和 jina-code-embeddings 模型支持 32,768 个 token;jina-embeddings-v3、jina-clip-v2 和 jina-colbert-v2 支持 8,192 个 token。除非设置 truncate: true,否则超过限制的输入将返回错误。
单次请求中最多可以包含多少个输入?
keyboard_arrow_down
每次请求包含的项目数量没有硬性限制。API 会根据token数量对输入进行内部分批处理,以实现最佳 GPU 利用率,因此您可以在单个请求中发送任意数量的文本或图像。PDF 文件除外:每次请求只能发送一个 PDF 文件。
如何将图像、音频、视频或 PDF 发送到多模态模型?
keyboard_arrow_down
使用 image、audio、video 或 pdf 键,将类型化对象传递到 input 数组中。该键的值可以是公开 URL 或 base64 编码的字节。模型会将每种模态的数据路由到相应的编码器,您可以在单个批次中自由混合使用不同的模态。支持的音频格式包括 WAV、MP3、FLAC、OGG、M4A 和 Opus;视频以 32 帧均匀采样的方式进行处理。每个请求必须发送一个 PDF 文件。
Jina 向量模型与最新的 OpenAI、Cohere 和 Voyage 模型相比如何?
keyboard_arrow_down
jina-embeddings-v5-text-small(6.77亿参数)是MMTEB数据集上参数量低于10亿时性能最强的模型,任务级平均得分为67.0,在英语MTEB数据集上的平均得分更是高达71.7。jina-embeddings-v5-text-nano(2.39亿参数)在MMTEB数据集上得分为65.5,优于我们评估的所有参数量低于5亿时的模型。我们的设计目标是每个参数的性能,而非原始参数量,因此这些模型在提供相当或更优检索质量的同时,比大多数替代方案的部署成本更低。所有v5模型都支持Matryoshka表示学习,因此您可以将维度截断至32而无需重新训练。
如何从 OpenAI 的 text-embedding-3-large 迁移到 Jina Embeddings 模型?
keyboard_arrow_down
迁移过程非常简单:我们的 API 端点 与 OpenAI 的 text-embedding-3-large 的输入和输出 JSON 模式相匹配,因此在大多数代码库中,您只需更改基本 URL、API 密钥和模型名称即可。Jina On-Prem 容器也同样如此,它们还公开了 Elastic Inference Service (EIS)、Cohere、Voyage AI 和 Gemini 模式,因此 Jina 模型可以直接替换现有代码路径中的模型。请注意,来自不同模型系列的向量不具有可比性,因此您必须重新嵌入语料库,而不是将来自两个提供商的向量混合在一个索引中。有关 Jina On-Prem 容器本身的信息,请联系 Elastic Sales。
如何计算图像和其他非文本输入的词元?
keyboard_arrow_down
文本按标准方式计数。非文本输入由相应的编码器转换为标记(token),其成本很大程度上取决于您使用的模型,因此请使用您自己的输入进行测量,而不是假设。作为参考,一张 600x600 像素的图像的成本约为: • jina-embeddings-v5-omni-small:约 363 个标记 • jina-embeddings-v5-omni-nano:约 362 个标记 • jina-embeddings-v4:约 4,840 个标记 • jina-clip-v2:约 16,000 个标记 v5-omni 模型每张图像的成本比旧模型低一到两个数量级。每个响应都包含一个 usage 对象,其中包含该请求的确切token计数,包括多模态输入的 image_tokens 细分,以便您可以验证每次调用的成本。
你们提供用于嵌入图像、音频或视频的模型吗?
keyboard_arrow_down
是的。jina-embeddings-v5-omni-small 和 jina-embeddings-v5-omni-nano 将文本、图像、音频、视频和 PDF 嵌入到同一个共享的向量空间中。jina-embeddings-v4 和 jina-clip-v2 则处理文本和图像。
Jina向量模型能否在私人数据或公司数据上进行微调?
keyboard_arrow_down
有两种途径。自助式途径是使用微调 API,它可以根据您对领域的描述生成合成训练数据,并返回一个微调后的模型,而无需您自行构建带标签的数据集。如果您需要根据商业协议在专有数据上、专用基础设施上,或使用不在基础模型选择器中的模型进行微调,请联系Elastic Sales;这项工作由 Elastic 负责范围界定和合同签订。
联系我们
模型可以私有托管吗?比如托管在我自己的基础设施上或者我自己的云账户里?
keyboard_arrow_down
是的,有两种方式。Jina 模型已在 AWS、Azure 和 GCP Marketplace 上架,因此您可以将其部署在您自己的云账户中。对于自管理、本地部署或物理隔离的基础设施,Elastic 提供名为 Jina On-Prem 的商业许可,该许可自 2026 年 8 月 10 日起生效,它将模型以完全离线的 Docker 容器形式交付,无需外部调用,也无需许可证服务器。如需获取报价,请联系 Elastic Sales。
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
task 参数是什么?什么时候该用它?
keyboard_arrow_down
task 参数会选择特定任务的 LoRA adapter 以获得最佳效果。retrieval.query 用于检索的查询侧,retrieval.passage 用于被检索的文档侧,text-matching 用于对称相似度(例如去重或改写检测),classification 用于分类,separation 用于聚类。检索是不对称的,把查询/文档两侧用反会明显掉点。支持该参数的模型有 jina-embeddings-v5、jina-embeddings-v4 和 jina-embeddings-v3。
什么是迟交互检索?哪些模型支持?
keyboard_arrow_down
迟交互保留词元级向量,而不是将文档合并成一个向量,这样虽然会增加索引大小,但可以保留更细粒度的细节信息。jina-embeddings-v4 通过 output_type 参数支持密集(单向量)和迟交互(多向量)输出,而 jina-colbert-v2 则是一个专用的迟交互模型。对于大多数检索流程而言,使用密集 v5 模型后接重排序器可以获得更好的准确率/成本平衡。
什么是延迟分块?什么时候该用它?
keyboard_arrow_down
延迟分块首先使用长上下文模型对整个文档进行嵌入,然后从词元级表示中导出块向量。与将每个块孤立嵌入的朴素分块不同,延迟分块保留了跨块上下文,这提高了 RAG 管道中的检索质量,因为在这些管道中,一个块引用了文档中前面定义的内容。使用 late_chunking 参数启用此功能。
为什么 API 强制执行的上下文长度与模型支持的上下文长度不同?
keyboard_arrow_down
某些模型在架构上能够处理比托管 API 所接受的更长的上下文。非常长的序列会消耗大量的 GPU 内存,我们会针对大多数用例调整服务配置,以平衡吞吐量、延迟和成本。如果您需要完整的架构上下文长度,请自行运行模型:联系 Elastic Sales 了解自助部署方案。
为什么 jina-embeddings-v4 是免费的,速度又比较慢?
keyboard_arrow_down
jina-embeddings-v4 基于 Qwen2-VL 基础模型构建,该模型以 Qwen 研究许可发布,仅允许用于研究和非商业用途。因此,我们无法对其进行商业授权,而是通过 API 免费提供。此外,它是一个 38 亿参数模型,因此每次请求的处理速度较慢,并且我们限制了其吞吐量以控制基础设施成本。它不适用于生产工作负载,因此,它不通过 Elastic Inference Service 提供,也不作为 Jina On-Prem 的一部分提供。对于生产环境,请使用 jina-embeddings-v5 系列:它速度更快,检索基准测试结果更出色,并且可以通过 Elastic Sales 获得商业授权。
Embeddings API 的速率限制是多少?
keyboard_arrow_down
速率限制取决于您的 API 密钥类型:

免费版: 100 RPM,100K TPM
付费版: 500 RPM,2M TPM
高级版: 5,000 RPM,50M TPM

为防止滥用,每 60 秒还存在 10,000 次请求的额外 IP 限制。限制按密钥应用,并在 60 秒窗口内计算,因此突发请求会被平滑处理而不是排队;超过限制的请求将返回 HTTP 429 错误,并应使用指数退避算法重试。如果您需要超出高级版级别的限制,或者完全没有共享租户限制的专用容量,请联系 Elastic Sales。
我应该选择哪种向量模型?
keyboard_arrow_down
文本检索建议首先使用 jina-embeddings-v5-text-small:它是我们提供的最强大的小于 10 亿参数的模型,可处理 32K 上下文。如果延迟、成本或边缘硬件比精度更重要,则应使用 jina-embeddings-v5-text-nano。处理图像、音频、视频或 PDF 时,请使用 jina-embeddings-v5-omni-small 或 v5-omni-nano;它们的文本输出与相应的文本模型完全相同,因此您可以将这些模态添加到现有索引中而无需重新嵌入。源代码请使用 jina-code-embeddings-0.5b 或 1.5b。同一系列中,版本越新越好。
图片和PDF文件的大小限制是多少?
keyboard_arrow_down
图片文件最大大小为 5 MB,PDF 文件最大大小为 8 MB。超过此限制的文件将被拒绝并显示错误信息。
重排模型常见问题
Reranker API 的费用是多少?
keyboard_arrow_down
Reranker API 的定价与 Embeddings API 一样,均采用基于词元的定价结构,同一密钥下的所有 Jina API 共享词元。新开通的 API 密钥包含免费词元,方便用户快速上手;此外,用户还可以购买词元包。详情请参阅定价部分。
Jina 重排器之间有什么区别?
keyboard_arrow_down
jina-reranker-v3.5 是我们目前的旗舰产品:一个拥有 0.6B 参数、13.1 万 token 上下文的多语言 listwise 重排序器,可直接替代 jina-reranker-v3。它在所有衡量指标上都优于 v3,尤其在结构化数据和法律检索方面提升最为显著,运行速度也提升了 1.22 倍到 1.56 倍。jina-reranker-v3 仍然可用。jina-reranker-m0 是一个用于对视觉文档进行排序的多模态重排序器。jina-reranker-v2-base-multilingual 是一个较小的交叉编码器,支持 100 多种语言,当您需要一个非 Qwen 衍生模型时非常有用。jina-colbert-v2 使用 89 种语言的迟交互。
Jina排名器是如何获得授权的?
keyboard_arrow_down
jina-reranker-v3.5、jina-reranker-v3、jina-reranker-m0、jina-reranker-v2-base-multilingual 和 jina-colbert-v2 均以 CC-BY-NC 4.0 许可发布。您可以免费使用、分享和改编它们用于非商业用途。商业生产用途需要商业许可,Elastic 自 2026 年 8 月 10 日起以 Jina On-Prem 的名称作为其独立 SKU 进行销售。请联系 Elastic Sales 获取报价。旧版 jina-reranker-v1-* 模型仍使用 Apache-2.0 许可。
重排模型支持多种语言吗?
keyboard_arrow_down
是的,目前所有重排序工具都支持多语言。jina-reranker-v3.5 在 MIRACL 和多语言检索方面都比 v3 版本有所改进。jina-reranker-v3 和 jina-reranker-v2-base-multilingual 支持 100 多种语言,jina-reranker-m0 处理多语言可视化文档排序,而 jina-colbert-v2 支持 89 种语言。
每个重排序器的最大上下文长度是多少?
keyboard_arrow_down
上下文长度因模型而异:

jina-reranker-v3.5: 131,072 个词元(查询加上所有文档的总和),启用自动截断
jina-reranker-v3: 131,072 个词元,启用自动截断
jina-reranker-m0: 10,000 个词元
jina-reranker-v2-base-multilingual: 1,024 个词元,对较长的文档启用自动分块
jina-colbert-v2: 8,192 个词元

对于 v1 和 v2 重排序器,查询会自动截断,长文档会使用跨块最大池化进行分块。
每次查询可重排的文档数量有上限吗?
keyboard_arrow_down
单次请求的文档数量没有硬性上限。与向量模型 API 一样,Reranker API 会按词元数在内部自动分批,以充分利用 GPU。您可以在一次请求中发送任意数量的文档。
对 100 个文档重排时,预计延迟会是多少?
keyboard_arrow_down
延迟从 100 毫秒到 7 秒不等,主要取决于文档和查询的长度。例如,使用 64 个词元的查询对 100 个包含 256 个词元的文档进行重排大约需要 150 毫秒。将文档长度增加到 4096 个词元将使时间增加到 3.5 秒。如果查询长度增加到 512 个词元,则时间进一步增加到 7 秒。
以下是对一个查询和 100 个文档进行重排的时间成本(以毫秒为单位):
每个文档中的词元数量
查询中的词元数量256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
重新排名工具可以私有托管吗?例如,托管在我自己的基础架构或我自己的云账户中?
keyboard_arrow_down
是的。您可以在 AWS、Azure 和 GCP Marketplace 上找到这些重新排序工具,并将它们部署到您自己的云账户中。对于自管理、本地部署或物理隔离的基础设施,Elastic 提供商业许可(Jina On-Prem),该许可将模型以完全离线的 Docker 容器形式交付。请联系 Elastic Sales 获取报价。
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
你们是否提供基于特定领域数据进行微调的重新排名工具?
keyboard_arrow_down
在委托进行微调之前,不妨先试试 jina-reranker-v3.5:它采用自蒸馏技术专门针对特定领域进行了训练,具有很强的鲁棒性,并且在法律和结构化数据检索方面比 v3 版本有了显著提升。一个精心挑选的现成重排序器加上更优化的分块处理通常比微调更能有效弥补差距,而且测试是免费的。如果它仍然无法满足您的数据需求,您可以考虑定制一个特定领域的重排序器:请联系 Elastic Sales 来了解具体需求。
联系我们
文档图片的最小尺寸是多少?
keyboard_arrow_down
jina-reranker-m0 模型可接受的最小图像尺寸为 28x28 像素。
什么是 listwise 重排序?它和逐点式重排序有何不同?
keyboard_arrow_down
jina-reranker-v3 和 jina-reranker-v3.5 采用 listwise 架构:查询和所有候选文档共享一个上下文窗口,并在一次前向传播中完成评分,因此模型可以相互比较文档。传统的逐点重排序器,例如 jina-reranker-v2-base-multilingual,则独立地对每个文档与查询进行评分。listwise 评分更加准确,因为相关性通常是相对于候选集中其他文档而言的。
为什么 API 强制执行的上下文长度与模型支持的上下文长度不同?
keyboard_arrow_down
某些重排序器架构上能够处理比托管 API 所接受的更长的上下文。非常长的序列会消耗大量的 GPU 内存,我们会针对大多数使用场景调整服务配置,以平衡吞吐量、延迟和成本。如果您需要完整的架构上下文长度,请在您自己的基础设施上运行模型,并联系 Elastic Sales 获取商业许可。
Reranker API 的速率限制是多少?
keyboard_arrow_down
速率限制取决于您的 API 密钥类型:

免费版: 100 RPM,100K TPM
付费版: 500 RPM,2M TPM
高级版: 5,000 RPM,50M TPM

此外,还有基于 IP 地址的限制,每 60 秒最多 10,000 次请求。这些限制同样适用于 Embeddings 和 Reranker API,且同一密钥下的所有 Jina API 共享 token。
我应该选择哪款重新排名工具?
keyboard_arrow_down
对于文本,请使用 jina-reranker-v3.5。它可直接替代 jina-reranker-v3:请求模式保持不变,因此只需切换模型字符串即可完成整个迁移。当候选对象是图像或包含丰富视觉内容的文档时,请使用 jina-reranker-m0。当您需要更小的模型或并非基于 Qwen 主干架构的模型时,请使用 jina-reranker-v2-base-multilingual。
API 相关常见问题
code
我可以在所有 Jina API 中使用同一个 API 密钥吗?
keyboard_arrow_down
是的。一个 API 密钥可用于 Jina AI 搜索基础产品的所有功能,包括 Reader、Embeddings、Reranker、Classifier 和 Segmenter API,所有功能共享相同的 token。
code
我可以查看 API 密钥的词元用量吗?
keyboard_arrow_down
可以,在“API 密钥与计费”标签页输入您的 API 密钥,即可查看近期用量记录和剩余词元。如果您已登录 API 控制面板,也可以在“管理 API 密钥”标签页查看这些信息。
code
如果我忘记了 API 密钥,该怎么办?
keyboard_arrow_down
如果您弄丢了已充值的密钥并希望找回,请用注册邮箱联系 support AT jina.ai。建议登录账户,这样 API 密钥可以安全保存、随时取用。
联系我们
code
API 密钥会过期吗?
keyboard_arrow_down
不会,API 密钥没有过期日期。如果密钥泄露,请在 API 密钥控制面板 中自行撤销,立即生效;想避免服务中断可以先申请一个替代密钥。任何剩余的 token 余额都留在账户里,而不是随撤销的密钥一起没了。如果您无法访问控制面板,或者怀疑账户本身被盗用,请联系 Elastic Support。
联系我们
code
可以在不同 API 密钥之间转移词元吗?
keyboard_arrow_down
可以,您能把词元从一个高级密钥转到另一个密钥。在 API 密钥控制面板登录账户后,进入待转出密钥的设置页,即可转移全部剩余的付费词元。
code
我可以销毁我的 API 密钥吗?
keyboard_arrow_down
可以,如果您认为密钥已泄露,可以销毁它。销毁后,所有保存该密钥的用户都会立即无法使用,剩余额度和关联属性也将永久失效。如果是高级密钥,您可以在销毁前把剩余的付费额度转移到另一个密钥。请注意,此操作无法撤销。要销毁密钥,请前往 API 密钥控制面板中的密钥设置。
code
为什么有些模型的首次请求比较慢?
keyboard_arrow_down
这是因为我们的无服务器架构会在使用率较低时卸载部分模型。首次请求会激活或“预热”模型,需要几秒钟。激活之后,后续请求的处理速度会快得多。
code
我的 API 数据会被用来训练你们的模型吗?
keyboard_arrow_down
不会。我们绝不会用您的 API 请求、输入或输出来训练向量模型、重排模型或任何其他模型。您的数据始终属于您。
code
Jina API 的速率限制是多少?
keyboard_arrow_down
每个 API 密钥均有速率限制:

免费版: 100 RPM,100K TPM
付费版: 500 RPM,2M TPM
高级版: 5,000 RPM,50M TPM

此外,每 60 秒还存在 10,000 次请求的 IP 地址限制。不同端点的限制有所不同;请参阅上方的速率限制表,了解每个端点的具体限制。
code
API 有批量大小限制吗?
keyboard_arrow_down
Embeddings 和 Reranker API 都没有批量大小限制,每次请求可以发送任意数量的条目或文档。两个 API 都会在内部按词元数对输入分批,以充分利用 GPU。
code
Jina API 与 Elastic 中的 Jina 模型是同一回事吗?
keyboard_arrow_down
不,这是三种不同的路径。本网站上的 Jina API 是自助式的,采用按需付费模式,需要 Jina API 密钥。Elastic Inference Service (EIS) 在 Elastic Cloud 中运行 Jina 模型,费用通过您的 Elastic 订阅收取,无需您管理任何基础设施。Jina On-Prem 是 Elastic 自 2026 年 8 月 10 日起作为其独立 SKU 销售的商业许可证,用于在您自己的自管理本地或物理隔离的基础设施中运行模型。有关 EIS 和 On-Prem 路径的更多信息,请联系 Elastic Sales。
与计费相关的常见问题
attach_money
API 是按句子数还是按请求数计费?
keyboard_arrow_down
我们按处理的词元总数计费,您可以把这些词元灵活分配到任意数量的句子上,用更低的成本满足各种文本分析需求。
attach_money
新用户可以免费试用吗?
keyboard_arrow_down
是的。新用户将获得一个自动生成的 API 密钥,其中包含可在我们所有模型中使用的免费词元。免费词元用完后,您可以在“购买词元”选项卡中为该密钥购买更多词元。
attach_money
失败的请求是否会扣除词元?
keyboard_arrow_down
不,失败的请求不会扣除词元。
attach_money
接受哪些付款方式?
keyboard_arrow_down
付款通过 Stripe 处理,支持信用卡、Google Pay、PayPal 等多种方式,方便您选择。
attach_money
充值后可以开具发票吗?
keyboard_arrow_down
对于自助词元购买,Stripe 会在购买时向您的 Stripe 账户关联的电子邮件地址发送发票。如果您需要正式的采购订单、协商合同、采购文件或通过 Elastic 而非 Stripe 处理的合并账单,请联系 Elastic Sales。
attach_money
如何购买商业许可证而不是 API 词元?
keyboard_arrow_down
在本站购买词元仅涵盖使用托管的 Jina API。这些词元不包含您在自有基础设施上运行模型权重的许可。为此,Elastic 自 2026 年 8 月 10 日起以商业许可的形式单独销售,按年收费,而非按词元收费。如需报价,请联系 Elastic Sales。
attach_money
我可以用发票或采购订单付款,而不是用信用卡吗?
keyboard_arrow_down
自助词元购买通过 Stripe 处理,发票将自动发送到您的 Stripe 账户邮箱。对于采购订单、采购流程或超出自助充值支持的交易量,请联系 Elastic Sales。
attach_money
我已付款,但余额或速率限制没有变化,该检查什么?
keyboard_arrow_down
余额和速率限制属于 API key,不属于账号,所以先查 key 本身而不是账号页面:在「API Key & Billing」标签里输入该 key,确认余额和档位。如果账号下有多个 key,token 都在被充值的那个 key 上,未必是您应用实际在用的那个。另外付款后新档位生效可能有短暂延迟。如果 key 已显示余额、但过后仍被限制在原档位,请联系支持。
attach_money
如何取消、关闭自动充值或删除已保存的付款方式?
keyboard_arrow_down
自助计费在客户门户中管理,入口在「API Key & Billing」标签,可在那里关闭自动充值、移除已保存的付款方式。关闭自动充值只是停止后续扣款,已购买的余额仍可继续使用。如果您还需要删除账号及其数据,或希望申请退款,请把请求发给支持;账号删除为人工处理,需要几个工作日,完成后会有书面确认。
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。