您的搜索底座 如虎添翼!
globe_book
使用
r.jina.ai 读取 URL 并获取其内容travel_explore
使用
s.jina.ai 搜索网页并获取 SERP把
mcp.jina.ai 添加为您的 MCP 服务器,让大模型直接调用我们的 API内容格式
Return-Format
您可以控制响应的细节程度,避免过度过滤。默认流程针对大多数网站和大模型输入做了优化。
默认
arrow_drop_down
JSON 响应
Accept
响应采用 JSON 格式,包含 URL、标题、内容和时间戳(如有)。在搜索模式下会返回五条结果,每条都遵循上述 JSON 结构。
超时时间(秒)
X-Timeout
页面加载的最长等待时间。页面较慢时调大,简单静态页面可调小。
词元预算
X-Token-Budget
限制此请求使用的最大词元数。超出此限制将导致请求失败。
使用 ReaderLM-v2
实验性
X-Respond-With
使用 ReaderLM-v2 将 HTML 转换为 Markdown,为结构和内容复杂的网站提供高质量结果。词元消耗为 3 倍!open_in_new了解更多
仅提取(CSS 选择器)
X-Target-Selector
仅提取与这些 CSS 选择器匹配的内容。例如:article、.main-content、#post-body
等待(CSS 选择器)
X-Wait-For-Selector
等这些元素出现后再提取内容。适用于动态加载的内容。
排除(CSS 选择器)
X-Remove-Selector
提取前先移除这些元素。例如:nav、footer、.sidebar、#ads
移除所有图片
X-Retain-Images
从输出中移除所有图片。不需要图片时可减少词元用量。
链接摘要部分
X-With-Links-Summary
文末会创建“按钮和链接”部分,帮助下游大模型或 Web 智能体浏览页面、执行后续操作。
无
arrow_drop_down
图片摘要部分
X-With-Images-Summary
文末会创建“图片”部分,让下游大模型总览页面上的所有视觉内容,有助于提升推理效果。
无
arrow_drop_down
转发 Cookie
X-Set-Cookie
我们的 API 服务器在访问 URL 时可以转发您自定义的 Cookie 设置,适合需要额外身份验证的页面。请注意,带 Cookie 的请求不会被缓存。open_in_new了解更多
图片说明
X-With-Generated-Alt
为指定 URL 上的所有图片生成说明文字,对缺少 alt 标签的图片补充“Image [idx]: [caption]”。这样下游大模型便可在推理、摘要等任务中利用图片信息。
使用特定国家/地区的代理服务器
X-Proxy
设置基于地理位置的代理服务器国家/地区代码。填 auto 表示自动择优,填 none 表示禁用。
绕过缓存
X-No-Cache
我们的 API 会将 URL 内容缓存一段时间。设为 true 可忽略缓存结果,直接从该 URL 抓取内容。
缓存容忍时间(秒)
X-Cache-Tolerance
若缓存内容生成时间不超过 N 秒,则接受该缓存。设为 0 表示获取最新内容(等同于“绕过缓存”),设置更大的值则可更快地从缓存返回响应。
页面就绪时机
X-Respond-Timing
判定页面已完全加载的时机。越靠后的时机等待越久,但能捕获更多动态内容。
默认
arrow_drop_down
自定义 User-Agent
X-User-Agent
覆盖浏览器的 User-Agent 字符串。适合访问要求特定浏览器或屏蔽抓取程序的网站。
自定义 Referer
X-Referer
设置 HTTP Referer 请求头。部分网站会检查此项,以确认流量来自预期来源。
保留 Base64 图片
X-Keep-Img-Data-Url
将内联 base64 编码的图片保留在 Markdown 输出中,而不是将其转换为外部 URL。
请勿缓存或追踪
DNT
阻止此请求在我们的服务器上被缓存或记录。请用于敏感 URL。
GitHub 风格 Markdown
X-No-Gfm
选择启用或关闭 GFM(Github Flavored Markdown)功能。
已启用
arrow_drop_down
遵守 robots.txt
X-Robots-Txt
抓取前先检查 robots.txt 中的规则。请指定检查时使用的爬虫名称。
包含 iframe 内容
X-With-Iframe
从内嵌 iframe 中提取内容。页面内容加载在 iframe 中时请启用。
包含 Shadow DOM
X-With-Shadow-Dom
从 Shadow DOM 组件中提取内容。页面使用 Web Components 时请启用。
使用最终 URL 作为基准
X-Base
使用重定向后的最终目标 URL 而不是原始 URL 来解析相对 URL。
本地 PDF/HTML 文件
POST
上传本地 PDF 和 HTML 文件,用 Reader 读取。仅支持 pdf 和 html 文件。对于 HTML,请同时指定一个参考 URL,以便更好地解析相关的 CSS/JS 脚本。
upload
提取前运行 JavaScript
POST
在提取内容前执行自定义 JS 修改页面。可以是内联代码,也可以是脚本文件的 URL。open_in_new了解更多
标题样式
X-Md-Heading-Style
设置 Markdown 标题格式(传递给 Turndown)。
井号样式
arrow_drop_down
水平线样式
X-Md-Hr
定义 Markdown 分隔线的格式(传递给 Turndown)。
项目符号样式
X-Md-Bullet-List-Marker
设置无序列表的标记字符(传递给 Turndown)。
*
arrow_drop_down
斜体样式
X-Md-Em-Delimiter
定义 Markdown 斜体分隔符(传递给 Turndown)。
_
arrow_drop_down
加粗样式
X-Md-Strong-Delimiter
设置 Markdown 加粗分隔符(传递给 Turndown)。
**
arrow_drop_down
链接样式
X-Md-Link-Style
决定 Markdown 链接的格式(传递给 Turndown)。
内联
arrow_drop_down
欧盟数据驻留
实验性
启用后,本次请求的基础设施和数据处理将位于欧盟境内。
curl "https://r.jina.ai/https://www.example.com"key
API 密钥
visibility_off
剩余词元额度
0
为了更好的搜索
我们的前沿模型构成了高质量企业搜索和 RAG 系统的搜索底座。
我们的论文
想知道我们的前沿搜索模型是如何从零训练出来的?请查看我们的最新论文。欢迎在 EMNLP、SIGIR、ICLR、NeurIPS 和 ICML 与我们的团队见面!
七月 20, 2026
SIGIR 2026
五月 11, 2026
SIGIR 2026
二月 17, 2026
ICLR 2026
一月 22, 2026
十二月 29, 2025
ICLR 2026
十二月 04, 2025
AAAI 2026
十月 01, 2025
NeurIPS 2025
八月 31, 2025
EMNLP 2025
六月 24, 2025
ICLR 2025
三月 04, 2025
ACL 2025
十二月 17, 2024
ICLR 2025
十二月 12, 2024
ECIR 2025
九月 18, 2024
SIGIR 2025
九月 07, 2024
EMNLP 2024
八月 30, 2024
WWW 2025
六月 21, 2024
ICML 2024
五月 30, 2024
二月 26, 2024
十月 30, 2023
EMNLP 2023
七月 20, 2023
共计 20 篇论文。



















