您的搜尋底座 如虎添翼!
chevron_leftchevron_right
globe_book
使用
r.jina.ai 讀取 URL 並獲取其內容travel_explore
使用
s.jina.ai 搜尋網頁並獲取 SERP把
mcp.jina.ai 新增為您的 MCP 伺服器,讓大模型直接呼叫我們的 API內容格式
Return-Format
您可以控制響應的細節程度,避免過度過濾。預設流程針對大多數網站和大模型輸入做了最佳化。
預設
arrow_drop_down
JSON 響應
Accept
響應採用 JSON 格式,包含 URL、標題、內容和時間戳(如有)。在搜尋模式下會返回五條結果,每條都遵循上述 JSON 結構。
超時時間(秒)
X-Timeout
頁面載入的最長等待時間。頁面較慢時調大,簡單靜態頁面可調小。
詞元預算
X-Token-Budget
限制此請求使用的最大詞元數。超出此限制將導致請求失敗。
使用 ReaderLM-v2
實驗性
X-Respond-With
使用 ReaderLM-v2 將 HTML 轉換為 Markdown,為結構和內容複雜的網站提供高品質結果。詞元消耗為 3 倍!open_in_new瞭解更多
僅提取(CSS 選擇器)
X-Target-Selector
僅提取與這些 CSS 選擇器匹配的內容。例如:article、.main-content、#post-body
等待(CSS 選擇器)
X-Wait-For-Selector
等這些元素出現後再提取內容。適用於動態載入的內容。
排除(CSS 選擇器)
X-Remove-Selector
提取前先移除這些元素。例如:nav、footer、.sidebar、#ads
移除所有圖片
X-Retain-Images
從輸出中移除所有圖片。不需要圖片時可減少詞元用量。
連結摘要部分
X-With-Links-Summary
文末會建立“按鈕和連結”部分,幫助下游大模型或 Web 智慧體瀏覽頁面、執行後續操作。
無
arrow_drop_down
圖片摘要部分
X-With-Images-Summary
文末會建立“圖片”部分,讓下游大模型總覽頁面上的所有視覺內容,有助於提升推理效果。
無
arrow_drop_down
轉發 Cookie
X-Set-Cookie
我們的 API 伺服器在訪問 URL 時可以轉發您自定義的 Cookie 設定,適合需要額外身份驗證的頁面。請注意,帶 Cookie 的請求不會被快取。open_in_new瞭解更多
圖片說明
X-With-Generated-Alt
為指定 URL 上的所有圖片生成說明文字,對缺少 alt 標籤的圖片補充“Image [idx]: [caption]”。這樣下游大模型便可在推理、摘要等任務中利用圖片資訊。
使用特定國家/地區的代理伺服器
X-Proxy
設定基於地理位置的代理伺服器國家/地區程式碼。填 auto 表示自動擇優,填 none 表示禁用。
繞過快取
X-No-Cache
我們的 API 會將 URL 內容快取一段時間。設為 true 可忽略快取結果,直接從該 URL 抓取內容。
快取容忍時間(秒)
X-Cache-Tolerance
若快取內容生成時間不超過 N 秒,則接受該快取。設為 0 表示獲取最新內容(等同於“繞過快取”),設定更大的值則可更快地從快取返回響應。
頁面就緒時機
X-Respond-Timing
判定頁面已完全載入的時機。越靠後的時機等待越久,但能捕獲更多動態內容。
預設
arrow_drop_down
自定義 User-Agent
X-User-Agent
覆蓋瀏覽器的 User-Agent 字串。適合訪問要求特定瀏覽器或遮蔽抓取程式的網站。
自定義 Referer
X-Referer
設定 HTTP Referer 請求頭。部分網站會檢查此項,以確認流量來自預期來源。
保留 Base64 圖片
X-Keep-Img-Data-Url
將內聯 base64 編碼的圖片保留在 Markdown 輸出中,而不是將其轉換為外部 URL。
請勿快取或追蹤
DNT
阻止此請求在我們的伺服器上被快取或記錄。請用於敏感 URL。
GitHub 風格 Markdown
X-No-Gfm
選擇啟用或關閉 GFM(Github Flavored Markdown)功能。
已啟用
arrow_drop_down
遵守 robots.txt
X-Robots-Txt
抓取前先檢查 robots.txt 中的規則。請指定檢查時使用的爬蟲名稱。
包含 iframe 內容
X-With-Iframe
從內嵌 iframe 中提取內容。頁面內容載入在 iframe 中時請啟用。
包含 Shadow DOM
X-With-Shadow-Dom
從 Shadow DOM 元件中提取內容。頁面使用 Web Components 時請啟用。
使用最終 URL 作為基準
X-Base
使用重定向後的最終目標 URL 而不是原始 URL 來解析相對 URL。
本地 PDF/HTML 檔案
POST
上傳本地 PDF 和 HTML 檔案,用 Reader 讀取。僅支援 pdf 和 html 檔案。對於 HTML,請同時指定一個參考 URL,以便更好地解析相關的 CSS/JS 指令碼。
upload
提取前執行 JavaScript
POST
在提取內容前執行自定義 JS 修改頁面。可以是內聯程式碼,也可以是指令碼檔案的 URL。open_in_new瞭解更多
標題樣式
X-Md-Heading-Style
設定 Markdown 標題格式(傳遞給 Turndown)。
井號樣式
arrow_drop_down
水平線樣式
X-Md-Hr
定義 Markdown 分隔線的格式(傳遞給 Turndown)。
專案符號樣式
X-Md-Bullet-List-Marker
設定無序列表的標記字元(傳遞給 Turndown)。
*
arrow_drop_down
斜體樣式
X-Md-Em-Delimiter
定義 Markdown 斜體分隔符(傳遞給 Turndown)。
_
arrow_drop_down
加粗樣式
X-Md-Strong-Delimiter
設定 Markdown 加粗分隔符(傳遞給 Turndown)。
**
arrow_drop_down
連結樣式
X-Md-Link-Style
決定 Markdown 連結的格式(傳遞給 Turndown)。
內聯
arrow_drop_down
歐盟資料駐留
實驗性
啟用後,本次請求的基礎設施和資料處理將位於歐盟境內。
curl "https://r.jina.ai/https://www.example.com"key
API 金鑰
visibility_off
剩餘詞元額度
0
為了更好的搜尋
我們的前沿模型構成了高品質企業搜尋和 RAG 系統的搜尋底座。
我們的論文
想知道我們的前沿搜尋模型是如何從零訓練出來的?請檢視我們的最新論文。歡迎在 EMNLP、SIGIR、ICLR、NeurIPS 和 ICML 與我們的團隊見面!
七月 20, 2026
SIGIR 2026
五月 11, 2026
SIGIR 2026
二月 17, 2026
ICLR 2026
一月 22, 2026
十二月 29, 2025
ICLR 2026
十二月 04, 2025
AAAI 2026
十月 01, 2025
NeurIPS 2025
八月 31, 2025
EMNLP 2025
六月 24, 2025
ICLR 2025
三月 04, 2025
ACL 2025
十二月 17, 2024
ICLR 2025
十二月 12, 2024
ECIR 2025
九月 18, 2024
SIGIR 2025
九月 07, 2024
EMNLP 2024
八月 30, 2024
WWW 2025
六月 21, 2024
ICML 2024
五月 30, 2024
二月 26, 2024
十月 30, 2023
EMNLP 2023
七月 20, 2023
共計 20 篇論文。



















