Reader
Convertissez une URL en entrée compatible avec LLM en ajoutant
r.jina.ai au début.API de Reader
Convertissez une URL en entrée compatible avec LLM en ajoutant
r.jina.ai au début.globe_book
Utilisez
r.jina.ai pour lire une URL et récupérer son contenutravel_explore
Utilisez
s.jina.ai pour rechercher sur le Web et obtenir le SERPAjoutez
mcp.jina.ai comme serveur MCP pour accéder à notre API dans les LLMFormat du contenu
Return-Format
Vous pouvez contrôler le niveau de détail de la réponse pour éviter un filtrage excessif. Le pipeline par défaut est optimisé pour la plupart des sites Web et des entrées LLM.
Défaut
arrow_drop_down
Réponse JSON
Accept
La réponse sera au format JSON, contenant l'URL, le titre, le contenu et l'horodatage (si disponible). En mode Recherche, il renvoie une liste de cinq entrées, chacune suivant la structure JSON décrite.
Délai d'attente (secondes)
X-Timeout
Délai maximal d'attente pour le chargement de la page. Augmenter ce délai pour les pages lentes, le diminuer pour les pages statiques simples.
Budget de tokens
X-Token-Budget
Limite le nombre maximal de tokens utilisés pour cette demande. Le dépassement de cette limite entraînera l'échec de la demande.
Utiliser ReaderLM-v2
Expérimental
X-Respond-With
Utilise ReaderLM-v2 pour la conversion HTML en Markdown, afin de fournir des résultats de haute qualité pour les sites Web aux structures et contenus complexes. Coûte 3× tokens !open_in_newApprendre encore plus
Extrait uniquement (sélecteur CSS)
X-Target-Selector
Extraire uniquement le contenu correspondant à ces sélecteurs CSS. Exemple : article, .main-content, #post-body
Attendre (sélecteur CSS)
X-Wait-For-Selector
Attendez que ces éléments apparaissent avant d'extraire le contenu. Utile pour le contenu chargé dynamiquement.
Exclure (sélecteur CSS)
X-Remove-Selector
Supprimez ces éléments avant l'extraction. Exemple : nav, footer, .sidebar, #ads
Supprimer toutes les images
X-Retain-Images
Supprime toutes les images du résultat. Cela réduit la consommation de tokens lorsque les images ne sont pas nécessaires.
Format de citation OpenAI
X-Retain-Links
Formate les liens pour l'outil de navigation web d'OpenAI. Utilise des marqueurs de citation spéciaux compatibles avec les modèles GPT.open_in_newApprendre encore plus
Résumé des liens
X-With-Links-Summary
Une section "Boutons & Liens" sera créée à la fin. Cela aide les LLM ou les agents Web en aval à naviguer sur la page ou à entreprendre d'autres actions.
Aucun
arrow_drop_down
Section récapitulative des images
X-With-Images-Summary
Une section "Images" sera créée à la fin. Cela donne aux LLM en aval un aperçu de tous les visuels de la page, ce qui peut améliorer le raisonnement.
Aucun
arrow_drop_down
Taille de la fenêtre du navigateur
POST
viewport
Définir les dimensions de la fenêtre du navigateur. Cela affecte la mise en page adaptative et la visibilité du contenu.open_in_newApprendre encore plus
Transférer le cookie
X-Set-Cookie
Notre serveur API peut transmettre vos paramètres de cookies personnalisés lors de l'accès à l'URL, ce qui est utile pour les pages nécessitant une authentification supplémentaire. Notez que les demandes contenant des cookies ne seront pas mises en cache.open_in_newApprendre encore plus
Légende
X-With-Generated-Alt
Ajoute des légendes à toutes les images de l'URL spécifiée et ajoute « Image [idx] : [caption] » comme balise alt à celles qui n'en ont pas. Cela permet aux LLM en aval d'interagir avec les images pour des activités de raisonnement et de synthèse.
Utiliser un serveur proxy
X-Proxy-Url
Notre serveur API peut utiliser votre proxy pour accéder aux URL, ce qui est utile pour les pages accessibles uniquement via des proxys spécifiques.open_in_newApprendre encore plus
Utiliser un serveur proxy spécifique à un pays
X-Proxy
Définissez le code pays pour le serveur proxy basé sur la localisation. Utilisez « auto » pour une sélection optimale ou « aucun » pour désactiver.
Contourner le cache
X-No-Cache
Notre serveur API met en cache le contenu des modes Lecture et Recherche pendant un certain temps. Pour contourner ce cache, définissez cet en-tête sur true.
Tolérance du cache (secondes)
X-Cache-Tolerance
Accepter le contenu mis en cache s'il date de moins de N secondes. Définir sur 0 pour du contenu récent (équivalent à « Ignorer le cache »), ou sur des valeurs plus élevées pour permettre des réponses plus rapides du cache.
Délai de chargement de la page
X-Respond-Timing
Quand considérer une page comme entièrement chargée ? Les mesures ultérieures impliquent un temps d’attente plus long, mais permettent de capturer davantage de contenu dynamique.
Défaut
arrow_drop_down
Agent utilisateur personnalisé
X-User-Agent
Modifiez la chaîne User-Agent du navigateur. Utile pour accéder aux sites nécessitant des navigateurs spécifiques ou bloquant les robots d'exploration.
Référent personnalisé
X-Referer
Configurez l'en-tête HTTP Referer. Certains sites le vérifient pour s'assurer que le trafic provient bien des sources attendues.
Préserver les images Base64
X-Keep-Img-Data-Url
Conservez les images encodées en base64 directement dans le code Markdown au lieu de les convertir en URL externes.
Ne pas mettre en cache ni suivre
DNT
Empêcher la mise en cache ou l'enregistrement de cette requête sur nos serveurs. À utiliser pour les URL sensibles.
Markdown à saveur GitHub
X-No-Gfm
Fonctionnalités d'activation/désactivation de GFM (GitHub Flavored Markdown).
Activé
arrow_drop_down
Mode flux
Accept
Le mode flux est avantageux pour les grandes pages cibles, ce qui laisse plus de temps à la page pour s'afficher complètement. Si le mode standard génère un contenu incomplet, envisagez d’utiliser le mode Stream.open_in_newApprendre encore plus
Personnaliser les paramètres régionaux du navigateur
X-Locale
Contrôlez les paramètres régionaux du navigateur pour afficher la page. De nombreux sites Web proposent un contenu différent en fonction des paramètres régionaux.open_in_newApprendre encore plus
Respectez robots.txt
X-Robots-Txt
Vérifiez les règles du fichier robots.txt avant de récupérer les données. Spécifiez le nom du robot à utiliser pour la vérification.
Inclure le contenu iframe
X-With-Iframe
Extraire le contenu des iframes intégrées. Activer cette fonction pour les pages dont le contenu est chargé dans des iframes.
Inclure Shadow DOM
X-With-Shadow-Dom
Extraire le contenu des composants Shadow DOM. Activer pour les pages utilisant des composants web.
Utiliser l'URL finale comme base
X-Base
Résolvez les URL relatives en utilisant l'URL de destination finale après les redirections, au lieu de l'URL d'origine.
Fichier PDF/HTML local
POST
Utilisez Reader sur vos fichiers PDF et HTML locaux en les téléchargeant. Ne prend en charge que les fichiers PDF et HTML.
upload
Exécuter JavaScript avant l'extraction
POST
Exécutez du code JS personnalisé pour modifier la page avant l'extraction du contenu. Il peut s'agir de code intégré ou d'une URL pointant vers un fichier script.open_in_newApprendre encore plus
Style de titre
X-Md-Heading-Style
Définit le format de titre Markdown (transmis à Turndown).
Hash Style
arrow_drop_down
Style de règle horizontale
X-Md-Hr
Définit le format de la règle horizontale de démarque (transmis à Turndown).
Style à puces
X-Md-Bullet-List-Marker
Définit le caractère marqueur de la liste à puces (transmis à Turndown).
*
arrow_drop_down
Style d'emphase
X-Md-Em-Delimiter
Définit le délimiteur d'emphase Markdown (transmis à Turndown).
_
arrow_drop_down
Style à forte emphase
X-Md-Strong-Delimiter
Définit le délimiteur d'emphase fort Markdown (transmis à Turndown).
**
arrow_drop_down
Style de lien
X-Md-Link-Style
Détermine le format du lien Markdown (transmis à Turndown).
Inline
arrow_drop_down
Résidence dans l'UE
Expérimental
Lorsque cette option est activée, l'infrastructure et le traitement des données de cette requête sont situés dans l'UE.
curl "https://r.jina.ai/https://www.example.com"key
Clé API
visibility_off
Tokens disponibles
0
Jina VLM : Petit modèle de langage de vision multilingue
Un modèle vision-langage à 2,4 milliards de paramètres qui atteint un niveau de réponse aux questions visuelles multilingues de pointe parmi les VLM ouverts à l'échelle 2B.
ReaderLM v2 : petit modèle de langage pour HTML vers Markdown et JSON
ReaderLM-v2 est un modèle de langage de 1,5 milliard de paramètres spécialisé dans la conversion HTML vers Markdown et l'extraction HTML vers JSON. Il prend en charge les documents jusqu'à 512 000 tokens dans 29 langues et offre une précision 20 % supérieure à celle de son prédécesseur.
L'embedding de données web dans les LLM est une étape cruciale de leur embedding, mais peut s'avérer complexe. La méthode la plus simple consiste à extraire le code HTML brut de la page web. Cependant, cette opération peut être complexe et souvent bloquée, et le code HTML brut est encombré d'éléments superflus tels que des balises et des scripts. L'API Reader résout ces problèmes en extrayant le contenu principal d'une URL et en le convertissant en un texte propre et compatible avec les LLM, garantissant ainsi des données de haute qualité pour vos systèmes d'agents et de gestion des annonces (RAG). L'API Reader est une infrastructure de développement : elle convertit une URL que vous fournissez en un texte compatible avec les LLM afin que vous puissiez créer vos propres systèmes de recherche, RAG et d'agents. Il ne s'agit pas d'un moteur de recherche grand public et elle n'indexe ni ne classe le web pour vous ; vous contrôlez les URL traitées et êtes responsable de l'utilisation des résultats.
Entrez votre URL
URL du Reader
HTML brut
Sortie du Reader
Poser une question
Reader peut être utilisé comme API SERP. Il vous permet d'alimenter votre LLM avec le contenu derrière la page des résultats du moteur de recherche. Ajoutez simplement
https://s.jina.ai/?q= à votre requête, et Reader effectuera une recherche sur le Web et renverra les cinq premiers résultats avec leurs URL et leur contenu, chacun dans un texte clair et adapté au LLM. De cette façon, vous pouvez toujours maintenir votre LLM à jour, améliorer sa factualité et réduire les hallucinations.Entrez votre requête
URL du Reader
info Veuillez noter que contrairement à la démo présentée ci-dessus, en pratique, vous ne recherchez pas la question d'origine sur le Web pour vous ancrer. Ce que les gens font souvent, c'est réécrire la question d'origine ou utiliser des questions à sauts multiples. Ils lisent les résultats récupérés, puis génèrent des requêtes supplémentaires pour recueillir plus d'informations si nécessaire avant d'arriver à une réponse finale.
Les images de la page Web sont automatiquement sous-titrées à l'aide d'un modèle de langage de vision dans le Reader et formatées sous forme de balises alt d'image dans la sortie. Cela donne à votre LLM en aval juste assez d'indices pour intégrer ces images dans ses processus de raisonnement et de synthèse. Cela signifie que vous pouvez poser des questions sur les images, en sélectionner des spécifiques ou même transmettre leurs URL à un VLM plus puissant pour une analyse plus approfondie !
Oui, Reader prend en charge nativement la lecture de PDF. Il est compatible avec la plupart des PDF, y compris ceux contenant de nombreuses images, et il est ultra-rapide ! En combinaison avec un LLM, vous pouvez facilement créer une IA ChatPDF ou d'analyse de documents en un rien de temps.
La meilleure partie? C'est gratuit!
L'API Reader est disponible gratuitement et offre une limite de débit et une tarification flexibles. Construite sur une infrastructure évolutive, elle offre une grande accessibilité, un fort niveau de concurrence et une fiabilité élevée. Nous nous efforçons d'être votre solution d'ancrage préférée pour vos LLM.
Limite de débit
Les limites de débit sont suivies de deux manières : RPM (requêtes par minute) et TPM (tokens par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
Colonnes
arrow_drop_down
| Product | API Endpoint | Descriptionarrow_upward | w/o API Keykey_off | w/ Free API Keykey | w/ Paid API Keykey | w/ Premium API Keykey | Average Latency | Token Usage Counting | Allowed Request | |
|---|---|---|---|---|---|---|---|---|---|---|
| Reader API | https://r.jina.ai | Converts a URL to LLM-friendly text | 20 RPM | 500 RPM | 500 RPM | trending_up5000 RPM | 7.9s | Count the number of tokens in the output response. | GET/POST | |
| Reader API | https://s.jina.ai | Search the web and convert results to LLM-friendly text | block | 100 RPM | 100 RPM | trending_up1000 RPM | 2.5s | Every request costs a fixed number of tokens, starting from 10000 tokens | GET/POST | |
| Embedding API | https://api.jina.ai/v1/embeddings | Convert text/images to fixed-length vectors | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depends on the input size help | Count the number of tokens in the input request. | POST | |
| Reranker API | https://api.jina.ai/v1/rerank | Rank documents by query | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depends on the input size help | Count the number of tokens in the input request. | POST |
Pas de panique ! Chaque nouvelle clé API contient 10 millions de tokens gratuits !
Tarification des API
La tarification de l'API est basée sur l'utilisation des tokens. Une seule clé API vous donne accès à tous les produits Search Foundation.
Quels sont les coûts associés à l’utilisation de l’API Reader ?
keyboard_arrow_down
Comment fonctionne l'API Reader ?
keyboard_arrow_down
L'API Reader est-elle open source ?
keyboard_arrow_down
Quelle est la latence typique de l’API Reader ?
keyboard_arrow_down
Pourquoi devrais-je utiliser l'API Reader au lieu de gratter la page moi-même ?
keyboard_arrow_down
L'API Reader prend-elle en charge plusieurs langues ?
keyboard_arrow_down
L'API Reader respecte-t-elle les contrôles d'accès des sites web ?
keyboard_arrow_down
L'API Reader peut-elle extraire le contenu des fichiers PDF ?
keyboard_arrow_down
L'API Reader peut-elle traiter le contenu multimédia des pages Web ?
keyboard_arrow_down
Est-il possible d'utiliser l'API Reader sur des fichiers HTML locaux ?
keyboard_arrow_down
L'API Reader met-elle en cache le contenu ?
keyboard_arrow_down
Puis-je utiliser l'API Reader pour accéder au contenu derrière une connexion ?
keyboard_arrow_down
Puis-je utiliser l'API Reader pour accéder au PDF sur arXiv ?
keyboard_arrow_down
Comment fonctionne la légende d’image dans Reader ?
keyboard_arrow_down
Quelle est l’évolutivité du Reader ? Puis-je l’utiliser en production ?
keyboard_arrow_down
Quelle est la limite de débit de l’API Reader ?
keyboard_arrow_down
Qu'est-ce que ReaderLM ? Comment puis-je l'utiliser ?
keyboard_arrow_down
Comment extraire des données structurées à partir de pages web ?
keyboard_arrow_down
Le Reader contourne-t-il activement la protection anti-robots du site web ?
keyboard_arrow_down
Le passage d'une clé API gratuite à une clé payante me donnera-t-il accès à davantage de sites web ?
keyboard_arrow_down
Puis-je exécuter Reader au sein de ma propre infrastructure ?
keyboard_arrow_down
Limite de débit
Les limites de débit sont suivies de deux manières : RPM (requêtes par minute) et TPM (tokens par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
Colonnes
arrow_drop_down
| Product | API Endpoint | Descriptionarrow_upward | w/o API Keykey_off | w/ Free API Keykey | w/ Paid API Keykey | w/ Premium API Keykey | Average Latency | Token Usage Counting | Allowed Request | |
|---|---|---|---|---|---|---|---|---|---|---|
| Reader API | https://r.jina.ai | Converts a URL to LLM-friendly text | 20 RPM | 500 RPM | 500 RPM | trending_up5000 RPM | 7.9s | Count the number of tokens in the output response. | GET/POST | |
| Reader API | https://s.jina.ai | Search the web and convert results to LLM-friendly text | block | 100 RPM | 100 RPM | trending_up1000 RPM | 2.5s | Every request costs a fixed number of tokens, starting from 10000 tokens | GET/POST | |
| Embedding API | https://api.jina.ai/v1/embeddings | Convert text/images to fixed-length vectors | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depends on the input size help | Count the number of tokens in the input request. | POST | |
| Reranker API | https://api.jina.ai/v1/rerank | Rank documents by query | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart depends on the input size help | Count the number of tokens in the input request. | POST |
Questions courantes liées à l'API
code
Puis-je utiliser la même clé API pour toutes les API Jina ?
keyboard_arrow_down
code
Puis-je surveiller l’utilisation des tokens de ma clé API ?
keyboard_arrow_down
code
Que dois-je faire si j'oublie ma clé API ?
keyboard_arrow_down
code
Les clés API expirent-elles ?
keyboard_arrow_down
code
Puis-je transférer des tokens entre des clés API ?
keyboard_arrow_down
code
Puis-je révoquer ma clé API ?
keyboard_arrow_down
code
Pourquoi la première demande de certains modèles est-elle lente ?
keyboard_arrow_down
code
Mes données API sont-elles utilisées pour entraîner vos modèles ?
keyboard_arrow_down
code
Quelles sont les limites de débit des API Jina ?
keyboard_arrow_down
code
Existe-t-il des limites de taille de lot pour les API ?
keyboard_arrow_down
code
Les API Jina sont-elles la même chose que les modèles Jina au sein d'Elastic ?
keyboard_arrow_down
Questions courantes liées à la facturation
attach_money
La facturation est-elle basée sur le nombre de phrases ou de demandes ?
keyboard_arrow_down
attach_money
Existe-t-il un essai gratuit disponible pour les nouveaux utilisateurs ?
keyboard_arrow_down
attach_money
Les tokens sont-ils facturés pour les demandes ayant échoué ?
keyboard_arrow_down
attach_money
Quels moyens de paiement sont acceptés ?
keyboard_arrow_down
attach_money
La facturation est-elle disponible pour les achats de tokens ?
keyboard_arrow_down
attach_money
Comment puis-je acheter une licence commerciale plutôt que des tokens API ?
keyboard_arrow_down
attach_money
Puis-je payer par facture ou bon de commande plutôt que par carte ?
keyboard_arrow_down
attach_money
J'ai payé, mais mon solde ou ma limite de débit n'a pas changé. Que dois-je vérifier ?
keyboard_arrow_down
attach_money
Comment puis-je annuler, arrêter le rechargement automatique ou supprimer un mode de paiement enregistré ?
keyboard_arrow_down



