Reader

Convertissez une URL en entrée compatible avec LLM en ajoutant r.jina.ai au début.


API de Reader

Convertissez une URL en entrée compatible avec LLM en ajoutant r.jina.ai au début.


Utilisez r.jina.ai pour lire une URL et récupérer son contenu
Utilisez s.jina.ai pour rechercher sur le Web et obtenir le SERP
Ajoutez mcp.jina.ai comme serveur MCP pour accéder à notre API dans les LLM


Demande
GET
curl "https://r.jina.ai/https://www.example.com"


jina-ocr-v1 : Analyse de documents plus rapide sur des GPU à petit budget

Un analyseur de documents à mélange d'experts, de 3,4B paramètres, dont seulement 570M sont actifs par token. Il lit une image de page et restitue, en un seul passage, du Markdown avec texte, formules, tableaux et ordre de lecture.
L'embedding de données web dans les LLM est une étape cruciale de leur embedding, mais peut s'avérer complexe. La méthode la plus simple consiste à extraire le code HTML brut de la page web. Cependant, cette opération peut être complexe et souvent bloquée, et le code HTML brut est encombré d'éléments superflus tels que des balises et des scripts. L'API Reader résout ces problèmes en extrayant le contenu principal d'une URL et en le convertissant en un texte propre et compatible avec les LLM, garantissant ainsi des données de haute qualité pour vos systèmes d'agents et de gestion des annonces (RAG). L'API Reader est une infrastructure de développement : elle convertit une URL que vous fournissez en un texte compatible avec les LLM afin que vous puissiez créer vos propres systèmes de recherche, RAG et d'agents. Il ne s'agit pas d'un moteur de recherche grand public et elle n'indexe ni ne classe le web pour vous ; vous contrôlez les URL traitées et êtes responsable de l'utilisation des résultats.



HTML brut

Sortie du Reader

Reader peut être utilisé comme API SERP. Il vous permet d'alimenter votre LLM avec le contenu derrière la page des résultats du moteur de recherche. Ajoutez simplement https://s.jina.ai/?q= à votre requête, et Reader effectuera une recherche sur le Web et renverra les cinq premiers résultats avec leurs URL et leur contenu, chacun dans un texte clair et adapté au LLM. De cette façon, vous pouvez toujours maintenir votre LLM à jour, améliorer sa factualité et réduire les hallucinations.



Veuillez noter que contrairement à la démo présentée ci-dessus, en pratique, vous ne recherchez pas la question d'origine sur le Web pour vous ancrer. Ce que les gens font souvent, c'est réécrire la question d'origine ou utiliser des questions à sauts multiples. Ils lisent les résultats récupérés, puis génèrent des requêtes supplémentaires pour recueillir plus d'informations si nécessaire avant d'arriver à une réponse finale.
Les images de la page Web sont automatiquement sous-titrées à l'aide d'un modèle de langage de vision dans le Reader et formatées sous forme de balises alt d'image dans la sortie. Cela donne à votre LLM en aval juste assez d'indices pour intégrer ces images dans ses processus de raisonnement et de synthèse. Cela signifie que vous pouvez poser des questions sur les images, en sélectionner des spécifiques ou même transmettre leurs URL à un VLM plus puissant pour une analyse plus approfondie !
Oui, Reader prend en charge nativement la lecture de PDF. Il est compatible avec la plupart des PDF, y compris ceux contenant de nombreuses images, et il est ultra-rapide ! En combinaison avec un LLM, vous pouvez facilement créer une IA ChatPDF ou d'analyse de documents en un rien de temps.

La meilleure partie? C'est gratuit!

L'API Reader est disponible gratuitement et offre une limite de débit et une tarification flexibles. Construite sur une infrastructure évolutive, elle offre une grande accessibilité, un fort niveau de concurrence et une fiabilité élevée. Nous nous efforçons d'être votre solution d'ancrage préférée pour vos LLM.
Limite de débit
Les limites de débit sont suivies de deux manières : RPM (requêtes par minute) et TPM (tokens par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
ProductAPI EndpointDescriptionw/o API Keyw/ Free API Keyw/ Paid API Keyw/ Premium API KeyAverage latencyToken Usage CountingAllowed Request
Reader APIhttps://r.jina.aiConverts a URL to LLM-friendly text20 RPM500 RPM500 RPM5000 RPM7.9sCount the number of tokens in the output response.GET/POST
Reader APIhttps://s.jina.aiSearch the web and convert results to LLM-friendly text100 RPM100 RPM1000 RPM2.5sEvery request costs a fixed number of tokens, starting from 10 000 tokensGET/POST
Embedding APIhttps://api.jina.ai/v1/embeddingsConvert text/images to fixed-length vectors100 RPM & 100,000 TPM500 RPM & 2,000,000 TPM5,000 RPM & 50,000,000 TPM
depends on the input size
Count the number of tokens in the input request.POST
Reranker APIhttps://api.jina.ai/v1/rerankRank documents by query100 RPM & 100,000 TPM500 RPM & 2,000,000 TPM5,000 RPM & 50,000,000 TPM
depends on the input size
Count the number of tokens in the input request.POST
Pas de panique ! Chaque nouvelle clé API contient 10 millions de tokens gratuits !

Tarification des API

La tarification de l'API est basée sur l'utilisation des tokens. Une seule clé API vous donne accès à tous les produits Search Foundation.
Rechargez cette clé API avec plus de tokens
Selon votre emplacement, vous pouvez être facturé en USD, EUR ou dans d'autres devises. Des taxes peuvent s'appliquer.
Veuillez saisir la bonne clé API pour recharger
Limite de débit
Les limites de débit sont suivies de deux manières : RPM (requêtes par minute) et TPM (tokens par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
ProductAPI EndpointDescriptionw/o API Keyw/ Free API Keyw/ Paid API Keyw/ Premium API KeyAverage latencyToken Usage CountingAllowed Request
Reader APIhttps://r.jina.aiConverts a URL to LLM-friendly text20 RPM500 RPM500 RPM5000 RPM7.9sCount the number of tokens in the output response.GET/POST
Reader APIhttps://s.jina.aiSearch the web and convert results to LLM-friendly text100 RPM100 RPM1000 RPM2.5sEvery request costs a fixed number of tokens, starting from 10 000 tokensGET/POST
Embedding APIhttps://api.jina.ai/v1/embeddingsConvert text/images to fixed-length vectors100 RPM & 100,000 TPM500 RPM & 2,000,000 TPM5,000 RPM & 50,000,000 TPM
depends on the input size
Count the number of tokens in the input request.POST
Reranker APIhttps://api.jina.ai/v1/rerankRank documents by query100 RPM & 100,000 TPM500 RPM & 2,000,000 TPM5,000 RPM & 50,000,000 TPM
depends on the input size
Count the number of tokens in the input request.POST
Questions courantes liées à l'API
Questions courantes liées à la facturation