Elastic
Jina AI
Modelle
API
keyboard_arrow_down
Reader
Konvertieren Sie jede URL in Markdown für besseres Grounding von LLMs.
Einbettungen
Multimodale, mehrsprachige Einbettungen.
Reranker
Reranker zur Maximierung der Suchrelevanz.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenten
data_object
Schema
menu_book
Dokumentation
Einloggen
login

Kontaktieren Sie unseren Vertrieb

Erweitern Sie Ihr Geschäft mit Jina AI.

nights_stay Das Vertriebsteam ist gerade nicht erreichbar und in 53 h wieder da.

Zwei Kaufmöglichkeiten

Abonnieren Sie unsere API oder kaufen Sie über Cloud-Anbieter.
radio_button_unchecked
cloud
Mit 3 Cloud-Service-Anbietern
Verwendet Ihr Unternehmen AWS oder Azure? Sie können unsere Modelle direkt auf der Cloud-Plattform Ihres Unternehmens einsetzen und die Abrechnung über das CSP-Konto abwickeln.
AWS SageMaker
Einbettungen
Reranker
Microsoft Azure
Einbettungen
Reranker
Google Cloud
Einbettungen
radio_button_checked
Mit Jina Search Foundation API
Der einfachste Weg, auf alle unsere Produkte zuzugreifen. Laden Sie Tokens unterwegs auf.
Laden Sie diesen API-Schlüssel mit weiteren Token auf
Abhängig von Ihrem Standort werden Ihnen möglicherweise USD, EUR oder andere Währungen in Rechnung gestellt. Es können Steuern anfallen.
Bitte geben Sie zum Aufladen den richtigen API-Schlüssel ein
Verstehen Sie die Ratenbegrenzung
Ratenbegrenzungen sind die maximale Anzahl von Anfragen, die pro Minute pro IP-Adresse/API-Schlüssel (RPM) an eine API gestellt werden können. Nachfolgend erfahren Sie mehr über die Ratenbegrenzungen für jedes Produkt und jede Stufe.
keyboard_arrow_down
Ratenbegrenzung
Ratenlimits werden auf zwei Arten erfasst: RPM (Anfragen pro Minute) und TPM (Token pro Minute). Die Limits werden pro IP/API-Schlüssel erzwungen und ausgelöst, wenn zuerst der RPM- oder TPM-Schwellenwert erreicht wird. Wenn Sie im Request-Header einen API-Schlüssel angeben, erfassen wir die Ratenlimits pro Schlüssel und nicht nach IP-Adresse.
ProduktAPI-EndpunktBeschreibungarrow_upwardohne API-Schlüsselkey_offmit kostenlosem API-Schlüsselkeymit kostenpflichtigem API-Schlüsselkeymit Premium-API-SchlüsselkeyDurchschnittliche LatenzZählung der Token-NutzungZulässige Anfrage
Reader-APIhttps://r.jina.aiURL in LLM-freundlichen Text konvertieren20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sAnzahl der Token in der Ausgabeantwort zählenGET/POST
Reader-APIhttps://s.jina.aiDas Web durchsuchen und die Ergebnisse in LLM-freundlichen Text konvertierenblock100 RPM100 RPMtrending_up1000 RPM2.5sJede Anfrage kostet eine feste Anzahl an Token, beginnend bei 10000 TokenGET/POST
Einbettungs-APIhttps://api.jina.ai/v1/embeddingsText/Bilder in Vektoren mit fester Länge konvertierenblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Anzahl der Token in der Eingabeanforderung zählenPOST
Reranker-APIhttps://api.jina.ai/v1/rerankDokumente nach Abfrage ordnenblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Anzahl der Token in der Eingabeanforderung zählenPOST

FAQ

Jina AI × Elastic

handshake
Wird die Marke Jina erhalten bleiben?
keyboard_arrow_down
Ja. Jina ist eine Modellmarke innerhalb von Elastic. Man kann es sich wie Qwen bei Alibaba, GPT bei OpenAI oder Kimi bei Moonshot vorstellen. Die rechtliche Identität wurde zu Elastic übertragen, wodurch sich Jina AI als Marke ausschließlich auf Search-Foundation-Modelle konzentrieren kann.
handshake
Worauf wird sich Jina AI in Zukunft konzentrieren?
keyboard_arrow_down
Einbettungen, Reranker und kleine Modelle für eine bessere Suche, einschließlich multimodaler und Reader-Modelle. Unsere Mission ist noch nicht abgeschlossen, und wir haben unser Ziel nie verheimlicht: ein führender Anbieter von Suchmodellen zu werden.
handshake
Werden die API- und Cloud-Marktplatzangebote fortgeführt?
keyboard_arrow_down
Ja. Die Reader-API, die Embeddings-API und die Reranker-API werden weiterhin entwickelt und gepflegt, und Modelle werden weiterhin auf Cloud-Marktplatzplattformen veröffentlicht. Sie können unsere API-Dienste wie gewohnt nutzen. Die einzige Ausnahme besteht darin, dass wir keine Unternehmen oder Länder bedienen können, die den US-Exportkontrollen unterliegen.
handshake
Werden Sie weiterhin Open-Weights-Modelle auf Hugging Face veröffentlichen?
keyboard_arrow_down
Ja. Bei Elastic treibt Jina die Entwicklung von Search-Foundation-Modellen kontinuierlich voran, und wir veröffentlichen ständig neue Open-Weights-Modelle.
handshake
Unter welcher Lizenz werden diese Open-Source-Modelle veröffentlicht?
keyboard_arrow_down
Die meisten aktuellen Modelle stehen unter der CC-BY-NC 4.0-Lizenz, und wir gehen davon aus, dass dies auch so bleibt. Ältere Modelle der Generationen v1 und v2 unterliegen der Apache-2.0-Lizenz, die die kommerzielle Nutzung uneingeschränkt erlaubt. Ein Modell, jina-embeddings-v4, unterliegt der Qwen-Forschungslizenz, die es von seinem Basismodell erbt: Diese Lizenz erlaubt keinerlei kommerzielle Nutzung, und es gibt auch keine kommerzielle Lizenz dafür. Die jeweils gültige Lizenz ist immer auf der Modellseite auf Hugging Face angegeben. Prüfen Sie diese daher bitte dort, anstatt sie aus der Generation abzuleiten. Unter CC-BY-NC 4.0 können die Gewichte kostenlos heruntergeladen, evaluiert, für Benchmarks verwendet und in der Forschung unter Angabe der Quelle genutzt werden. Für die Verwendung in einem kommerziellen Produkt ist jedoch eine kommerzielle Lizenz erforderlich, die Elastic als eigene SKU anbietet. Kontaktieren Sie Elastic Sales, um eine solche Lizenz zu erwerben.
handshake
Werden Sie weiterhin Forschungsarbeiten veröffentlichen?
keyboard_arrow_down
Ja. Jedes von uns veröffentlichte Modell wird durch eine fundierte wissenschaftliche Arbeit untermauert, und wir reichen unsere Arbeiten weiterhin bei Top-Konferenzen wie ICLR, EMNLP, SIGIR, NeurIPS und ICML ein.
handshake
Ich bin noch kein Jina- oder Elastic-Kunde, möchte aber die Reader-API, Modell-APIs oder Cloud-Marketplace-Images nutzen. Was muss ich tun?
keyboard_arrow_down
Melden Sie sich einfach an und bezahlen Sie wie bisher über unsere Website oder den entsprechenden Cloud-Marktplatz.
handshake
Kann ich eine kommerzielle Lizenz für Jina-Modelle von Elastic erwerben?
keyboard_arrow_down
Ja. Seit dem 10. August 2026 vertreibt Elastic kommerzielle Lizenzen für Jina-Modelle direkt unter eigener Artikelnummer (SKU). Dies umfasst den Betrieb von Jina-Modellen in Ihrer eigenen, selbstverwalteten, lokalen oder abgeschotteten Infrastruktur und ist über Elastic Direct, Bundesbehörden und Cloud-Service-Provider (CSP) erhältlich. Das Angebot heißt Jina On-Prem. Für ein Angebot kontaktieren Sie bitte den Elastic-Vertrieb.
handshake
Was ist Jina On-Prem?
keyboard_arrow_down
Jina On-Prem ist eine kommerzielle Lizenz mit integrierten Docker-Containern, mit denen Sie Jina-Modelle vollständig in Ihrer eigenen Infrastruktur ausführen können. Die Container stellen keine externen Verbindungen her: Es erfolgt kein Aufruf von Hugging Face oder einer Modellregistrierung, und es gibt keinen Lizenzserver, keine Telemetrie- oder Protokollierungs-Endpunkte. Dadurch eignen sie sich für den Einsatz in einem abgeschotteten Netzwerk. Sie decken das gesamte Jina-Modellportfolio ab, einschließlich Embedding-, Reranker- und Reader-Modellen, und stellen API-Schemas für Elastic Inference Service (EIS), OpenAI, Cohere, Voyage AI und Gemini bereit, sodass bestehende Anwendungen ohne Codeänderungen funktionieren. Es handelt sich um eine separate SKU: Sie basiert nicht auf Elastic Resource Units (ERUs) und erfordert kein Elasticsearch. Sie ist auch mit Open-Source-Elasticsearch kompatibel. Jina On-Prem kann seit dem 10. August 2026 bestellt werden. Für Verfügbarkeit und Konditionen wenden Sie sich bitte an Elastic Sales.
handshake
Wie ist die Preisgestaltung von Jina On-Prem?
keyboard_arrow_down
Es handelt sich um eine jährliche Lizenzgebühr, deren Umfang von den eingesetzten Modellen und der Menge der für die Inferenz verwendeten Hardware abhängt. Die Gebühr wird nicht pro Benutzer, Knoten oder Modellgröße berechnet, und es erfolgt keine Abrechnung pro Token. Eine reine CPU-Bereitstellung wird analog dazu anhand der für die Inferenz verwendeten Prozessoren berechnet. Die Preisgestaltung ist nicht selbsterklärend: Kontaktieren Sie Elastic Sales, um ein Angebot für Ihre Bereitstellung zu erhalten.
handshake
Für wen ist Jina On-Prem gedacht?
keyboard_arrow_down
Organisationen, die keine Daten an einen Cloud-KI-Dienst senden können oder wollen, sind hier genau richtig. Typische Anwendungsfälle sind abgeschottete Umgebungen mit hohen Sicherheitsanforderungen, der öffentliche Sektor und die Verteidigung, regulierte Branchen wie Finanzdienstleistungen und Gesundheitswesen, latenzkritische oder Offline-Systeme sowie Teams, die feste, planbare Inferenzkosten anstelle einer Abrechnung pro Token bevorzugen. Trifft dies auf Ihre Implementierung zu, kann das Vertriebsteam von Elastic die Details mit Ihnen besprechen.
handshake
Ich bin Elastic-Kunde. Kann ich Jina-Modelle in Elastic Cloud verwenden, ohne etwas bereitstellen zu müssen?
keyboard_arrow_down
Ja. Jina-Modelle sind über den Elastic Inference Service (EIS) verfügbar und können daher für die Datenerfassung und -suche genutzt werden, ohne dass Machine-Learning-Knoten bereitgestellt oder GPU-Infrastruktur verwaltet werden muss. Zu den im EIS üblicherweise verfügbaren Modellen gehören jina-embeddings-v5-text-small, jina-embeddings-v5-text-nano, jina-embeddings-v5-omni-small, jina-embeddings-v5-omni-nano, jina-embeddings-v3, jina-clip-v2 sowie die Reranker jina-reranker-v3.5, jina-reranker-v3, jina-reranker-v2-base-multilingual und jina-reranker-m0. Die aktuelle Modellliste, die unterstützten Regionen und die minimale Stack-Version für jedes Modell finden Sie in der Elastic-Dokumentation.
handshake
Ich habe die Gewichte von Hugging Face heruntergeladen. Benötige ich eine Lizenz, um sie produktionstechnisch einzusetzen?
keyboard_arrow_down
Es hängt von der Lizenz des jeweiligen Modells ab, die auf der Seite bei Hugging Face angegeben ist. Die Apache-2.0-Lizenz erlaubt die kommerzielle Nutzung ohne zusätzlichen Kauf. Unter CC-BY-NC 4.0 sind Evaluierung, Benchmarking und Forschung kostenlos, für die kommerzielle Nutzung in der Produktion ist jedoch eine kommerzielle Lizenz erforderlich, wie sie beispielsweise Jina On-Prem bietet. Eine Forschungslizenz erlaubt keinerlei kommerzielle Nutzung, und auch die kommerziellen Lizenzen der anderen Modelle erstrecken sich nicht darauf. Daher ist ein Modell unter einer dieser Lizenzen unabhängig vom Budget nicht für den Produktiveinsatz geeignet. Wichtig: Dies bezieht sich auf die Gewichtungen. Für die kommerzielle Nutzung der gehosteten APIs oder der offiziellen Cloud-Marketplace-Images ist keine separate Lizenz erforderlich. Um eine solche Lizenz zu erwerben, wenden Sie sich bitte an Elastic Sales.
handshake
Ich möchte einen Vertrag oder eine individuelle Vereinbarung für Jina-Models unterzeichnen. Was muss ich tun?
keyboard_arrow_down
Kontaktieren Sie den Elastic-Vertrieb. Kommerzielle Lizenzierung, Vertragsabwicklung und Support für Jina-Modelle erfolgen nun über den Standard-Vertriebs- und Supportprozess von Elastic.
handshake
Ich beziehe Ihre Dienstleistungen als chinesisches Unternehmen. Kann ich eine chinesische Rechnung (发票) erhalten?
keyboard_arrow_down
Nicht für API-Aufladungen im Self-Service: Diese werden automatisch von der zahlungsverarbeitenden Stelle in Rechnung gestellt, die keine chinesischen Rechnungen (发票) ausstellen kann. Für vertragsbasierte Käufe, einschließlich Jina On-Prem, wenden Sie sich bitte an Elastic Sales, um die verfügbaren Vertragspartner und Rechnungsstellungsmodalitäten zu besprechen.
handshake
Ich bin Elastic-Kunde und möchte Best Practices für Embeddings und Reranker kennenlernen, oder ich bin allgemein an der Entwicklung von Jina AI interessiert. Was soll ich tun?
keyboard_arrow_down
Kontaktieren Sie Elastic Sales, und wir können ein Treffen zwischen Ihnen, dem Jina AI-Team und Elastic vereinbaren.
handshake
Ist ein neues Modell, das Sie während meiner Lizenzlaufzeit veröffentlichen, inbegriffen?
keyboard_arrow_down
Modelle, die während der Laufzeit in derselben Kategorie veröffentlicht wurden, sind eingeschlossen: Es ist kein neuer Vertrag oder Kauf erforderlich, und Ihr Lizenzschlüssel bleibt unverändert, da er für die Kategorie und nicht für ein einzelnes Modell ausgestellt wird. Modelle mit einer Lizenz, die keine kommerzielle Nutzung erlaubt, bilden die Ausnahme, da für diese keine kommerzielle Lizenz gilt. Welche Details ein bestimmter Vertrag umfasst, erfahren Sie bei Elastic Sales.
handshake
Welche Unterstützung ist in einer kommerziellen Lizenz enthalten und wer bietet diese an?
keyboard_arrow_down
Die Lizenz beinhaltet Support auf Enterprise-Niveau gemäß der Standard-Servicevereinbarung. Die Bereitstellung bleibt in Ihrer Verantwortung: Sie laden das Container-Image herunter und führen es in Ihrer eigenen Umgebung aus. Der Support hilft Ihnen bei Installationsproblemen. Der Support erfolgt gemäß dem Standardprozess von Elastic, wie alle vertraglichen Abläufe. Informationen zu den Service-Levels einer bestimmten Vereinbarung erhalten Sie beim Elastic Sales.
handshake
Welche Begriffe der Datenverarbeitung gelten nun, da Jina Teil von Elastic ist?
keyboard_arrow_down
Die Datenverarbeitung unterliegt der Datenverarbeitungsvereinbarung von Elastic und nicht mehr den früheren Bedingungen der Jina AI GmbH. Dies ist relevant für Beschaffungsunterlagen, die auf die alte Vereinbarung verweisen. Daher empfiehlt es sich, alle vor der Übernahme erstellten Dokumente zu prüfen. Die aktuellen Bedingungen und alle für Ihre Region spezifischen Informationen erhalten Sie bei Elastic Sales.

Wie erhalte ich meinen API-Schlüssel?

video_not_supported

Wie hoch ist die Ratenbegrenzung?

Ratenbegrenzung
Ratenlimits werden auf zwei Arten erfasst: RPM (Anfragen pro Minute) und TPM (Token pro Minute). Die Limits werden pro IP/API-Schlüssel erzwungen und ausgelöst, wenn zuerst der RPM- oder TPM-Schwellenwert erreicht wird. Wenn Sie im Request-Header einen API-Schlüssel angeben, erfassen wir die Ratenlimits pro Schlüssel und nicht nach IP-Adresse.
ProduktAPI-EndpunktBeschreibungarrow_upwardohne API-Schlüsselkey_offmit kostenlosem API-Schlüsselkeymit kostenpflichtigem API-Schlüsselkeymit Premium-API-SchlüsselkeyDurchschnittliche LatenzZählung der Token-NutzungZulässige Anfrage
Reader-APIhttps://r.jina.aiURL in LLM-freundlichen Text konvertieren20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sAnzahl der Token in der Ausgabeantwort zählenGET/POST
Reader-APIhttps://s.jina.aiDas Web durchsuchen und die Ergebnisse in LLM-freundlichen Text konvertierenblock100 RPM100 RPMtrending_up1000 RPM2.5sJede Anfrage kostet eine feste Anzahl an Token, beginnend bei 10000 TokenGET/POST
Einbettungs-APIhttps://api.jina.ai/v1/embeddingsText/Bilder in Vektoren mit fester Länge konvertierenblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Anzahl der Token in der Eingabeanforderung zählenPOST
Reranker-APIhttps://api.jina.ai/v1/rerankDokumente nach Abfrage ordnenblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Anzahl der Token in der Eingabeanforderung zählenPOST

Benötige ich eine gewerbliche Lizenz?

CC BY-NC Lizenz Selbstcheck

play_arrow
Nutzen Sie unsere gehostete API oder unsere offiziellen Images auf Azure, AWS oder GCP?
play_arrow
Ja
Es ist keine separate Lizenz erforderlich. Die kommerzielle Nutzung ist durch die Nutzungsbedingungen abgedeckt: Registrieren Sie sich und bezahlen Sie über diese Website oder den Cloud-Marktplatz.
play_arrow
NEIN
play_arrow
Verwenden Sie die Modellgewichte selbst in einem kommerziellen Produkt oder einer Dienstleistung?
play_arrow
NEIN
Es ist kein Kauf erforderlich. Herunterladen, Evaluieren, Benchmarking und die Nutzung für Forschungszwecke sind unter jeder von uns verwendeten Lizenz mit Quellenangabe gestattet.
play_arrow
Ja
play_arrow
Welche Lizenz besitzt das Model? Das ist auf der Seite des Models bei Hugging Face angegeben.
play_arrow
Apache-2.0
Apache-2.0 erlaubt die kommerzielle Nutzung. Es ist kein Kauf erforderlich. Dies umfasst unsere älteren Modelle der Generationen v1 und v2.
play_arrow
CC BY-NC 4.0
Sie benötigen eine kommerzielle Lizenz. Seit dem 10. August 2026 bietet Elastic eine solche Lizenz für Jina-Modelle als eigene SKU unter dem Namen Jina On-Prem an. Sie deckt selbstverwaltete, lokale und vom Netzwerk getrennte Bereitstellungen ab und erfordert kein Elasticsearch-Abonnement.
Wenn Sie bereits Elastic-Kunde sind, kann Ihr Account-Team dies zu Ihrem bestehenden Vertrag hinzufügen.
Kontaktieren Sie den Elastic-Vertrieb.
play_arrow
Qwen-Forschungslizenz
Eine Forschungslizenz erlaubt keine kommerzielle Nutzung, und eine kommerzielle Lizenz für unsere anderen Modelle erstreckt sich nicht darauf. Für dieses Modell gibt es keine kommerzielle Option, weder für die Eigeninstallation noch über die API. Wählen Sie stattdessen ein Modell unter einer der beiden anderen Lizenzen.

Andere Fragen

Häufig gestellte Fragen zu Reader
Welche Kosten sind mit der Nutzung der Reader-API verbunden?
keyboard_arrow_down
Reader ist für die grundlegende Nutzung kostenlos: Fügen Sie Ihrer URL „https://r.jina.ai/“ voran. Die Angabe eines API-Schlüssels erhöht das Ratenlimit und berechnet Tokens basierend auf der Inhaltslänge. Informationen zu den Ratenlimits finden Sie in Frage 16.
Wie funktioniert die Reader-API?
keyboard_arrow_down
Die Reader-API ruft die URL serverseitig ab und liefert sauberen, LLM-fähigen Text. Sie wählen die Abfrage-Engine über den Header X-Engine: direct führt einen einfachen HTTP-Fetch durch und ist am schnellsten. Die Standard-Engine rendert die Seite in einem Headless-Browser, sodass clientseitiges JavaScript vor der Extraktion ausgeführt wird. cf-browser-rendering ist ein experimenteller, von Cloudflare unterstützter Renderer. Boilerplate-Code wie Navigation, Header, Footer und Werbung wird entfernt, und der Hauptinhalt wird in Markdown konvertiert. Verwenden Sie X-Respond-With, um andere Darstellungsformen derselben Seite zu erhalten, und X-Target-Selector oder X-Remove-Selector, um bestimmte CSS-Selektoren beizubehalten oder zu entfernen.
Ist die Reader-API Open Source?
keyboard_arrow_down
Der Quellcode des Reader-Dienstes ist auf GitHub in der Jina AI-Organisation verfügbar. Die vom Reader verwendeten Modelle, darunter ReaderLM-v2 und jina-vlm, sind unter der CC-BY-NC 4.0-Lizenz lizenziert. Diese Lizenz ist nicht Open Source: Sie dürfen kostenlos heruntergeladen und nicht-kommerziell genutzt werden, für die kommerzielle Nutzung ist jedoch eine kommerzielle Lizenz erforderlich. Elastic bietet diese Lizenz seit dem 10. August 2026 separat an. Wenden Sie sich an Elastic Sales, um eine solche Lizenz zu erwerben.
Wie hoch ist die typische Latenz für die Reader-API?
keyboard_arrow_down
Es hängt hauptsächlich von der Engine und der Seite selbst ab. Ein direkter Abruf einer einfachen Seite dauert typischerweise nur wenige hundert Millisekunden, während die Standard-Browser-Engine die Seite laden und ausführen muss, bevor sie geladen werden kann, was üblicherweise einige Sekunden dauert. Umfangreiche Single-Page-Anwendungen, langsame Ursprungsserver und große PDFs benötigen mehr Zeit. Wird dieselbe URL innerhalb von 5 Minuten wiederholt aufgerufen, wird sie aus dem Cache geladen und ist nahezu sofort verfügbar. Daher ist eine bereits bekannte URL deutlich schneller als eine unbekannte.
Warum sollte ich die Reader-API verwenden, anstatt die Seite selbst zu scrapen?
keyboard_arrow_down
Scraping kann kompliziert und unzuverlässig sein, insbesondere bei komplexen oder dynamischen Seiten. Die Reader-API bietet eine optimierte, zuverlässige Ausgabe von sauberem, LLM-fähigem Text.
Unterstützt die Reader-API mehrere Sprachen?
keyboard_arrow_down
Die Reader-API ist sprachunabhängig und gibt Inhalte in der Originalsprache der Seite zurück; sie führt keine Übersetzung durch. Die Inhaltsverhandlung erfolgt über den X-Locale-Header, der die beim Rendern verwendete Browsersprache festlegt. So können Websites, die je nach Sprache unterschiedliche Formatierungen bereitstellen, auf die gewünschte Version umgeleitet werden.
Berücksichtigt die Reader-API die Zugriffskontrollen der Website?
keyboard_arrow_down
Ja. Reader funktioniert wie ein herkömmlicher Webclient und respektiert die Zugriffskontrollen von Websites. Wenn eine Website die Anfrage blockiert, wird diese Entscheidung respektiert. Sie sind dafür verantwortlich, dass Ihre Nutzung von Reader den Nutzungsbedingungen der von Ihnen besuchten Websites entspricht und keine Rechte Dritter an geistigem Eigentum verletzt.
Kann die Reader-API Inhalte aus PDF-Dateien extrahieren?
keyboard_arrow_down
Ja, die Reader-API kann Inhalte aus PDF-Dateien nativ extrahieren.
Kann die Reader-API Medieninhalte von Webseiten verarbeiten?
keyboard_arrow_down
Ja, Reader kann Bilder auf Webseiten mithilfe des x-with-generated-alt-Headers mit einer Bildunterschrift versehen. Dadurch werden beschreibende Alt-Tags zu Bildern hinzugefügt, denen diese fehlen, sodass große Sprachmodelle (LLMs) die visuellen Inhalte besser verstehen können. Die Videozusammenfassung ist für zukünftige Versionen geplant.
Ist es möglich, die Reader-API auf lokale HTML-Dateien anzuwenden?
keyboard_arrow_down
Nein, die Reader-API kann nur Inhalte von öffentlich zugänglichen URLs verarbeiten.
Speichert die Reader-API den Inhalt im Cache?
keyboard_arrow_down
Wenn Sie innerhalb von 5 Minuten dieselbe URL anfordern, gibt die Reader-API den zwischengespeicherten Inhalt zurück.
Kann ich die Reader-API verwenden, um auf Inhalte hinter einer Anmeldung zuzugreifen?
keyboard_arrow_down
Ja, für Seiten, die Cookie-basierte Sessions akzeptieren. Übergeben Sie Ihre Session-Cookies mit dem Header X-Set-Cookie. Der Reader leitet sie beim Abrufen der URL weiter, indem er dieselbe Form <name>=<value> wie ein normales Set-Cookie verwendet, optional mit dem Scope ; domain=. Anfragen mit Cookies werden nicht zwischengespeichert, daher wird jede Anfrage neu abgerufen. Dies führt keine automatische Anmeldung durch: Es werden Ihre bereits vorhandenen Anmeldeinformationen verwendet. Sie sind daher selbst dafür verantwortlich, diese zu beschaffen und die Nutzungsbedingungen der Zielseite einzuhalten. Abläufe, die eine interaktive Anmeldung, MFA oder ein vom Seitenaufruf selbst generiertes Bearer-Token erfordern, fallen nicht unter diese Funktion.
Kann ich die Reader-API verwenden, um auf arXiv auf PDF zuzugreifen?
keyboard_arrow_down
Ja, Sie können entweder die native PDF-Unterstützung des Readers (https://r.jina.ai/https://arxiv.org/pdf/2310.19923v4) oder die HTML-Version von arXiv (https://r.jina.ai/https://arxiv.org/html/2310.19923v4) verwenden.
Wie funktionieren Bildunterschriften im Reader?
keyboard_arrow_down
Der Reader beschriftet alle Bilder unter der angegebenen URL und fügt Image [idx]: [caption] als Alt-Tag hinzu (falls ursprünglich keiner vorhanden ist). Dies ermöglicht nachgelagerten LLMs, beim Denken, Zusammenfassen usw. mit den Bildern zu interagieren.
Wie skalierbar ist der Reader? Kann ich ihn in der Produktion einsetzen?
keyboard_arrow_down
Die Reader-API ist auf hohe Skalierbarkeit ausgelegt. Sie wird automatisch auf Basis des Echtzeitverkehrs skaliert und die maximale Anzahl gleichzeitiger Anfragen liegt derzeit bei etwa 4000. Wir pflegen sie aktiv als eines der Kernprodukte von Jina AI. Sie können sie also gerne in der Produktion verwenden.
Wie hoch ist die Ratenbegrenzung der Reader-API?
keyboard_arrow_down
Die neuesten Informationen zur Ratenbegrenzung finden Sie in der folgenden Tabelle. Beachten Sie, dass wir aktiv an der Verbesserung der Ratenbegrenzung und der Leistung der Reader-API arbeiten. Die Tabelle wird entsprechend aktualisiert.
speedRatenbegrenzung
Was ist ReaderLM? Wie kann ich es verwenden?
keyboard_arrow_down
ReaderLM-v2 ist ein kleines Sprachmodell mit 1,54 Milliarden Parametern, das rohes HTML in sauberes Markdown oder JSON umwandelt und strukturierte Daten mithilfe eines JSON-Schemas oder natürlicher Sprachbefehle extrahieren kann. Es kann über die Reader-API mit dem Header x-respond-with: readerlm-v2 verwendet oder über die Marktplätze von AWS, Azure oder GCP bereitgestellt werden. Für bildlastige oder gescannte Dokumente steht unser Bildverarbeitungs-Readermodell jina-vlm mit 2,4 Milliarden Parametern zur Verfügung.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Wie extrahiere ich strukturierte Daten von Webseiten?
keyboard_arrow_down
Verwenden Sie den Header x-json-schema mit einer JSON-Schema-Definition oder den Header x-instruction mit Anweisungen in natürlicher Sprache. Beide Funktionen ermöglichen in Verbindung mit ReaderLM-v2 das Extrahieren bestimmter Felder wie Preise, Titel, Datum usw. von beliebigen Webseiten in ein strukturiertes JSON-Format.
Umgeht Reader aktiv den Anti-Bot-Schutz der Website?
keyboard_arrow_down
Nein. Reader umgeht oder unterläuft keine Website-Sicherheitsmechanismen, Anti-Bot-Systeme oder Zugriffskontrollen. Wenn eine Website unseren Dienst als Bot erkennt und die Anfrage blockiert, respektieren wir diese Entscheidung. Wir verhalten uns wie ein Standard-Webclient und verwenden keine Techniken, die Erkennungssysteme umgehen sollen. Sie sind weiterhin dafür verantwortlich, dass Ihre Nutzung von Reader die Rechte am geistigen Eigentum Dritter und die Nutzungsbedingungen der von Ihnen besuchten Websites respektiert.
Erhalte ich durch das Upgrade von einem kostenlosen auf einen kostenpflichtigen API-Schlüssel Zugriff auf mehr Websites?
keyboard_arrow_down
Nein. Ein Upgrade von einem kostenlosen Tarif auf einen kostenpflichtigen API-Schlüssel gewährt keinen Zugriff auf zusätzliche Websites und umgeht keine Website-Beschränkungen. Der Unterschied zwischen den Tarifen liegt hauptsächlich in den Ratenbegrenzungen und Leistungsoptimierungen. Ein kostenpflichtiger API-Schlüssel ermöglicht einen höheren Durchsatz und eine schnellere Verarbeitung, jedoch keinen Zugriff auf Websites, die unseren Dienst blockieren.
Kann ich Reader innerhalb meiner eigenen Infrastruktur ausführen?
keyboard_arrow_down
Ja. Die Reader-Modelle werden als eigenständige Offline-Docker-Container unter der kommerziellen Jina On-Prem-Lizenz bereitgestellt, die Elastic seit dem 10. August 2026 als eigene SKU anbietet. Dies ist die optimale Lösung für abgeschottete Umgebungen mit Firewalls, in denen die Container keinerlei ausgehende Verbindungen herstellen. Beachten Sie jedoch, dass zum Abrufen beliebiger öffentlicher Webseiten weiterhin ein Netzwerkzugriff auf diese Seiten erforderlich ist; der Vorteil der On-Premise-Lösung liegt in der lokalen Ausführung der Extraktionsmodelle. Kontaktieren Sie den Elastic-Vertrieb für ein Angebot.
Häufige Fragen zu Einbettungen
Wie wurden die Jina-Einbettungsmodelle trainiert?
keyboard_arrow_down
Detaillierte Informationen zu unseren Trainingsprozessen, Datenquellen und Evaluierungen finden Sie in den technischen Berichten auf arXiv. Die jina-embeddings-v5-Textmodelle werden in zwei Schritten trainiert: Zunächst werden die Einbettungen aus einem größeren Lehrermodell extrahiert, anschließend werden die aufgabenspezifischen LoRA-Adapter mit den eingefrorenen Backbone-Gewichten trainiert. Die v5-omni-Multimodalvarianten ergänzen dies um einen dritten Schritt, in dem ausschließlich crossmodale Projektoren trainiert werden, während der Text-Backbone und die Adapter eingefroren bleiben.
launcharXiv
Welche multimodalen Einbettungsmodelle verwenden Sie?
keyboard_arrow_down
Unsere aktuellen multimodalen Modelle sind jina-embeddings-v5-omni-small (~1,74 Mrd. Parameter, 1024 Dimensionen, 32.000 Kontext) und jina-embeddings-v5-omni-nano (~1,04 Mrd. Parameter, 768 Dimensionen, 8.000 Kontext). Sie verarbeiten Text, Bilder, Audio, Video und PDFs in einem gemeinsamen Vektorraum. So können Sie in einer Modalität indizieren und in einer anderen abfragen, ohne neu indizieren zu müssen. Ihre reine Textausgabe entspricht der von jina-embeddings-v5-text-small bzw. jina-embeddings-v5-text-nano. Das bedeutet, dass Sie multimodale Eingaben zu einem bestehenden Textindex hinzufügen können, ohne diese neu einzubetten. jina-clip-v2 (865 Mio. Parameter) steht weiterhin als schlankere Option für Text und Bilder zur Verfügung.
launcharXiv
Welche Sprachen unterstützen Ihre Modelle?
keyboard_arrow_down
Alle seit 2024 veröffentlichten Modelle sind mehrsprachig. Das Modell jina-embeddings-v5-text-small und die v5-omni-Modelle basieren auf einem Qwen3-Backbone mit breiter mehrsprachiger Abdeckung. jina-embeddings-v5-text-nano basiert auf EuroBERT-210M und unterstützt 15 wichtige europäische und globale Sprachen, darunter Englisch, Französisch, Deutsch, Spanisch, Chinesisch, Japanisch, Arabisch und Hindi. jina-embeddings-v3 und jina-clip-v2 unterstützen 89 Sprachen. Die Benchmark-Ergebnisse für die einzelnen Sprachen finden Sie in den MMTEB-Ergebnissen im jeweiligen technischen Bericht des Modells.
launcharXiv
Was ist die maximale Kontextlänge für eine einzelne Eingabe?
keyboard_arrow_down
Die Kontextlänge variiert je nach Modell: jina-embeddings-v5-text-small und jina-embeddings-v5-omni-small unterstützen bis zu 32.768 Tokens, während jina-embeddings-v5-text-nano und jina-embeddings-v5-omni-nano 8.192 Tokens unterstützen. jina-embeddings-v4 und die jina-code-embeddings-Modelle unterstützen 32.768 Tokens; jina-embeddings-v3, jina-clip-v2 und jina-colbert-v2 unterstützen 8.192 Tokens. Eingaben, die das Limit überschreiten, führen zu einem Fehler, es sei denn, Sie setzen truncate: true.
Wie viele Eingaben kann ich maximal in eine einzelne Anfrage einbeziehen?
keyboard_arrow_down
Es gibt keine feste Begrenzung für die Anzahl der Elemente pro Anfrage. Die API verarbeitet Eingaben intern anhand der Tokenanzahl, um die GPU optimal zu nutzen. Daher können Sie beliebig viele Texte oder Bilder in einer einzigen Anfrage senden. PDFs bilden die Ausnahme: Senden Sie jeweils nur eine PDF-Datei pro Anfrage.
Wie kann ich Bilder, Audio-, Video- oder PDF-Dateien an die multimodalen Modelle senden?
keyboard_arrow_down
Übergeben Sie ein typisiertes Objekt im input-Array mithilfe eines image-, audio-, video- oder pdf-Schlüssels. Dessen Wert ist entweder eine öffentliche URL oder Base64-kodierte Bytes. Das Modell leitet jede Modalität an den entsprechenden Encoder weiter. Sie können Modalitäten innerhalb eines Batches beliebig mischen. Unterstützte Audioformate sind WAV, MP3, FLAC, OGG, M4A und Opus; Video wird in 32 gleichmäßig abgetasteten Frames verarbeitet. PDFs müssen einzeln pro Anfrage gesendet werden.
Wie schneiden Jina-Embeddings im Vergleich zu den neuesten OpenAI-, Cohere- und Voyage-Modellen ab?
keyboard_arrow_down
jina-embeddings-v5-text-small (677 Millionen Parameter) ist das leistungsstärkste Modell mit weniger als einer Milliarde Parametern auf MMTEB-Ebene. Es erzielt einen durchschnittlichen Wert von 67,0 auf Aufgabenebene und erreicht 71,7 auf Englisch-MTEB. jina-embeddings-v5-text-nano (239 Millionen Parameter) erzielt 65,5 Punkte auf MMTEB-Ebene und übertrifft damit alle Modelle, die wir mit weniger als 500 Millionen Parametern evaluiert haben. Unser Designziel ist die Leistungsfähigkeit pro Parameter und nicht die reine Größe. Daher sind diese Modelle kostengünstiger als die meisten Alternativen bei vergleichbarer oder besserer Retrievalqualität. Alle v5-Modelle unterstützen Matryoshka Representation Learning, sodass Sie die Dimensionen ohne erneutes Training auf 32 reduzieren können.
Wie nahtlos ist der Übergang von OpenAIs Text-Embedding-3-Large zu Ihrer Lösung?
keyboard_arrow_down
Der Übergang ist unkompliziert: unser API-Endpunkt entspricht den Eingabe- und Ausgabe-JSON-Schemas von OpenAIs text-embedding-3-large. In den meisten Codebasen müssen Sie daher lediglich die Basis-URL, den API-Schlüssel und den Modellnamen ändern. Dasselbe gilt für die Jina On-Prem-Container, die zusätzlich Schemas für Elastic Inference Service (EIS), Cohere, Voyage AI und Gemini bereitstellen. Jina-Modelle lassen sich somit problemlos in bestehende Codepfade integrieren. Beachten Sie, dass Einbettungen verschiedener Modellfamilien nicht vergleichbar sind. Sie müssen Ihren Korpus daher neu einbetten, anstatt Vektoren von zwei Anbietern in einem Index zu mischen. Für die On-Prem-Container selbst wenden Sie sich bitte an Elastic Sales.
Wie werden Tokens für Bilder und andere Nicht-Text-Eingaben berechnet?
keyboard_arrow_down
Text wird wie üblich gezählt. Nicht-Text-Eingaben werden vom jeweiligen Encoder in Tokens umgewandelt. Die Kosten hängen stark vom verwendeten Modell ab. Messen Sie daher mit Ihren eigenen Eingaben, anstatt Annahmen zu treffen. Als Richtwert: Ein Bild mit 600x600 Pixeln kostet ungefähr: • jina-embeddings-v5-omni-small: ~363 Tokens • jina-embeddings-v5-omni-nano: ~362 Tokens • jina-embeddings-v4: ~4.840 Tokens • jina-clip-v2: ~16.000 Tokens Die v5-omni-Modelle sind pro Bild um ein bis zwei Größenordnungen günstiger als die älteren Modelle. Jede Antwort enthält ein usage-Objekt mit der genauen Tokenanzahl für diese Anfrage, einschließlich einer image_tokens-Aufschlüsselung für multimodale Eingaben, sodass Sie die Kosten pro Aufruf überprüfen können.
Bieten Sie Modelle zum Einbetten von Bildern, Audio oder Video an?
keyboard_arrow_down
Ja. jina-embeddings-v5-omni-small und jina-embeddings-v5-omni-nano betten Text, Bilder, Audio, Video und PDFs in einen gemeinsamen Vektorraum ein. jina-embeddings-v4 und jina-clip-v2 verarbeiten Text und Bilder.
Können Jina-Embedding-Modelle anhand von privaten oder Firmendaten feinabgestimmt werden?
keyboard_arrow_down
Es gibt zwei Möglichkeiten. Die Self-Service-Variante ist die Fine-Tuning-API. Diese generiert synthetische Trainingsdaten anhand einer Beschreibung Ihrer Domäne und liefert ein feinabgestimmtes Modell, ohne dass Sie einen annotierten Datensatz erstellen müssen. Für die Feinabstimmung proprietärer Daten im Rahmen einer kommerziellen Vereinbarung, auf dedizierter Infrastruktur oder für ein Modell, das nicht in der Basismodellauswahl enthalten ist, wenden Sie sich bitte an Elastic Sales. Diese Aufträge werden über Elastic abgewickelt.
Kontakt
Können die Modelle privat, auf meiner eigenen Infrastruktur oder in meinem eigenen Cloud-Konto gehostet werden?
keyboard_arrow_down
Ja, auf zwei Arten. Jina-Modelle sind auf den Marktplätzen von AWS, Azure und GCP verfügbar, sodass Sie sie in Ihrem eigenen Cloud-Konto bereitstellen können. Für selbstverwaltete, lokale oder vom Internet getrennte Infrastrukturen bietet Elastic eine kommerzielle Lizenz namens Jina On-Prem an, die seit dem 10. August 2026 erhältlich ist. Diese Lizenz liefert die Modelle als vollständig offlinefähige Docker-Container ohne externe Aufrufe und ohne Lizenzserver. Um ein Angebot für eine der beiden Optionen zu erhalten, kontaktieren Sie Elastic Sales.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Was ist der Parameter „task“ und wann sollte ich ihn verwenden?
keyboard_arrow_down
Der Parameter task wählt einen aufgabenspezifischen LoRa-Adapter für optimale Leistung aus. Verwenden Sie retrieval.query für Suchanfragen, retrieval.passage für zu durchsuchende Dokumente, text-matching für symmetrische Ähnlichkeitsanalysen wie Duplikat- oder Paraphrasenerkennung, classification für Kategorisierung und separation für Clustering. Da die Suche asymmetrisch ist, verschlechtert die Verwendung der falschen Seite des Such-/Textpaares die Ergebnisse messbar. Der Parameter wird von jina-embeddings-v5, jina-embeddings-v4 und jina-embeddings-v3 unterstützt.
Was versteht man unter „Late-Interaction Retrieval“ und welche Modelle unterstützen es?
keyboard_arrow_down
Late-Interaction behält Token-Vektoren bei, anstatt ein Dokument zu einem einzigen Vektor zusammenzufassen. Dadurch bleiben feine Details erhalten, allerdings auf Kosten eines größeren Index. jina-embeddings-v4 unterstützt über den Parameter output_type sowohl die dichte Einzelvektor-Ausgabe als auch die mehrvektorielle Late-Interaction-Ausgabe. jina-colbert-v2 ist ein dediziertes Modell für Late-Interaction. Für die meisten Retrieval-Pipelines ist ein dichtes v5-Modell mit anschließendem Reranker das bessere Verhältnis von Genauigkeit zu Kosten.
Was ist Late Chunking und wann sollte ich es anwenden?
keyboard_arrow_down
Late Chunking bettet zunächst das gesamte Dokument in ein Langzeitkontextmodell ein und leitet anschließend Chunk-Einbettungen aus den Token-Repräsentationen ab. Im Gegensatz zu Naive Chunking, das jeden Chunk isoliert einbettet, erhält Late Chunking den Kontext zwischen den Chunks. Dies verbessert die Retrieval-Qualität in RAG-Pipelines, in denen ein Chunk auf etwas verweist, das zuvor im Dokument definiert wurde. Aktivieren Sie Late Chunking mit dem Parameter late_chunking.
Warum erzwingt die API eine andere Kontextlänge als die vom Modell unterstützte?
keyboard_arrow_down
Einige Modelle sind architektonisch so ausgelegt, dass sie längere Kontexte verarbeiten können, als die gehostete API akzeptiert. Sehr lange Sequenzen beanspruchen viel GPU-Speicher. Wir optimieren die Serverkonfiguration, um Durchsatz, Latenz und Kosten für die meisten Anwendungsfälle optimal auszubalancieren. Benötigen Sie die volle architektonische Kontextlänge, führen Sie das Modell selbst aus: Kontaktieren Sie Elastic Sales bezüglich einer selbstverwalteten Bereitstellung.
Warum ist jina-embeddings-v4 kostenlos und warum ist es langsam?
keyboard_arrow_down
jina-embeddings-v4 basiert auf dem Qwen2-VL-Basismodell, das unter der Qwen Research License veröffentlicht wurde. Diese Lizenz erlaubt ausschließlich Forschungszwecke und nichtkommerzielle Nutzung. Daher können wir es nicht kommerziell lizenzieren und stellen es stattdessen kostenlos über die API zur Verfügung. Da es sich um ein 3,8-B-Parameter-Modell handelt, ist es pro Anfrage naturgemäß langsamer. Um die Infrastrukturkosten zu kontrollieren, drosseln wir den Durchsatz. Es ist nicht für Produktionsumgebungen geeignet und wird aus demselben Grund weder über den Elastic Inference Service noch als Teil von Jina On-Prem angeboten. Für den Produktiveinsatz empfehlen wir die jina-embeddings-v5-Familie: Sie ist schneller, erzielt bessere Ergebnisse bei Retrieval-Benchmarks und kann über Elastic Sales für die kommerzielle Nutzung lizenziert werden.
Welche Ratenbegrenzungen gelten für die Embeddings API?
keyboard_arrow_down
Die Ratenbegrenzungen hängen von Ihrem API-Schlüsseltyp ab:

Kostenlos: 100 RPM, 100.000 TPM
Kostenpflichtig: 500 RPM, 2 Mio. TPM
Premium: 5.000 RPM, 50 Mio. TPM

Zusätzlich gilt eine IP-basierte Begrenzung von 10.000 Anfragen pro 60 Sekunden, um Missbrauch zu verhindern. Die Begrenzungen gelten pro Schlüssel und werden über ein 60-Sekunden-Fenster gezählt, sodass Lastspitzen geglättet und nicht in eine Warteschlange gestellt werden. Eine Anfrage, die die Begrenzung überschreitet, gibt den HTTP-Statuscode 429 zurück und sollte mit exponentiellem Backoff wiederholt werden. Benötigen Sie höhere Limits als im Premium-Tarif oder dedizierte Kapazität ohne Begrenzung für gemeinsam genutzte Mandanten, wenden Sie sich bitte an Elastic Sales.
Welches Einbettungsmodell sollte ich wählen?
keyboard_arrow_down
Beginnen Sie mit jina-embeddings-v5-text-small für die Textsuche: Es ist das leistungsstärkste Modell unter 1 Milliarde Einträgen in unserem Angebot und verarbeitet 32.000 Kontextdaten. Wechseln Sie zu jina-embeddings-v5-text-nano, wenn Latenz, Kosten oder Edge-Hardware wichtiger sind als die absolute Genauigkeit. Verwenden Sie jina-embeddings-v5-omni-small oder v5-omni-nano für Bilder, Audio, Video oder PDFs; deren Textausgabe ist identisch mit dem entsprechenden Textmodell, sodass Sie Modalitäten zu einem bestehenden Index hinzufügen können, ohne sie erneut einzubetten. Verwenden Sie jina-code-embeddings-0.5b oder 1.5b für den Quellcode. Innerhalb einer Familie gilt: Je neuer, desto besser.
Welche Dateigrößenbeschränkungen gelten für Bilder und PDFs?
keyboard_arrow_down
Die maximale Dateigröße beträgt 5 MB für Bilder und 8 MB für PDFs. Größere Dateien werden mit einer Fehlermeldung abgelehnt.
Häufige Fragen zum Reranker
Wie viel kostet die Reranker-API?
keyboard_arrow_down
Die Preisgestaltung der Reranker-API folgt dem gleichen tokenbasierten Modell wie die Embeddings-API. Token werden für alle Jina-APIs mit demselben Schlüssel verwendet. Neue API-Schlüssel enthalten kostenlose Token für den Einstieg; darüber hinaus sind Token-Pakete käuflich erhältlich. Details finden Sie im Abschnitt „Preisgestaltung“.
Worin bestehen die Unterschiede zwischen den Jina-Rerankern?
keyboard_arrow_down
jina-reranker-v3.5 ist unser aktuelles Flaggschiff: ein mehrsprachiger Listwise-Reranker mit 0,6 Milliarden Parametern und einem Kontextfenster von 131.000 Token. Er ist ein direkter Ersatz für jina-reranker-v3. Er verbessert v3 in allen gemessenen Bereichen, insbesondere bei strukturierten Daten und juristischem Retrieval, und ist 1,22- bis 1,56-mal schneller. jina-reranker-v3 ist weiterhin verfügbar. jina-reranker-m0 ist der multimodale Reranker für das Ranking visueller Dokumente. jina-reranker-v2-base-multilingual ist ein kleinerer Cross-Encoder, der über 100 Sprachen unterstützt und sich eignet, wenn ein nicht von Qwen abgeleitetes Modell benötigt wird. jina-colbert-v2 verwendet Late-Interaction in 89 Sprachen.
Wie werden die Jina-Reranker lizenziert?
keyboard_arrow_down
Die Modelle jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual und jina-colbert-v2 sind unter der CC-BY-NC 4.0-Lizenz veröffentlicht. Sie dürfen diese für nichtkommerzielle Zwecke frei verwenden, weitergeben und anpassen. Für die kommerzielle Nutzung ist eine kommerzielle Lizenz erforderlich, die Elastic seit dem 10. August 2026 unter dem Namen Jina On-Prem als eigene SKU anbietet. Kontaktieren Sie den Elastic-Vertrieb für ein Angebot. Ältere Modelle jina-reranker-v1-* bleiben unter der Apache-2.0-Lizenz lizenziert.
Unterstützen die Reranker mehrere Sprachen?
keyboard_arrow_down
Ja, alle aktuellen Reranker sind mehrsprachig. jina-reranker-v3.5 verbessert Version 3 hinsichtlich MIRACL und allgemein der mehrsprachigen Suche. jina-reranker-v3 und jina-reranker-v2-base-multilingual unterstützen über 100 Sprachen, jina-reranker-m0 ermöglicht das visuelle Ranking mehrsprachiger Dokumente und jina-colbert-v2 unterstützt 89 Sprachen.
Was ist die maximale Kontextlänge für jeden Reranker?
keyboard_arrow_down
Die Kontextlänge variiert je nach Modell:

jina-reranker-v3.5: 131.072 Tokens (Anfrage plus alle Dokumente kombiniert) mit automatischer Kürzung
jina-reranker-v3: 131.072 Tokens mit automatischer Kürzung
jina-reranker-m0: 10.000 Tokens
jina-reranker-v2-base-multilingual: 1.024 Tokens, mit automatischer Segmentierung für längere Dokumente
jina-colbert-v2: 8.192 Tokens

Bei den Rerankern v1 und v2 werden Anfragen automatisch gekürzt und lange Dokumente mittels Max-Pooling über die Segmente hinweg segmentiert.
Gibt es eine Begrenzung für die Anzahl der Dokumente, die ich pro Suchanfrage neu sortieren kann?
keyboard_arrow_down
Es gibt keine feste Begrenzung für die Anzahl der Dokumente pro Anfrage. Wie unsere Embeddings-API verarbeitet auch die Reranker-API Eingaben intern anhand der Tokenanzahl, um die GPU optimal auszulasten. Sie können beliebig viele Dokumente in einer einzigen Anfrage senden.
Mit welcher Latenz kann ich rechnen, wenn ich 100 Dokumente neu einordne?
keyboard_arrow_down
Die Latenz variiert zwischen 100 Millisekunden und 7 Sekunden und hängt weitgehend von der Länge der Dokumente und der Abfrage ab. Beispielsweise dauert das Reranking von 100 Dokumenten mit jeweils 256 Token bei einer 64-Token-Abfrage etwa 150 Millisekunden. Durch Erhöhen der Dokumentlänge auf 4096 Token erhöht sich die Zeit auf 3,5 Sekunden. Wenn die Abfragelänge auf 512 Token erhöht wird, erhöht sich die Zeit weiter auf 7 Sekunden.
Unten ist der Zeitaufwand für das Reranking einer Abfrage und 100 Dokumenten in Millisekunden aufgeführt:
Anzahl der Token in jedem Dokument
Anzahl der Token in der Abfrage256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
Können die Reranker privat, auf meiner eigenen Infrastruktur oder in meinem eigenen Cloud-Konto gehostet werden?
keyboard_arrow_down
Ja. Die Reranker sind auf den Marktplätzen von AWS, Azure und GCP für die Bereitstellung in Ihrem eigenen Cloud-Konto verfügbar. Für selbstverwaltete, lokale oder vom Netzwerk getrennte Infrastrukturen bietet Elastic eine kommerzielle Lizenz (Jina On-Prem) an, die die Modelle als vollständig offline nutzbare Docker-Container bereitstellt. Kontaktieren Sie Elastic Sales für ein Angebot.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Bieten Sie einen Reranker an, der auf domänenspezifischen Daten feinabgestimmt ist?
keyboard_arrow_down
Bevor Sie ein Feintuning in Auftrag geben, testen Sie jina-reranker-v3.5: Dieser wurde mit Selbstdestillation speziell für robuste Domänenanalysen trainiert und erzielt im Vergleich zu Version 3 deutliche Verbesserungen bei der Suche nach juristischen und strukturierten Daten. Ein gut gewählter Standard-Reranker in Kombination mit optimiertem Chunking schließt die Lücke in der Regel besser als ein Feintuning, und der Test ist kostenlos. Sollte dies bei Ihren Daten immer noch nicht ausreichen, ist ein domänenspezifischer Reranker eine individuelle Lösung: Kontaktieren Sie Elastic Sales, um die Details zu besprechen.
Kontakt
Was ist die Mindestbildgröße für die Dokumente?
keyboard_arrow_down
Die minimal akzeptable Bildgröße für das Modell jina-reranker-m0 beträgt 28 x 28 Pixel.
Was ist listenweises Reranking und wie unterscheidet es sich vom punktweisen Reranking?
keyboard_arrow_down
jina-reranker-v3 und jina-reranker-v3.5 verwenden eine listenweise Architektur: Die Anfrage und alle Kandidaten teilen sich ein Kontextfenster und werden in einem einzigen Vorwärtsdurchlauf bewertet, sodass das Modell Dokumente miteinander vergleichen kann. Traditionelle punktweise Reranker, wie beispielsweise jina-reranker-v2-base-multilingual, bewerten jedes Dokument unabhängig anhand der Anfrage. Die listenweise Bewertung ist genauer, da Relevanz oft relativ zu den anderen Dokumenten im Kandidatensatz ist.
Warum erzwingt die API eine andere Kontextlänge als die vom Modell unterstützte?
keyboard_arrow_down
Einige Reranker sind architektonisch in der Lage, längere Kontexte zu verarbeiten, als die gehostete API akzeptiert. Sehr lange Sequenzen beanspruchen erheblichen GPU-Speicher. Wir optimieren die Serverkonfiguration, um Durchsatz, Latenz und Kosten für die meisten Anwendungsfälle auszubalancieren. Benötigen Sie die volle architektonische Kontextlänge, führen Sie das Modell in Ihrer eigenen Infrastruktur aus und kontaktieren Sie Elastic Sales bezüglich einer kommerziellen Lizenz.
Welche Ratenbegrenzungen gelten für die Reranker-API?
keyboard_arrow_down
Die Ratenbegrenzungen hängen von Ihrem API-Schlüsseltyp ab:

Kostenlos: 100 RPM, 100.000 TPM
Kostenpflichtig: 500 RPM, 2 Mio. TPM
Premium: 5.000 RPM, 50 Mio. TPM

Es gibt außerdem eine IP-basierte Begrenzung von 10.000 Anfragen pro 60 Sekunden. Dieselben Begrenzungen gelten für die Embeddings- und Reranker-APIs. Tokens werden für alle Jina-APIs mit demselben Schlüssel verwendet.
Welchen Reranker soll ich wählen?
keyboard_arrow_down
Verwenden Sie jina-reranker-v3.5 für Text. Es ist ein direkter Ersatz für jina-reranker-v3: Das Anfrageschema bleibt unverändert, daher besteht die gesamte Migration im Austausch der Modellzeichenfolge. Verwenden Sie jina-reranker-m0, wenn Ihre Kandidaten Bilder oder visuell reiche Dokumente sind. Verwenden Sie jina-reranker-v2-base-multilingual, wenn Sie ein kleineres Modell oder eines benötigen, das nicht von Qwen abgeleitet ist.
Häufige Fragen zu APIs
code
Kann ich denselben API-Schlüssel für alle Jina-APIs verwenden?
keyboard_arrow_down
Ja. Ein API-Schlüssel ist für alle Produkte der Jina AI Search Foundation gültig, einschließlich der APIs Reader, Embeddings, Reranker, Classifier und Segmenter, wobei die Token für alle gemeinsam genutzt werden.
code
Kann ich die Token-Nutzung meines API-Schlüssels überwachen?
keyboard_arrow_down
Ja, die Token-Nutzung kann auf der Registerkarte „API-Schlüssel und Abrechnung“ überwacht werden, indem Sie Ihren API-Schlüssel eingeben. So können Sie den aktuellen Nutzungsverlauf und die verbleibenden Token anzeigen. Wenn Sie sich beim API-Dashboard angemeldet haben, können diese Details auch auf der Registerkarte „API-Schlüssel verwalten“ angezeigt werden.
code
Was soll ich tun, wenn ich meinen API-Schlüssel vergesse?
keyboard_arrow_down
Wenn Sie einen aufgeladenen Schlüssel verlegt haben und ihn abrufen möchten, wenden Sie sich bitte mit Ihrer registrierten E-Mail-Adresse an support AT jina.ai. Es wird empfohlen, sich anzumelden, damit Ihr API-Schlüssel sicher gespeichert und leicht zugänglich bleibt.
Kontakt
code
Laufen API-Schlüssel ab?
keyboard_arrow_down
Nein, unsere API-Schlüssel haben kein Ablaufdatum. Sollte ein Schlüssel kompromittiert werden, können Sie ihn selbst im API-Schlüsselverwaltungs-Dashboard widerrufen. Der Widerruf wird sofort wirksam. Um Ausfallzeiten zu vermeiden, stellen Sie zunächst einen Ersatzschlüssel aus. Ihr verbleibendes Token-Guthaben bleibt auf Ihrem Konto, nicht auf dem widerrufenen Schlüssel. Falls Sie keinen Zugriff auf das Dashboard haben oder vermuten, dass Ihr Konto selbst kompromittiert wurde, wenden Sie sich bitte an den Elastic-Support.
Kontakt
code
Kann ich Token zwischen API-Schlüsseln übertragen?
keyboard_arrow_down
Ja, Sie können Token von einem Premium-Schlüssel auf einen anderen übertragen. Nachdem Sie sich auf dem API-Schlüsselverwaltungs-Dashboard bei Ihrem Konto angemeldet haben, verwenden Sie die Einstellungen des Schlüssels, den Sie übertragen möchten, um alle verbleibenden bezahlten Token zu übertragen.
code
Kann ich meinen API-Schlüssel widerrufen?
keyboard_arrow_down
Ja, Sie können Ihren API-Schlüssel widerrufen, wenn Sie glauben, dass er kompromittiert wurde. Durch das Widerrufen eines Schlüssels wird dieser sofort für alle Benutzer deaktiviert, die ihn gespeichert haben, und alle verbleibenden Guthaben und zugehörigen Eigenschaften werden dauerhaft unbrauchbar. Wenn es sich bei dem Schlüssel um einen Premium-Schlüssel handelt, haben Sie die Möglichkeit, das verbleibende bezahlte Guthaben vor dem Widerruf auf einen anderen Schlüssel zu übertragen. Beachten Sie, dass diese Aktion nicht rückgängig gemacht werden kann. Um einen Schlüssel zu widerrufen, gehen Sie zu den Schlüsseleinstellungen im Dashboard zur API-Schlüsselverwaltung.
code
Warum ist die erste Anfrage für einige Modelle langsam?
keyboard_arrow_down
Dies liegt daran, dass unsere serverlose Architektur bestimmte Modelle in Zeiten geringer Nutzung auslagert. Die erste Anfrage aktiviert oder „wärmt“ das Modell auf, was einige Sekunden dauern kann. Nach dieser ersten Aktivierung werden nachfolgende Anfragen viel schneller verarbeitet.
code
Werden meine API-Daten zum Trainieren Ihrer Modelle verwendet?
keyboard_arrow_down
Nein. Wir verwenden Ihre API-Anfragen, Eingaben oder Ausgaben niemals, um unsere Embedding-, Reranker- oder andere Modelle zu trainieren. Ihre Daten bleiben Ihre Daten.
code
Welche Ratenbegrenzungen gelten für Jina-APIs?
keyboard_arrow_down
Es gelten Ratenbegrenzungen pro API-Schlüssel:

Kostenlos: 100 Anfragen pro Minute (RPM), 100.000 Token pro Minute (TPM)
Kostenpflichtig: 500 Anfragen pro Minute (RPM), 2 Mio. Token pro Minute (TPM)
Premium: 5.000 Anfragen pro Minute (RPM), 50 Mio. Token pro Minute (TPM)

Zusätzlich gilt eine IP-basierte Begrenzung von 10.000 Anfragen pro 60 Sekunden. Die Grenzwerte variieren je nach Endpunkt; die Werte pro Endpunkt finden Sie in der obigen Tabelle.
code
Gibt es Beschränkungen hinsichtlich der Batchgröße für die APIs?
keyboard_arrow_down
Es gibt keine Beschränkung der Batchgröße für die Embeddings- und Reranker-APIs. Sie können beliebig viele Elemente oder Dokumente pro Anfrage senden. Beide APIs verarbeiten die Eingaben intern anhand der Tokenanzahl, um die GPU optimal auszulasten.
code
Sind die Jina-APIs dasselbe wie die Jina-Modelle innerhalb von Elastic?
keyboard_arrow_down
Nein, es handelt sich um drei separate Wege. Die Jina-APIs auf dieser Website sind Self-Service-APIs mit nutzungsbasierter Abrechnung (Pay-as-you-go) und einem Jina-API-Schlüssel. Der Elastic Inference Service (EIS) führt Jina-Modelle in der Elastic Cloud aus und wird über Ihr Elastic-Abonnement abgerechnet. Sie müssen keine Infrastruktur verwalten. Jina On-Prem ist eine kommerzielle Lizenz, die Elastic seit dem 10. August 2026 als eigene SKU anbietet. Sie ermöglicht die Ausführung der Modelle in Ihrer eigenen, selbstverwalteten, lokalen oder vom Netzwerk getrennten Infrastruktur. Für Informationen zu EIS und On-Prem wenden Sie sich bitte an den Elastic-Vertrieb.
Häufige Fragen zur Abrechnung
attach_money
Erfolgt die Abrechnung nach der Anzahl der Sätze bzw. Anfragen?
keyboard_arrow_down
Unser Preismodell basiert auf der Gesamtzahl der verarbeiteten Token und bietet Benutzern die Flexibilität, diese Token auf eine beliebige Anzahl von Sätzen zu verteilen. Dies bietet eine kostengünstige Lösung für unterschiedliche Textanalyseanforderungen.
attach_money
Gibt es eine kostenlose Testversion für neue Benutzer?
keyboard_arrow_down
Ja. Neue Nutzer erhalten automatisch einen API-Schlüssel mit kostenlosen Tokens, die für alle unsere Modelle verwendet werden können. Sobald die kostenlosen Tokens aufgebraucht sind, können Sie im Tab „Tokens kaufen“ weitere Tokens für den Schlüssel erwerben.
attach_money
Werden für fehlgeschlagene Anfragen Token berechnet?
keyboard_arrow_down
Nein, für fehlgeschlagene Anfragen werden keine Token abgezogen.
attach_money
Welche Zahlungsmethoden werden akzeptiert?
keyboard_arrow_down
Zahlungen werden über Stripe abgewickelt und unterstützen zu Ihrer Bequemlichkeit eine Vielzahl von Zahlungsmethoden, darunter Kreditkarten, Google Pay und PayPal.
attach_money
Ist eine Rechnungsstellung für Token-Käufe verfügbar?
keyboard_arrow_down
Bei Token-Käufen im Self-Service stellt Stripe zum Zeitpunkt des Kaufs eine Rechnung an die mit Ihrem Stripe-Konto verknüpfte E-Mail-Adresse aus. Benötigen Sie eine formelle Bestellung, einen ausgehandelten Vertrag, Beschaffungsunterlagen oder eine Sammelrechnung, die über Elastic und nicht über Stripe abgewickelt wird, wenden Sie sich bitte an Elastic Sales.
attach_money
Wie kann ich eine kommerzielle Lizenz anstelle von API-Tokens erwerben?
keyboard_arrow_down
Mit dem Kauf von Tokens auf dieser Website decken Sie die Nutzung der gehosteten Jina-APIs ab. Sie erhalten damit keine Lizenz zur Ausführung der Modellgewichte in Ihrer eigenen Infrastruktur. Hierfür bietet Elastic seit dem 10. August 2026 eine kommerzielle Lizenz als eigene SKU an, die jährlich und nicht pro Token abgerechnet wird. Kontaktieren Sie Elastic Sales für ein Angebot.
attach_money
Kann ich per Rechnung oder Bestellschein statt per Karte bezahlen?
keyboard_arrow_down
Der Kauf von Guthaben per Self-Service-Token wird über Stripe abgewickelt und automatisch an Ihre Stripe-Konto-E-Mail-Adresse in Rechnung gestellt. Für Bestellungen, Beschaffungsprozesse oder Mengen, die das Self-Service-Aufladevolumen übersteigen, wenden Sie sich bitte an Elastic Sales.
attach_money
Ich habe bezahlt, aber mein Kontostand oder mein Ratenlimit hat sich nicht geändert. Was sollte ich überprüfen?
keyboard_arrow_down
Guthaben und Ratenbegrenzungen sind an einen API-Schlüssel gebunden, nicht an das Konto. Überprüfen Sie daher zuerst den Schlüssel selbst und nicht die Kontoseite: Geben Sie ihn im Tab „API-Schlüssel & Abrechnung“ ein und bestätigen Sie dort Guthaben und Tarif. Falls das Konto mehrere Schlüssel enthält, befinden sich die Token auf dem Schlüssel, der aufgeladen wurde. Dies ist möglicherweise nicht der Schlüssel, den Ihre Anwendung sendet. Es kann außerdem einige Zeit dauern, bis ein neuer Tarif nach der Zahlung wirksam wird. Wenn der Schlüssel zwar Guthaben anzeigt, aber weiterhin auf den vorherigen Tarif beschränkt ist, wenden Sie sich bitte an den Support.
attach_money
Wie kann ich eine Zahlung stornieren, die automatische Aufladung stoppen oder eine gespeicherte Zahlungsmethode entfernen?
keyboard_arrow_down
Die Abrechnung erfolgt über das Kundenportal, das Sie über den Reiter „API-Schlüssel & Abrechnung“ erreichen. Dort können Sie die automatische Aufladung deaktivieren und gespeicherte Zahlungsmethoden löschen. Durch die Deaktivierung der automatischen Aufladung werden keine weiteren Gebühren erhoben, bereits gekauftes Guthaben bleibt jedoch nutzbar. Wenn Sie Ihr Konto und Ihre Daten löschen oder eine Rückerstattung beantragen möchten, wenden Sie sich bitte an den Support. Die Kontolöschung wird manuell bearbeitet und dauert einige Werktage. Sie erhalten eine schriftliche Bestätigung, sobald der Vorgang abgeschlossen ist.
Aktuelle Sprache / Design
Search Foundation
Reader
Einbettungen
Reranker
Jina API-Schlüssel abrufen
Ratenbegrenzung
Über uns
Neuigkeiten
Jina-Logo herunterladen
open_in_new
Elastic-Logo herunterladen
open_in_new
API-Status
Elastic © 2026.SicherheitAGBPrivatsphäreCookie-EinstellungenMeine persönlichen Daten nicht verkaufen oder weitergeben
Diese Website und alle zugehörigen Inhalte, Software, Produkte und Dienstleistungen sind ausschließlich für den professionellen Gebrauch bestimmt. Eine Nutzung durch Endverbraucher ist weder vorgesehen noch empfohlen.