Elastic
Jina AI
Modelle
API
keyboard_arrow_down
Leser
Lesen Sie URLs und suchen Sie im Internet nach fundierteren LLMs.
Einbettungen
Multimodale, mehrsprachige Einbettungen.
Reranker
Reranker zur Maximierung der Suchrelevanz.
Elastic Inference Service
Jina-Modelle nativ in Elasticsearch ausführen.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenten
data_object
Schema
menu_book
Dokumente
Einloggen
login

Reranker

Maximieren Sie die Suchrelevanz und RAG-Genauigkeit mit unserer hochmodernen Reranker-API.

Reranker-API

Probieren Sie unsere hochmoderne Reranker-API aus, um Ihre Suchrelevanz und RAG-Genauigkeit zu maximieren. Kostenlos starten!
keyAPI-Schlüssel und Abrechnung
codeVerwendung
more_horizMehr
chevron_leftchevron_right

home
speedRatenbegrenzung
bug_reportProblem melden
help_outlineFAQ
Status
chevron_leftchevron_right

Anzahl der zurückgegebenen Dokumente
top_n
top_k
Maximale Anzahl der zurückzugebenden Top-Dokumente.

upload
Anfrage
POST
curl "https://api.jina.ai/v1/rerank" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{ "model": null, "query": "Organic skincare products for sensitive skin", "top_n": 3, "documents": [ text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.", text_fieldsclose"New makeup trends focus on bold colors and innovative techniques: Step into the world of cutting-edg…atement with every look.", text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.", text_fieldsclose"Neue Make-up-Trends setzen auf kräftige Farben und innovative Techniken: Tauchen Sie ein in die Welt…jedes Mal ein Statement.", text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.", text_fieldsclose"Las nuevas tendencias de maquillaje se centran en colores vivos y técnicas innovadoras: Entra en el … y destaca en cada look.", text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。", text_fieldsclose"新的化妆趋势注重鲜艳的颜色和创新的技巧:进入化妆艺术的新纪元,本季的化妆趋势以大胆的颜色和创新的技巧为主。无论是霓虹眼线还是全息高光,每一款妆容都能让您脱颖而出,展现独特魅力。", text_fieldsclose"敏感肌のために特別に設計された天然有機スキンケア製品: アロエベラとカモミールのやさしい力で、自然の抱擁を感じてください。敏感肌用に特別に設計された私たちのスキンケア製品は、肌に優しく栄養を与え、保護します。肌トラブルにさようなら、輝く健康な肌にこんにちは。", text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。" + Eingabe hinzufügen ], "return_documents": false }
EOFEOF


Version 3.5: Schnelleres listenweises Reranking mit hybrider Aufmerksamkeits- und Selbstdestillationsfunktion

jina-reranker-v3.5 is a 0.6B parameter multilingual listwise reranker with a 131K context window. Hybrid attention and self-distillation make it both faster and more robust across domains than v3, and it is a drop-in replacement: the request schema is unchanged.
Versionshinweis lesenarrow_forward

m0: Mehrsprachiger multimodaler Dokumenten-Reranker

Unser neuer multimodaler mehrsprachiger Reranker zum Abrufen visueller Dokumente in mehreren Sprachen, mit SOTA-Leistung bei mehrsprachigen langen Dokumenten und Codesuchaufgaben.
Versionshinweis lesenarrow_forward

Was ist ein Reranker?

Ziel eines Suchsystems ist es, schnell und effizient die relevantesten Ergebnisse zu finden. Traditionell wurden Methoden wie BM25 oder tf-idf verwendet, um Suchergebnisse basierend auf der Keyword-Übereinstimmung zu ordnen. Neuere Methoden, wie beispielsweise die einbettungsbasierte Kosinusähnlichkeit, wurden in vielen Vektordatenbanken implementiert. Diese Methoden sind unkompliziert, können jedoch manchmal die Feinheiten der Sprache und vor allem die Interaktion zwischen Dokumenten und der Absicht einer Abfrage außer Acht lassen. Hier glänzt der „Reranker“. Ein Reranker ist ein fortschrittliches KI-Modell, das die anfänglichen Ergebnisse einer Suche – oft bereitgestellt durch eine einbettungs-/tokenbasierte Suche – und sie neu bewertet, um sicherzustellen, dass sie besser mit der Absicht des Benutzers übereinstimmen. Es geht über den oberflächlichen Abgleich von Begriffen hinaus und berücksichtigt die tiefere Interaktion zwischen der Suchanfrage und dem Inhalt der Dokumente.
account_tree
So funktioniert das:

1
Erster Abruf
Ein Suchsystem verwendet Einbettungen/BM25, um basierend auf der Anfrage des Benutzers eine breite Palette potenziell relevanter Dokumente zu finden.

2
Neueinstufung
Anschließend analysiert der Reranker diese Ergebnisse auf einer detaillierteren Ebene und berücksichtigt dabei die Nuancen der Interaktion der Abfragebegriffe mit dem Dokumentinhalt.

3
Verbesserte Ergebnisse
Es ordnet die Suchergebnisse neu und platziert diejenigen, die es auf der Grundlage dieser tiefergehenden Analyse für am relevantesten hält, ganz oben.

Der Reranker kann die Suchqualität erheblich verbessern, da er auf Unterdokument- und Unterabfrageebene arbeitet, d. h. die einzelnen Wörter und Phrasen, ihre Bedeutung und ihre Beziehung zueinander innerhalb der Abfrage und der Dokumente untersucht. Dies führt zu präziseren und kontextbezogeneren Suchergebnissen.
Jina Reranker v2 ist ein am 25. Juni 2024 veröffentlichter Reranker, der für Agentic RAG entwickelt wurde. Er bietet Unterstützung für Funktionsaufrufe, mehrsprachige Suche für über 100 Sprachen, Code-Suchfunktionen und ist im Vergleich zu v1 sechsmal schneller. Erfahren Sie mehr über das v2-Modell.
Mehrsprachiger Abruf
Reranker v2 ermöglicht die Dokumentensuche in über 100 Sprachen, unabhängig von der Abfragesprache.

Funktionsaufruf und Codesuche
Reranker v2 bewertet Codeausschnitte und Funktionssignaturen auf der Grundlage von Abfragen in natürlicher Sprache und ist somit ideal für Agentic RAG-Anwendungen.

Unterstützung tabellarischer und strukturierter Daten
Reranker v2 erstellt eine Rangfolge der relevantesten Tabellen auf der Grundlage von Abfragen in natürlicher Sprache und hilft so dabei, verschiedene Tabellenschemata zu sortieren und das relevanteste zu identifizieren, bevor eine SQL-Abfrage generiert wird.

Zwei Kaufmöglichkeiten

Abonnieren Sie unsere API oder kaufen Sie über Cloud-Anbieter.
radio_button_unchecked
cloud
Mit 3 Cloud-Service-Anbietern
Verwendet Ihr Unternehmen AWS oder Azure? Dann setzen Sie unsere Suchgrundlagenmodelle direkt auf diesen Plattformen in Ihrem Unternehmen ein, damit Ihre Daten sicher und konform bleiben.
AWS SageMaker
Einbettungen
Neubewerter
Microsoft Azure
Einbettungen
Neubewerter
Google Cloud
Einbettungen
radio_button_checked
Mit Jina Search Foundation API
Der einfachste Weg, auf alle unsere Produkte zuzugreifen. Laden Sie Tokens unterwegs auf.
Laden Sie diesen API-Schlüssel mit weiteren Token auf
Abhängig von Ihrem Standort werden Ihnen möglicherweise USD, EUR oder andere Währungen in Rechnung gestellt. Es können Steuern anfallen.
Bitte geben Sie zum Aufladen den richtigen API-Schlüssel ein
Verstehen Sie die Ratenbegrenzung
Ratenbegrenzungen sind die maximale Anzahl von Anfragen, die pro Minute pro IP-Adresse/API-Schlüssel (RPM) an eine API gestellt werden können. Nachfolgend erfahren Sie mehr über die Ratenbegrenzungen für jedes Produkt und jede Stufe.
keyboard_arrow_down
Ratenbegrenzung
Ratenbegrenzungen werden auf drei Arten verfolgt: RPM (Anfragen pro Minute) und TPM (Token pro Minute). Die Begrenzungen werden pro IP/API-Schlüssel erzwungen und ausgelöst, wenn zuerst der RPM- oder TPM-Schwellenwert erreicht wird. Wenn Sie im Anforderungsheader einen API-Schlüssel angeben, verfolgen wir die Ratenbegrenzungen nach Schlüssel und nicht nach IP-Adresse.
ProduktAPI-EndpunktBeschreibungarrow_upwardohne API-Schlüsselkey_offmit kostenlosem API-Schlüsselkeymit kostenpflichtigem API-Schlüsselkeymit Premium-API-SchlüsselkeyDurchschnittliche LatenzZählung der Token-NutzungZulässige Anfrage
Leser-APIhttps://r.jina.aiURL in LLM-freundlichen Text konvertieren20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sZählen Sie die Anzahl der Token in der Ausgabeantwort.GET/POST
Leser-APIhttps://s.jina.aiDurchsuchen Sie das Web und konvertieren Sie die Ergebnisse in LLM-freundlichen Textblock100 RPM100 RPMtrending_up1000 RPM2.5sJede Anfrage kostet eine feste Anzahl an Token, beginnend bei 10000 TokenGET/POST
Einbettungs-APIhttps://api.jina.ai/v1/embeddingsKonvertieren Sie Text/Bilder in Vektoren mit fester Längeblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Zählen Sie die Anzahl der Token in der Eingabeanforderung.POST
Reranker-APIhttps://api.jina.ai/v1/rerankOrdnen Sie Dokumente nach Abfrageblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Zählen Sie die Anzahl der Token in der Eingabeanforderung.POST

Bereitstellung vor Ort

Stellen Sie Jina Reranker auf AWS Sagemaker und Microsoft Azure und bald auch in Google Cloud Services bereit, oder wenden Sie sich an unser Vertriebsteam, um angepasste Kubernetes-Bereitstellungen für Ihre Virtual Private Cloud und Ihre lokalen Server zu erhalten.
AWS SageMaker
Einbettungen
Neubewerter
Microsoft Azure
Einbettungen
Neubewerter
Google Cloud
Einbettungen

Vergleich von Reranker, Vector Search und BM25

Die folgende Tabelle bietet einen umfassenden Vergleich von Reranker, Vector/Embeddings Search und BM25 und hebt deren Stärken und Schwächen in verschiedenen Kategorien hervor.
RerankerVektorsucheBM25
Beste fürVerbesserte Suchpräzision und RelevanzErste, schnelle FilterungAllgemeine Textsuche für weitreichende Abfragen
Die GranularitätDetailliert: Unterdokument und AbfragesegmentBreit: Ganze DokumenteMittelstufe: Verschiedene Textsegmente
Komplexität der AbfragezeitHochMittelNiedrig
Zeitkomplexität indizierenNicht benötigtHochNiedrig, nutzt vorgefertigten Index
Komplexität der TrainingszeitHochHochNicht benötigt
SuchqualitätHervorragend für differenzierte AbfragenAusgewogen zwischen Effizienz und GenauigkeitKonsistent und zuverlässig für eine breite Palette von Abfragen
StärkenSehr präzise mit tiefem KontextverständnisSchnell und effizient, mit mäßiger GenauigkeitHoch skalierbar, mit nachgewiesener Wirksamkeit
Testen Sie die Reranker-API kostenlosProbieren Sie die Einbettungs-API kostenlos aus

Erfahren Sie mehr über Reranker

Was ist ein Reranker? Warum reicht die Vektorsuche oder die Kosinusähnlichkeit nicht aus? Erfahren Sie mit unserem umfassenden Leitfaden mehr über Reranker von Grund auf.
August 03, 2026 • 11 Minuten gelesen
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
Juli 20, 2026
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
Listwise rerankers are the discriminative core of agentic retrieval pipelines, yet production deployment demands efficiency, domain robustness, and fluency on semi-structured data at the same time. We present jina-reranker-v3.5, a 0.6B-parameter listwise reranker that meets these demands together without sacrificing the cross-document comparison that makes its predecessor jina-reranker-v3 effective. It replaces uniform global attention with a hybrid schedule of three sliding-window layers followed by two global layers, pinning the terminal layer to global as last-but-not-late readout requires. It trains on a curated multi-domain mixture spanning legal, medical, financial, multilingual, and structured retrieval, and transfers quality through a three-stage self-distillation recipe in which a full-attention teacher sets an upper bound that a sparse-attention student then recovers. jina-reranker-v3.5 reaches 63.20 nDCG@10 on BEIR, matching a 4B model at roughly 7x fewer parameters, and lifts semi-structured retrieval by 9.6 nDCG@10 over jina-reranker-v3 while cutting listwise inference latency by up to 1.56x.
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
Oktober 03, 2025 • 7 Minuten gelesen
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
Oktober 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
jina-reranker-v3 is a 0.6B parameter multilingual document reranker that introduces a novel last but not late interaction. Unlike late interaction models such as ColBERT that perform separate encoding followed by multi-vector matching, our approach conducts causal self-attention between query and documents within the same context window, enabling rich cross-document interactions before extracting contextual embeddings from the last token of each document. This compact architecture achieves state-of-the-art BEIR performance with 61.94 nDCG@10 while being significant smaller than generative listwise rerankers.

FAQ

Wie viel kostet die Reranker-API?
keyboard_arrow_down
Die Preisgestaltung der Reranker-API folgt dem gleichen tokenbasierten Modell wie die Embeddings-API. Token werden für alle Jina-APIs mit demselben Schlüssel verwendet. Neue API-Schlüssel enthalten kostenlose Token für den Einstieg; darüber hinaus sind Token-Pakete käuflich erhältlich. Details finden Sie im Abschnitt „Preisgestaltung“.
Worin bestehen die Unterschiede zwischen den Jina-Rerankern?
keyboard_arrow_down
jina-reranker-v3.5 ist unser aktuelles Flaggschiff: ein mehrsprachiger, listenweiser Reranker mit 0,6 Milliarden Parametern und 131.000 Kontextinformationen. Er ist ein direkter Ersatz für jina-reranker-v3. Er verbessert v3 in allen gemessenen Bereichen, insbesondere bei strukturierten Daten und der Suche nach legalen Inhalten, und ist 1,22- bis 1,56-mal schneller. jina-reranker-v3 ist weiterhin verfügbar. jina-reranker-m0 ist der multimodale Reranker für das Ranking visueller Dokumente. jina-reranker-v2-base-multilingual ist ein kleinerer Cross-Encoder, der über 100 Sprachen unterstützt und sich eignet, wenn ein nicht von Qwen abgeleitetes Modell benötigt wird. jina-colbert-v2 verwendet späte Interaktion in 89 Sprachen.
Wie werden die Jina-Reranker lizenziert?
keyboard_arrow_down
Die Modelle jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual und jina-colbert-v2 sind unter der CC-BY-NC 4.0-Lizenz veröffentlicht. Sie dürfen diese für nichtkommerzielle Zwecke frei verwenden, weitergeben und anpassen. Für die kommerzielle Nutzung ist eine kommerzielle Lizenz erforderlich, die Elastic seit dem 10. August 2026 unter dem Namen Jina On-Prem als eigene SKU anbietet. Kontaktieren Sie den Elastic-Vertrieb für ein Angebot. Ältere Modelle jina-reranker-v1-* bleiben unter der Apache-2.0-Lizenz lizenziert.
Unterstützen die Reranker mehrere Sprachen?
keyboard_arrow_down
Ja, alle aktuellen Reranker sind mehrsprachig. jina-reranker-v3.5 verbessert Version 3 hinsichtlich MIRACL und allgemein der mehrsprachigen Suche. jina-reranker-v3 und jina-reranker-v2-base-multilingual unterstützen über 100 Sprachen, jina-reranker-m0 ermöglicht das visuelle Ranking mehrsprachiger Dokumente und jina-colbert-v2 unterstützt 89 Sprachen.
Was ist die maximale Kontextlänge für jeden Reranker?
keyboard_arrow_down
Die Kontextlänge variiert je nach Modell:

jina-reranker-v3.5: 131.072 Tokens (Anfrage plus alle Dokumente kombiniert) mit automatischer Kürzung
jina-reranker-v3: 131.072 Tokens mit automatischer Kürzung
jina-reranker-m0: 10.000 Tokens
jina-reranker-v2-base-multilingual: 1.024 Tokens, mit automatischer Segmentierung für längere Dokumente
jina-colbert-v2: 8.192 Tokens

Bei den Rerankern v1 und v2 werden Anfragen automatisch gekürzt und lange Dokumente mittels Max-Pooling über die Segmente hinweg segmentiert.
Gibt es eine Begrenzung für die Anzahl der Dokumente, die ich pro Suchanfrage neu sortieren kann?
keyboard_arrow_down
Es gibt keine feste Begrenzung für die Anzahl der Dokumente pro Anfrage. Wie unsere Embeddings-API verarbeitet auch die Reranker-API Eingaben intern anhand der Tokenanzahl, um die GPU optimal auszulasten. Sie können beliebig viele Dokumente in einer einzigen Anfrage senden.
Mit welcher Latenz kann ich rechnen, wenn ich 100 Dokumente neu einordne?
keyboard_arrow_down
Die Latenz variiert zwischen 100 Millisekunden und 7 Sekunden und hängt weitgehend von der Länge der Dokumente und der Abfrage ab. Beispielsweise dauert das Neuranking von 100 Dokumenten mit jeweils 256 Token bei einer 64-Token-Abfrage etwa 150 Millisekunden. Durch Erhöhen der Dokumentlänge auf 4096 Token erhöht sich die Zeit auf 3,5 Sekunden. Wenn die Abfragelänge auf 512 Token erhöht wird, erhöht sich die Zeit weiter auf 7 Sekunden.
Unten ist der Zeitaufwand für das Reranking einer Abfrage und 100 Dokumenten in Millisekunden aufgeführt:
Anzahl der Token in jedem Dokument
Anzahl der Token in der Abfrage256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
Können die Reranker privat, auf meiner eigenen Infrastruktur oder in meinem eigenen Cloud-Konto gehostet werden?
keyboard_arrow_down
Ja. Die Reranker sind auf den Marktplätzen von AWS, Azure und GCP für die Bereitstellung in Ihrem eigenen Cloud-Konto verfügbar. Für selbstverwaltete, lokale oder vom Netzwerk getrennte Infrastrukturen bietet Elastic eine kommerzielle Lizenz (Jina On-Prem) an, die die Modelle als vollständig offline nutzbare Docker-Container bereitstellt. Kontaktieren Sie Elastic Sales für ein Angebot.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Bieten Sie einen Reranker an, der auf domänenspezifischen Daten feinabgestimmt ist?
keyboard_arrow_down
Bevor Sie ein Feintuning in Auftrag geben, testen Sie jina-reranker-v3.5: Dieser wurde mit Selbstdestillation speziell für robuste Domänenanalysen trainiert und erzielt im Vergleich zu Version 3 deutliche Verbesserungen bei der Suche nach juristischen und strukturierten Daten. Ein gut gewählter Standard-Reranker in Kombination mit optimiertem Chunking schließt die Lücke in der Regel besser als ein Feintuning, und der Test ist kostenlos. Sollte dies bei Ihren Daten immer noch nicht ausreichen, ist ein domänenspezifischer Reranker eine individuelle Lösung: Kontaktieren Sie Elastic Sales, um die Details zu besprechen.
Kontakt
Was ist die Mindestbildgröße für die Dokumente?
keyboard_arrow_down
Die minimal akzeptable Bildgröße für das Modell jina-reranker-m0 beträgt 28 x 28 Pixel.
Was ist listenweises Reranking und wie unterscheidet es sich vom punktweisen Reranking?
keyboard_arrow_down
jina-reranker-v3 und jina-reranker-v3.5 verwenden eine listenweise Architektur: Die Anfrage und alle Kandidaten teilen sich ein Kontextfenster und werden in einem einzigen Vorwärtsdurchlauf bewertet, sodass das Modell Dokumente miteinander vergleichen kann. Traditionelle punktweise Reranker, wie beispielsweise jina-reranker-v2-base-multilingual, bewerten jedes Dokument unabhängig anhand der Anfrage. Die listenweise Bewertung ist genauer, da Relevanz oft relativ zu den anderen Dokumenten im Kandidatensatz ist.
Warum erzwingt die API eine andere Kontextlänge als die vom Modell unterstützte?
keyboard_arrow_down
Einige Reranker sind architektonisch in der Lage, längere Kontexte zu verarbeiten, als die gehostete API akzeptiert. Sehr lange Sequenzen beanspruchen erheblichen GPU-Speicher. Wir optimieren die Serverkonfiguration, um Durchsatz, Latenz und Kosten für die meisten Anwendungsfälle auszubalancieren. Benötigen Sie die volle architektonische Kontextlänge, führen Sie das Modell in Ihrer eigenen Infrastruktur aus und kontaktieren Sie Elastic Sales bezüglich einer kommerziellen Lizenz.
Welche Ratenbegrenzungen gelten für die Reranker-API?
keyboard_arrow_down
Die Ratenbegrenzungen hängen von Ihrem API-Schlüsseltyp ab:

Kostenlos: 100 RPM, 100.000 TPM
Kostenpflichtig: 500 RPM, 2 Mio. TPM
Premium: 5.000 RPM, 50 Mio. TPM

Es gibt außerdem eine IP-basierte Begrenzung von 10.000 Anfragen pro 60 Sekunden. Dieselben Begrenzungen gelten für die Embeddings- und Reranker-APIs. Tokens werden für alle Jina-APIs mit demselben Schlüssel verwendet.
Welchen Reranker soll ich wählen?
keyboard_arrow_down
Verwenden Sie jina-reranker-v3.5 für Text. Es ist ein direkter Ersatz für jina-reranker-v3: Das Anfrageschema bleibt unverändert, daher besteht die gesamte Migration im Austausch der Modellzeichenfolge. Verwenden Sie jina-reranker-m0, wenn Ihre Kandidaten Bilder oder visuell ansprechende Dokumente sind. Verwenden Sie jina-reranker-v2-base-multilingual, wenn Sie ein kleineres Modell oder eines benötigen, das nicht von Qwen abgeleitet ist.

Wie erhalte ich meinen API-Schlüssel?

video_not_supported

Wie hoch ist die Ratenbegrenzung?

Ratenbegrenzung
Ratenbegrenzungen werden auf drei Arten verfolgt: RPM (Anfragen pro Minute) und TPM (Token pro Minute). Die Begrenzungen werden pro IP/API-Schlüssel erzwungen und ausgelöst, wenn zuerst der RPM- oder TPM-Schwellenwert erreicht wird. Wenn Sie im Anforderungsheader einen API-Schlüssel angeben, verfolgen wir die Ratenbegrenzungen nach Schlüssel und nicht nach IP-Adresse.
ProduktAPI-EndpunktBeschreibungarrow_upwardohne API-Schlüsselkey_offmit kostenlosem API-Schlüsselkeymit kostenpflichtigem API-Schlüsselkeymit Premium-API-SchlüsselkeyDurchschnittliche LatenzZählung der Token-NutzungZulässige Anfrage
Leser-APIhttps://r.jina.aiURL in LLM-freundlichen Text konvertieren20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sZählen Sie die Anzahl der Token in der Ausgabeantwort.GET/POST
Leser-APIhttps://s.jina.aiDurchsuchen Sie das Web und konvertieren Sie die Ergebnisse in LLM-freundlichen Textblock100 RPM100 RPMtrending_up1000 RPM2.5sJede Anfrage kostet eine feste Anzahl an Token, beginnend bei 10000 TokenGET/POST
Einbettungs-APIhttps://api.jina.ai/v1/embeddingsKonvertieren Sie Text/Bilder in Vektoren mit fester Längeblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Zählen Sie die Anzahl der Token in der Eingabeanforderung.POST
Reranker-APIhttps://api.jina.ai/v1/rerankOrdnen Sie Dokumente nach Abfrageblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
hängt von der Eingangsgröße ab
help
Zählen Sie die Anzahl der Token in der Eingabeanforderung.POST

Benötige ich eine gewerbliche Lizenz?

CC BY-NC Lizenz Selbstcheck

play_arrow
Nutzen Sie unsere gehostete API oder unsere offiziellen Images auf Azure, AWS oder GCP?
play_arrow
Ja
Es ist keine separate Lizenz erforderlich. Die kommerzielle Nutzung ist durch die Nutzungsbedingungen abgedeckt: Registrieren Sie sich und bezahlen Sie über diese Website oder den Cloud-Marktplatz.
play_arrow
NEIN
play_arrow
Verwenden Sie die Modellgewichte selbst in einem kommerziellen Produkt oder einer Dienstleistung?
play_arrow
NEIN
Es ist kein Kauf erforderlich. Herunterladen, Evaluieren, Benchmarking und die Nutzung für Forschungszwecke sind unter jeder von uns verwendeten Lizenz mit Quellenangabe gestattet.
play_arrow
Ja
play_arrow
Welche Lizenz besitzt das Model? Das ist auf der Seite des Models bei Hugging Face angegeben.
play_arrow
Apache-2.0
Apache-2.0 erlaubt die kommerzielle Nutzung. Es ist kein Kauf erforderlich. Dies umfasst unsere älteren Modelle der Generationen v1 und v2.
play_arrow
CC BY-NC 4.0
Sie benötigen eine kommerzielle Lizenz. Seit dem 10. August 2026 bietet Elastic eine solche Lizenz für Jina-Modelle als eigene SKU unter dem Namen Jina On-Prem an. Sie deckt selbstverwaltete, lokale und vom Netzwerk getrennte Bereitstellungen ab und erfordert kein Elasticsearch-Abonnement.
Wenn Sie bereits Elastic-Kunde sind, kann Ihr Account-Team dies zu Ihrem bestehenden Vertrag hinzufügen.
Kontaktieren Sie den Elastic-Vertrieb.
play_arrow
Qwen-Forschungslizenz
Eine Forschungslizenz erlaubt keine kommerzielle Nutzung, und eine kommerzielle Lizenz für unsere anderen Modelle erstreckt sich nicht darauf. Für dieses Modell gibt es keine kommerzielle Option, weder für die Eigeninstallation noch über die API. Wählen Sie stattdessen ein Modell unter einer der beiden anderen Lizenzen.
Häufige Fragen zu APIs
code
Kann ich denselben API-Schlüssel für alle Jina-APIs verwenden?
keyboard_arrow_down
Ja. Ein API-Schlüssel ist für alle Produkte der Jina AI Search Foundation gültig, einschließlich der APIs Reader, Embeddings, Reranker, Classifier und Segmenter, wobei die Token für alle gemeinsam genutzt werden.
code
Kann ich die Token-Nutzung meines API-Schlüssels überwachen?
keyboard_arrow_down
Ja, die Token-Nutzung kann auf der Registerkarte „API-Schlüssel und Abrechnung“ überwacht werden, indem Sie Ihren API-Schlüssel eingeben. So können Sie den aktuellen Nutzungsverlauf und die verbleibenden Token anzeigen. Wenn Sie sich beim API-Dashboard angemeldet haben, können diese Details auch auf der Registerkarte „API-Schlüssel verwalten“ angezeigt werden.
code
Was soll ich tun, wenn ich meinen API-Schlüssel vergesse?
keyboard_arrow_down
Wenn Sie einen aufgeladenen Schlüssel verlegt haben und ihn abrufen möchten, wenden Sie sich bitte mit Ihrer registrierten E-Mail-Adresse an support AT jina.ai. Es wird empfohlen, sich anzumelden, damit Ihr API-Schlüssel sicher gespeichert und leicht zugänglich bleibt.
Kontakt
code
Laufen API-Schlüssel ab?
keyboard_arrow_down
Nein, unsere API-Schlüssel haben kein Ablaufdatum. Sollte ein Schlüssel kompromittiert werden, können Sie ihn selbst im API-Schlüsselverwaltungs-Dashboard widerrufen. Der Widerruf wird sofort wirksam. Um Ausfallzeiten zu vermeiden, stellen Sie zunächst einen Ersatzschlüssel aus. Ihr verbleibendes Token-Guthaben bleibt auf Ihrem Konto und wird nicht auf dem widerrufenen Schlüssel gespeichert. Falls Sie keinen Zugriff auf das Dashboard haben oder vermuten, dass Ihr Konto selbst kompromittiert wurde, wenden Sie sich bitte an den Elastic-Support.
Kontakt
code
Kann ich Token zwischen API-Schlüsseln übertragen?
keyboard_arrow_down
Ja, Sie können Token von einem Premium-Schlüssel auf einen anderen übertragen. Nachdem Sie sich auf dem API-Schlüsselverwaltungs-Dashboard bei Ihrem Konto angemeldet haben, verwenden Sie die Einstellungen des Schlüssels, den Sie übertragen möchten, um alle verbleibenden bezahlten Token zu übertragen.
code
Kann ich meinen API-Schlüssel widerrufen?
keyboard_arrow_down
Ja, Sie können Ihren API-Schlüssel widerrufen, wenn Sie glauben, dass er kompromittiert wurde. Durch das Widerrufen eines Schlüssels wird dieser sofort für alle Benutzer deaktiviert, die ihn gespeichert haben, und alle verbleibenden Guthaben und zugehörigen Eigenschaften werden dauerhaft unbrauchbar. Wenn es sich bei dem Schlüssel um einen Premium-Schlüssel handelt, haben Sie die Möglichkeit, das verbleibende bezahlte Guthaben vor dem Widerruf auf einen anderen Schlüssel zu übertragen. Beachten Sie, dass diese Aktion nicht rückgängig gemacht werden kann. Um einen Schlüssel zu widerrufen, gehen Sie zu den Schlüsseleinstellungen im Dashboard zur API-Schlüsselverwaltung.
code
Warum ist die erste Anfrage für einige Modelle langsam?
keyboard_arrow_down
Dies liegt daran, dass unsere serverlose Architektur bestimmte Modelle in Zeiten geringer Nutzung auslagert. Die erste Anfrage aktiviert oder „wärmt“ das Modell auf, was einige Sekunden dauern kann. Nach dieser ersten Aktivierung werden nachfolgende Anfragen viel schneller verarbeitet.
code
Werden meine API-Daten zum Trainieren Ihrer Modelle verwendet?
keyboard_arrow_down
Nein. Wir verwenden Ihre API-Anfragen, Eingaben oder Ausgaben niemals, um unsere Embedding-, Reranker- oder andere Modelle zu trainieren. Ihre Daten bleiben Ihre Daten.
code
Welche Ratenbegrenzungen gelten für Jina-APIs?
keyboard_arrow_down
Es gelten Ratenbegrenzungen pro API-Schlüssel:

Kostenlos: 100 Anfragen pro Minute (RPM), 100.000 Transaktionen pro Monat (TPM)
Kostenpflichtig: 500 Anfragen pro Minute (RPM), 2 Millionen TPM
Premium: 5.000 Anfragen pro Minute (RPM), 50 Millionen TPM

Zusätzlich gilt eine IP-basierte Begrenzung von 10.000 Anfragen pro 60 Sekunden. Die Grenzwerte variieren je nach Endpunkt; die Werte pro Endpunkt finden Sie in der obigen Tabelle.
code
Gibt es Beschränkungen hinsichtlich der Batchgröße für die APIs?
keyboard_arrow_down
Es gibt keine Beschränkung der Batchgröße für die Embeddings- und Reranker-APIs. Sie können beliebig viele Elemente oder Dokumente pro Anfrage senden. Beide APIs verarbeiten die Eingaben intern anhand der Tokenanzahl, um die GPU optimal auszulasten.
code
Sind die Jina-APIs dasselbe wie die Jina-Modelle innerhalb von Elastic?
keyboard_arrow_down
Nein, es handelt sich um drei separate Wege. Die Jina-APIs auf dieser Website sind Self-Service-APIs mit nutzungsbasierter Abrechnung (Pay-as-you-go) und einem Jina-API-Schlüssel. Der Elastic Inference Service (EIS) führt Jina-Modelle in der Elastic Cloud aus und wird über Ihr Elastic-Abonnement abgerechnet. Sie müssen keine Infrastruktur verwalten. Jina On-Prem ist eine kommerzielle Lizenz, die Elastic seit dem 10. August 2026 als eigene SKU anbietet. Sie ermöglicht die Ausführung der Modelle in Ihrer eigenen, selbstverwalteten, lokalen oder vom Netzwerk getrennten Infrastruktur. Für Informationen zu EIS und On-Prem wenden Sie sich bitte an den Elastic-Vertrieb.
Häufige Fragen zur Abrechnung
attach_money
Erfolgt die Abrechnung nach der Anzahl der Sätze bzw. Anfragen?
keyboard_arrow_down
Unser Preismodell basiert auf der Gesamtzahl der verarbeiteten Token und bietet Benutzern die Flexibilität, diese Token auf eine beliebige Anzahl von Sätzen zu verteilen. Dies bietet eine kostengünstige Lösung für unterschiedliche Textanalyseanforderungen.
attach_money
Gibt es eine kostenlose Testversion für neue Benutzer?
keyboard_arrow_down
Ja. Neue Nutzer erhalten automatisch einen API-Schlüssel mit kostenlosen Tokens, die für alle unsere Modelle verwendet werden können. Sobald die kostenlosen Tokens aufgebraucht sind, können Sie im Tab „Tokens kaufen“ weitere Tokens für den Schlüssel erwerben.
attach_money
Werden für fehlgeschlagene Anfragen Token berechnet?
keyboard_arrow_down
Nein, für fehlgeschlagene Anfragen werden keine Token abgezogen.
attach_money
Welche Zahlungsmethoden werden akzeptiert?
keyboard_arrow_down
Zahlungen werden über Stripe abgewickelt und unterstützen zu Ihrer Bequemlichkeit eine Vielzahl von Zahlungsmethoden, darunter Kreditkarten, Google Pay und PayPal.
attach_money
Ist eine Rechnungsstellung für Token-Käufe verfügbar?
keyboard_arrow_down
Bei Token-Käufen im Self-Service stellt Stripe zum Zeitpunkt des Kaufs eine Rechnung an die mit Ihrem Stripe-Konto verknüpfte E-Mail-Adresse aus. Benötigen Sie eine formelle Bestellung, einen ausgehandelten Vertrag, Beschaffungsunterlagen oder eine Sammelrechnung, die über Elastic und nicht über Stripe abgewickelt wird, wenden Sie sich bitte an Elastic Sales.
attach_money
Wie kann ich eine kommerzielle Lizenz anstelle von API-Tokens erwerben?
keyboard_arrow_down
Mit dem Kauf von Tokens auf dieser Website decken Sie die Nutzung der gehosteten Jina-APIs ab. Sie erhalten damit keine Lizenz zur Ausführung der Modellgewichte in Ihrer eigenen Infrastruktur. Hierfür bietet Elastic seit dem 10. August 2026 eine kommerzielle Lizenz als eigene SKU an, die jährlich und nicht pro Token abgerechnet wird. Kontaktieren Sie Elastic Sales für ein Angebot.
attach_money
Kann ich per Rechnung oder Bestellschein statt per Karte bezahlen?
keyboard_arrow_down
Der Kauf von Guthaben per Self-Service-Token wird über Stripe abgewickelt und automatisch an Ihre Stripe-Konto-E-Mail-Adresse in Rechnung gestellt. Für Bestellungen, Beschaffungsprozesse oder Mengen, die das Self-Service-Aufladevolumen übersteigen, wenden Sie sich bitte an Elastic Sales.
attach_money
Ich habe bezahlt, aber mein Kontostand oder mein Zinslimit hat sich nicht geändert. Was sollte ich überprüfen?
keyboard_arrow_down
Guthaben und Ratenbegrenzungen sind an einen API-Schlüssel gebunden, nicht an das Konto. Überprüfen Sie daher zuerst den Schlüssel selbst und nicht die Kontoseite: Geben Sie ihn im Tab „API-Schlüssel & Abrechnung“ ein und bestätigen Sie dort Guthaben und Tarif. Falls das Konto mehrere Schlüssel enthält, befinden sich die Token auf dem Schlüssel, der aufgeladen wurde. Dies ist möglicherweise nicht der Schlüssel, den Ihre Anwendung sendet. Es kann außerdem einige Zeit dauern, bis ein neuer Tarif nach der Zahlung wirksam wird. Wenn der Schlüssel zwar Guthaben anzeigt, aber weiterhin auf den vorherigen Tarif beschränkt ist, wenden Sie sich bitte an den Support.
attach_money
Wie kann ich ein Abonnement kündigen, die automatische Aufladung stoppen oder eine gespeicherte Zahlungsmethode entfernen?
keyboard_arrow_down
Die Abrechnung erfolgt über das Kundenportal, das Sie über den Reiter „API-Schlüssel & Abrechnung“ erreichen. Dort können Sie die automatische Aufladung deaktivieren und gespeicherte Zahlungsmethoden löschen. Durch die Deaktivierung der automatischen Aufladung werden keine weiteren Gebühren erhoben, bereits gekauftes Guthaben bleibt jedoch nutzbar. Wenn Sie Ihr Konto und Ihre Daten löschen oder eine Rückerstattung beantragen möchten, wenden Sie sich bitte an den Support. Die Kontolöschung wird manuell bearbeitet und dauert einige Werktage. Sie erhalten eine schriftliche Bestätigung, sobald der Vorgang abgeschlossen ist.
Aktuelle Sprache / Design
Search Foundation
Leser
Einbettungen
Reranker
Jina API-Schlüssel abrufen
Ratenbegrenzung
Über uns
Pressemitteilungen
Jina-Logo herunterladen
open_in_new
Elastic-Logo herunterladen
open_in_new
API-Status
Elastic © 2026.SicherheitTerms & amp; BedingungenPrivatsphäreCookie-EinstellungenMeine persönlichen Daten werden nicht verkauft oder weitergegeben.
Diese Website und alle zugehörigen Inhalte, Software, Produkte und Dienstleistungen sind ausschließlich für den professionellen Gebrauch bestimmt. Eine Nutzung durch Endverbraucher ist weder vorgesehen noch empfohlen.