Elastic
Jina AI
モデル
API
keyboard_arrow_down
Reader
任意の URL を Markdown に変換し、LLM のグラウンディングを向上させます。
Embeddings
マルチモーダルかつ多言語の埋め込み。
Reranker
検索エンジンのランキングを再調整して、検索関連性を最大化する。
Elastic Inference Service
Elasticsearch内でJinaモデルをネイティブに実行する。
MCP
terminal
コマンドライン
article
llms.txt
smart_toy
エージェント
data_object
スキーマ
menu_book
ドキュメント
ログイン
login
Embeddings
copyright CC BY-NC 4.0
open_in_new リリースノート

jina-embeddings-v5-text-small

タスク固有のアダプタを備えた最先端の多言語ベクトル
ライセンス
copyright CC-BY-NC-4.0
発売日
calendar_month
2026-02-18
入力
abc
文章
arrow_forward
出力
more_horiz
ベクター
Matryoshka 次元 help_outline
32
64
128
256
512
1024
モデル詳細
パラメータ: 677M
入力トークン長: 32K
出力寸法: 1024
ベースモデル help_outline
open_in_new
Qwen3-0.6B-Base
訓練された言語 help_outline
32 言語
サポートされている言語 help_outline
93 言語
量子化 help_outline
GGUF
Apple Silicon サポート help_outline
MLX
関連機種
link
jina-embeddings-v3
link
jina-embeddings-v5-text-nano
サポートされているタスク
search 検索
compare_arrows テキストマッチング
bubble_chart クラスタリング
label 分類
以下の方法で入手できます
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
エアギャップ
I/O 図

文章

jina-embeddings-v5-text-small

タスク

ベクター

Pareto fronthelp_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nanojina-embeddings-v5-text…Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
LongEmbed
66.39
Parameters
596M
Rank by score
8 / 69
Pareto front
Behind it
値の分布help_outline
AUC 0.8269
コーパス
翻訳ペア
ドキュメント検索
コード
画像 / バナー
画像 / ロゴ
タスク
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8080.400.500.600.700.800.90
関連10.9%
ハードネガティブ2.1%
無関連0.9%
推奨しきい値
FPR 0.1 · 0.717
FPR 0.01 · 0.808
FPR 0.001 · 0.860
FPR 0.0001 · 0.878
バランス · 0.697
AUC
0.8269
ノイズ上限
0.855
再現率の崖
0.566
測定ペア数
119 / 11k
ベクトル成分help_outline
-0.160.010.18
σ 0.0313 · 244k 個の値
埋め込みの幾何help_outline
01024
次元ごとの平均。カーソルを合わせると範囲を表示
ノイズ下限
0.300
実効次元数
70 / 1024
次元の切り詰めhelp_outline
32641282565121024
text-matching · 要求した次元数ごとのしきい値
言語ペアhelp_outline
de-ruen-deen-koen-zhja-ko
ペア間のしきい値のばらつき: 0.024
比較するモデルを選択してください
論文 (1)
SIGIR 2026
2月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

概要

jina-embeddings-v5-text-small は、Qwen3-0.6B-Base バックボーンネットワークに基づく、0.6B パラメータの多言語テキスト埋め込みモデルです。エンドワードプーリングにより 1024 次元の埋め込みを生成し、回転位置埋め込み (RoPE) と調整された基本周波数により最大 32K 語のコンテキスト長をサポートします。モデルには、検索、意味的類似性、クラスタリング、分類のための 4 つのタスク固有の LoRA アダプターが含まれており、固定されたバックボーンネットワークの重みに基づいて個別に学習されます。Matryoshka 表現学習は、32 次元までの埋め込みの切り捨てをサポートします。モデルは 2 段階の学習プロセスを採用しています。まず、Qwen3-Embedding-4B からの埋め込み蒸留を実行し、大規模な教師モデルから知識を転送します。次に、各タスクカテゴリ専用の損失関数を用いて、タスク固有のアダプターを学習します。「Query:」および「Document:」というプレフィックスを使用した非対称検索をサポートします。

方法

トレーニングは 2 つのフェーズに分かれています。最初のフェーズでは、埋め込み蒸留で、投影された生徒の埋め込みと教師の埋め込み間のコサイン距離損失を利用して、Qwen3-Embedding-4B (4B パラメータの教師モデル) から Qwen3-0.6B-Base 生徒モデルに知識を転送します。線形投影レイヤーは、生徒の 1024 次元空間を教師の高次元空間にマッピングします。汎用の蒸留では、30 を超える言語にわたる 300 を超えるデータセットを使用して 50,000 ステップのトレーニングを行い、その後、RoPE パラメータを調整して、合成および自然な長いドキュメント (1,000〜4,096 トークン) でロング コンテキスト トレーニングを実行します。第 2 段階では、4 つの LoRA アダプターが固定されたバックボーンの重みでトレーニングされます。検索アダプターは、ハードネガティブを用いた InfoNCE 対照損失、継続的な蒸留損失、および量子化の堅牢性のためのグローバル直交正則化 (GOR) を組み合わせます。テキストマッチングアダプタは、CoSENTランキング損失関数を用いて階層的類似度を計算し、スコアのないテキストペアに対して知識蒸留を実行します。クラスタリングアダプタは再蒸留を使用し、クラスタリング固有の教師指示を組み込みます。分類アダプタは双方向InfoNCE損失関数を使用し、関係知識蒸留の正則化を組み込みます。最後に、検索アダプタの重みは複数のチェックポイントにわたって平均化されます。

パフォーマンス

MMTEB(多言語)において、jina-embeddings-v5-text-smallは、タスクレベル平均スコア67.0、タイプレベル平均スコア58.9を達成し、10億パラメータ未満のすべてのモデルの中で最高となりました。分類は71.3、クラスタリングは53.4、ペア分類は82.9、再ランク付けは65.7、検索は64.9、STSは78.9でした。英語MTEBでは平均スコア71.7を記録し、指示ありのQwen3-0.6B(70.5)およびjina-embeddings-v3(65.7)を上回りました。検索に特化したベンチマークでは、MTEB-M検索で64.88、RTEBで66.84、BEIRで56.67、LongEmbedで66.39でした。このモデルは、サイズが6分の1であるにもかかわらず、ペア分類において教師モデルのQwen3-4B(MMTEBで42.0 対 26.8)を上回り、他のすべてのカテゴリでも競争力のあるスコアを維持しました。

ベストプラクティス

タスクに基づいて適切な LoRA アダプターを選択します。非対称クエリ ドキュメント検索の場合は 'retrieval'(クエリの前に 'Query:'、段落の前に 'Document:' を追加)、重複検出や言い換え識別などの対称類似性タスクの場合は 'text-matching'(両方の入力に 'Document:' プレフィックスを使用)、関連ドキュメントのグループ化の場合は 'clustering'、分類と感情分析の場合は 'classification' を選択します。検索タスクの場合、モデルは非対称エンコードを使用してトレーニングされるため、正しいプレフィックスを使用してください。Matryoshka 切り捨てにより、埋め込み次元を 1024 から 32 まで削減できます。256 次元を超えてもパフォーマンスは良好ですが、このしきい値を下回るとジョンソン・リンデンシュトラウス限界と一致して大幅に低下します。バイナリ量子化もサポートされており、GOR 正則化のおかげでパフォーマンスの低下は最小限に抑えられます。32K のコンテキストウィンドウは長文文書をネイティブに処理しますが、モデルは長文文書の堅牢な検索のために、長文コンテキストデータで追加学習されています。埋め込みの比較にはコサイン類似度が使用されます。モデルは、Jina AI API、Hugging Face(Sentence Transformers と vLLM の統合)、および llama.cpp 向けの量子化バリアントを通じて入手できます。
このモデルについて言及しているブログ
8月 03, 2026 • 11 読む時間
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
3月 06, 2026 • 6 読む時間
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
2月 19, 2026 • 7 読む時間
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
現在の言語 / テーマ
Search Foundation
Reader
Embeddings
Reranker
Jina APIキーを取得する
レート制限
私たちについて
ニュース
Jinaロゴをダウンロード
open_in_new
Elasticロゴをダウンロード
open_in_new
APIステータス
Elastic © 2026.セキュリティ利用規約プライバシーCookieを管理する私の個人情報を販売したり、共有したりしないでください。
このウェブサイトおよび関連するすべてのコンテンツ、ソフトウェア、製品、サービスは、専門家による利用のみを目的としています。一般消費者向けのものではなく、一般消費者による利用も推奨されていません。