Elastic
Jina AI
モデル
API
keyboard_arrow_down
Reader
任意の URL を Markdown に変換し、LLM のグラウンディングを向上させます。
Embeddings
マルチモーダルかつ多言語の埋め込み。
Reranker
検索エンジンのランキングを再調整して、検索関連性を最大化する。
MCP
terminal
コマンドライン
article
llms.txt
smart_toy
エージェント
data_object
スキーマ
menu_book
ドキュメント
ログイン
login
Embeddings
copyright CC BY-NC 4.0
open_in_new リリース記事

jina-embeddings-v5-text-small

タスク固有のアダプタを備えた最先端の多言語ベクトル
ライセンス
copyright CC-BY-NC-4.0
発売日
calendar_month
2026-02-18
入力
abc
テキスト
arrow_forward
出力
more_horiz
ベクター
Matryoshka 次元 help_outline
32
64
128
256
512
1024
モデル詳細
パラメータ: 677M
入力トークン長: 32K
出力寸法: 1024
ベースモデル help_outline
open_in_new
Qwen3-0.6B-Base
訓練された言語 help_outline
32 言語
サポートされている言語 help_outline
93 言語
量子化 help_outline
GGUF
Apple Silicon サポート help_outline
MLX
関連機種
link
jina-embeddings-v3
link
jina-embeddings-v5-text-nano
サポートされているタスク
search 検索
compare_arrows テキストマッチング
bubble_chart クラスタリング
label 分類
以下の方法で入手できます
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
エアギャップ
I/O 図

テキスト

jina-embeddings-v5-text-small

タスク

ベクター

パレートフロン help_outline
workspace_premium
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B204060all-MiniLM-L6-v2e5-base-v2EmbeddingGemma-300MEVA-CLIP ViT-B/16gtr-t5-basegtr-t5-xlgtr-t5-xxljina-clip-v1jina-clip-v2jina-embedding-l-en-v1jina-embedding-s-en-v1jina-embeddings-v2-base…jina-embeddings-v2-smal…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LongCLIP ViT-B/16nllb-siglip-largeOpenAI CLIP ViT-B/16Qwen3-Embedding-0.6BQwen3-Embedding-4Bsentence-t5-basesentence-t5-largesentence-t5-xlsentence-t5-xxljina-embeddings-v5-text…パラメータ数(対数)nDCG@10
このモデル
フロン上
Jina AI
その他
MTEB English · retrieval
60.07
パラメータ
596M
スコア順位
3 / 39
パレートフロン
フロン未満
値の分布help_outline
AUC 0.8269
コーパス
翻訳ペア
ドキュメント検索
コード
画像 / バナー
画像 / ロゴ
タスク
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8080.400.500.600.700.800.90
関連10.9%
ハードネガティブ2.1%
無関連0.9%
推奨しきい値
FPR 0.1 · 0.717
FPR 0.01 · 0.808
FPR 0.001 · 0.860
FPR 0.0001 · 0.878
バランス · 0.697
AUC
0.8269
ノイズ上限
0.855
再現率の崖
0.566
測定ペア数
119 / 11k
ベクトル成分help_outline
-0.160.010.18
σ 0.0313 · 244k 個の値
埋め込みの幾何help_outline
01024
次元ごとの平均。カーソルを合わせると範囲を表示
ノイズ下限
0.300
実効次元数
70 / 1024
次元の切り詰めhelp_outline
32641282565121024
text-matching · 要求した次元数ごとのしきい値
言語ペアhelp_outline
de-ruen-deen-koen-zhja-ko
ペア間のしきい値のばらつき:0.024
比較するモデルを選択してください
論文 (1)
SIGIR 2026
2月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

概要

jina-embeddings-v5-text-small は Qwen3-0.6B-Base バックボーン上に構築された 677M パラメータの多言語テキスト埋め込みモデルです。32K トークンのコンテキストをサポートし、Matryoshka 切り捨てを 32 次元まで行える 1024 次元の埋め込みを生成し、1B パラメータ未満の全モデル中で最高の MTEB 平均を達成しています。Jina API のデフォルト埋め込みモデルであり、本番 RAG パイプラインの第一候補です。

方法

モデルは、119 言語で事前学習された多言語対応の言語モデル Qwen3-0.6B-Base に構築されています。Last-Token-Pooling を用いて埋め込みを生成します。訓練は2段階の体制に従います:(1) Qwen3-Embedding-4B(4B パラメータの教師)からの埋め込み蒸留により、高品質な埋め込み表現が 677M の生徒モデルに転移されます;(2) タスク固有のコントラスト損失により、モデルは検索、テキストマッチング、クラスタリング、分類タスクでファインチューニングされます。Geometric Orthogonal Regularization(GOR)は、2 進量子化下でも性能の低下を最小限に抑え、堅牢な埋め込みを保証します。Matryoshka Representation Learning は、256 次元以上で強力な検索品質を維持しながら、次元を 1024 から 32 に切り詰めることができる。32K コンテキストウィンドウは、ベース周波数をチューニングした回転位置埋め込みによって実現され、モデルはさらに長文書検索の頑健性を高めるため長文脈データでも訓練されています。

パフォーマンス

MMTEB(多言語)では、モデルはタスクレベル平均 67.0、タイプレベル平均 58.9 を達成し、1B パラメータ未満の全モデル中で最高です。タスクレベルスコア:分類 71.3、クラスタリング 53.4、ペア分類 82.9、リランキング 65.7、検索 64.9、STS 78.9。英語 MTEB では平均 71.7 を達成し、指示付き Qwen3-0.6B(70.5)と jina-embeddings-v3(65.7)を上回っています。検索特化:MTEB-M 64.88、RTEB 66.84、BEIR 56.67、LongEmbed 66.39。注目すべきことに、このモデルはペア分類で 4B の教師 Qwen3-Embedding-4B(MMTEB 42.0 対 26.8)を上回り、サイズは 6 分の 1 ながら、蒸留とタスク固有の対照学習を組み合わせることで特定タスクでは教師の性能を超えることを示しています。

ベストプラクティス

適切な LoRA アダプターを選択してください:非対称クエリ-ドキュメント検索には 'retrieval'(クエリに 'Query:' を、パッセージに 'Document:' を前置する)、対称類似度には 'text-matching'(両方の入力に 'Document:' プレフィックスを使用)、関連ドキュメントのグルーピングには 'clustering'、カテゴライズとセンチメント分析には 'classification'。Matryoshka 切り捨てを 256–512 次元にするとストレージ制約のインデックスに適しています;リランキングにはフル 1024 次元を使用してください。2 進量子化は最小の性能損失でサポートされています。32K コンテキストウィンドウはチャンキングなしにネイティブに長文書に対応します。埋め込みの比較にはコサイン類似度を使用してください。Jina AI API、Hugging Face(Sentence Transformers、vLLM)、llama.cpp 用の量子化バリアントで利用可能です。マルチモーダルなワークロードには jina-embeddings-v5-omni-small を代わりに使用してください。

このモデルについて言及しているブログ
8月 03, 2026 • 11 読む時間
jina-reranker-v3.5: ハイブリッドアテンションと自己蒸留による高速なリストワイズ・リランカー
BEIRベンチマークで Qwen3-Reranker-4B を上回る性能を発揮し、v3 と比較して最大 1.56 倍の高速化を実現。さらに、半構造化データ検索において nDCG@10 で 9.6 ポイントの向上を達成した 0.6B のリストワイズ型重排器。
Jina AI
3月 06, 2026 • 6 読む時間
生の数値から埋め込みモデルを特定する
生の数値を読み取ることで埋め込みモデルをフィンガープリント化する、小さな Transformer。特徴量エンジニアリングは不要。
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
2月 19, 2026 • 7 読む時間
jina-embeddings-v5-text: 新しい SOTA 小型多言語ベクトルモデル
<input> 1B 未満の最高の性能を誇る 2 つの多言語対応ベクトルモデル(Embeddings)が、Elastic Inference Service、Llama.cpp、および MLX で利用可能になりました。 </input>
Jina AI
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
現在の言語 / テーマ
Search Foundation
Reader
Embeddings
Reranker
Jina APIキーを取得する
レート制限
私たちについて
ニュース
Jinaロゴをダウンロード
open_in_new
Elasticロゴをダウンロード
open_in_new
APIステータス
Elastic © 2026.セキュリティ利用規約プライバシーCookieを管理する私の個人情報を販売したり、共有したりしないでください。
このウェブサイトおよび関連するコンテンツ、ソフトウェア、製品、サービスは、すべて専門的な利用を目的としています。消費者向けの利用は想定していません。