Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
Elastic Inference Service
在 Elasticsearch 中原生執行 Jina 模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login
向量模型
copyright CC BY-NC 4.0
open_in_new 釋出部落格

jina-embeddings-v5-text-small

業界領先的多語言向量模型,配備任務專屬介面卡
許可證
copyright CC-BY-NC-4.0
釋出日期
calendar_month
2026-02-18
輸入
abc
文字
arrow_forward
輸出
more_horiz
向量
Matryoshka 維度 help_outline
32
64
128
256
512
1024
模型詳情
引數: 677M
輸入詞元長度: 32K
輸出維度: 1024
底座模型 help_outline
open_in_new
Qwen3-0.6B-Base
已訓練語言 help_outline
32 種語言
支援的語言 help_outline
93 種語言
量化版本 help_outline
GGUF
Apple 晶片支援 help_outline
MLX
相關模型
link
jina-embeddings-v3
link
jina-embeddings-v5-text-nano
支援的任務
search 檢索
compare_arrows 文字匹配
bubble_chart 聚類
label 分類
可透過以下方式獲取
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
物理隔離
I/O 圖

文字

jina-embeddings-v5-text-small

任務

向量

Pareto fronthelp_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nanojina-embeddings-v5-text…Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
LongEmbed
66.39
Parameters
596M
Rank by score
8 / 69
Pareto front
Behind it
取值分佈help_outline
AUC 0.8269
語料
翻譯對
文件檢索
程式碼
影象 / 頭圖
影象 / 標識
任務
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8080.400.500.600.700.800.90
相關10.9%
困難負例2.1%
無關0.9%
推薦閾值
FPR 0.1 · 0.717
FPR 0.01 · 0.808
FPR 0.001 · 0.860
FPR 0.0001 · 0.878
均衡 · 0.697
AUC
0.8269
噪聲上限
0.855
召回懸崖
0.566
測量樣本對
119 / 11k
向量分量help_outline
-0.160.010.18
σ 0.0313 · 244k 個數值
嵌入幾何help_outline
01024
各維度均值,懸停檢視區間
噪聲下限
0.300
有效維度
70 / 1024
維度截斷help_outline
32641282565121024
text-matching · 閾值隨所請求維度的變化
語言對help_outline
de-ruen-deen-koen-zhja-ko
各語言對之間的閾值跨度:0.024
選擇要比較的模型
論文 (1)
SIGIR 2026
二月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

概述

jina-embeddings-v5-text-small 是一個 0.6B 引數的多語言文字向量模型,基於 Qwen3-0.6B-Base 主幹網路構建。它透過末詞元池化生成 1024 維向量,並藉助旋轉位置編碼(RoPE)與調整後的基頻,支援最長 32K 詞元的上下文。模型包含四個面向特定任務的 LoRA 介面卡,分別用於檢索、語義相似度、聚類和分類,均在凍結的主幹網路權重之上獨立訓練。藉助 Matryoshka 表示學習,向量最低可截斷至 32 維。訓練分兩個階段:先從 Qwen3-Embedding-4B 做向量蒸餾,遷移大型教師模型的知識;再針對每類任務用專門的損失函式訓練對應介面卡。模型支援以「Query:」和「Document:」字首區分的非對稱檢索。

方法

訓練分兩個階段。第一階段做向量蒸餾,用投影后的學生向量與教師向量之間的餘弦距離損失,把 Qwen3-Embedding-4B(40 億參數的教師模型)的知識遷移到 Qwen3-0.6B-Base 學生模型。一個線性投影層負責把學生的 1024 維空間映射到教師的高維空間。通用蒸餾使用 300 多個資料集、覆蓋 30 多種語言,訓練 50,000 步;隨後調整 RoPE 參數,在合成與真實長文件(1,000 至 4,096 詞元)上做長上下文訓練。第二階段在凍結的主幹網路權重之上訓練四個 LoRA 適配器:檢索適配器結合帶難負樣本的 InfoNCE 對比損失、持續蒸餾損失和全域正交正則項(GOR),以提升量化穩健性;文本匹配適配器用 CoSENT 排序損失處理分級相似度,對未評分的樣本對則繼續蒸餾;聚類適配器採用帶聚類專用教師指令的再蒸餾;分類適配器採用雙向 InfoNCE 損失,並輔以關係型知識蒸餾正則化。最終的檢索適配器權重由多個檢查點平均得到。

效能

在多語言基準 MMTEB 上,jina-embeddings-v5-text-small 取得任務級平均分 67.0、型別級平均分 58.9,在所有 10 億引數以下的模型中位居第一。各項得分為:分類 71.3,聚類 53.4,配對分類 82.9,重排 65.7,檢索 64.9,STS 78.9。英文 MTEB 平均分 71.7,優於帶指令的 Qwen3-0.6B(70.5)和 jina-embeddings-v3(65.7)。檢索類基準上,MTEB-M 檢索 64.88,RTEB 66.84,BEIR 56.67,LongEmbed 66.39。該模型體量僅為教師模型 Qwen3-4B 的六分之一,卻在配對分類上反超教師(MMTEB 上 42.0 對 26.8),其餘各類成績也都保持在同類前列。

最佳實踐

請根據任務選擇合適的 LoRA 介面卡:「retrieval」用於非對稱的查詢-文件檢索(查詢前加「Query:」,段落前加「Document:」);「text-matching」用於查重、複述識別等對稱相似度任務(兩側輸入都用「Document:」字首);「clustering」用於把相關文件歸類;「classification」用於分類和情感分析。檢索任務請務必使用正確的字首,因為模型是按非對稱編碼訓練的。藉助 Matryoshka 截斷,向量可從 1024 維降到最低 32 維;256 維以上效能依然穩健,低於該閾值則明顯下滑,這與 Johnson-Lindenstrauss 定理的限制一致。得益於 GOR 正則化,二值量化的效能損失極小。32K 上下文視窗原生支援長文件,模型還額外在長上下文資料上做過訓練,長文件檢索更為穩健。向量比對請使用餘弦相似度。該模型可透過 Jina AI API、Hugging Face(已整合 Sentence Transformers 和 vLLM)獲取,也提供適用於 llama.cpp 的量化版本。
提及此模型的部落格
八月 03, 2026 • 11 分鐘閱讀
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
三月 06, 2026 • 6 分鐘閱讀
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
二月 19, 2026 • 7 分鐘閱讀
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 徽標
open_in_new
下載 Elastic 徽標
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業人士使用。不面向任何消費者,也不鼓勵任何消費者使用。