Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login
向量模型
copyright CC BY-NC 4.0
open_in_new 釋出部落格

jina-embeddings-v5-text-small

業界領先的多語言向量模型,配備任務專屬適配器
許可證
copyright CC-BY-NC-4.0
釋出日期
calendar_month
2026-02-18
輸入
abc
文字
arrow_forward
輸出
more_horiz
向量
Matryoshka 維度 help_outline
32
64
128
256
512
1024
模型詳情
參數: 677M
輸入詞元長度: 32K
輸出維度: 1024
底座模型 help_outline
open_in_new
Qwen3-0.6B-Base
已訓練語言 help_outline
32 種語言
支援的語言 help_outline
93 種語言
量化 help_outline
GGUF
Apple 晶片支援 help_outline
MLX
相關模型
link
jina-embeddings-v3
link
jina-embeddings-v5-text-nano
支援的任務
search 檢索
compare_arrows 文字匹配
bubble_chart 聚類
label 分類
可透過以下方式獲取
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
物理隔離
I/O 圖

文字

jina-embeddings-v5-text-small

任務

向量

帕累託前緣 help_outline
workspace_premium
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B204060all-MiniLM-L6-v2e5-base-v2EmbeddingGemma-300MEVA-CLIP ViT-B/16gtr-t5-basegtr-t5-xlgtr-t5-xxljina-clip-v1jina-clip-v2jina-embedding-l-en-v1jina-embedding-s-en-v1jina-embeddings-v2-base…jina-embeddings-v2-smal…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LongCLIP ViT-B/16nllb-siglip-largeOpenAI CLIP ViT-B/16Qwen3-Embedding-0.6BQwen3-Embedding-4Bsentence-t5-basesentence-t5-largesentence-t5-xlsentence-t5-xxljina-embeddings-v5-text…參數量(對數)nDCG@10
本模型
在前緣上
Jina AI
其他
MTEB English · retrieval
60.07
參數量
596M
按分數的排名
3 / 39
帕累託前緣
在前緣之後
取值分佈help_outline
AUC 0.8269
語料
翻譯對
文件檢索
程式碼
圖片 / 頭圖
圖片 / 標識
任務
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8080.400.500.600.700.800.90
相關10.9%
困難負例2.1%
無關0.9%
推薦閾值
FPR 0.1 · 0.717
FPR 0.01 · 0.808
FPR 0.001 · 0.860
FPR 0.0001 · 0.878
均衡 · 0.697
AUC
0.8269
噪聲上限
0.855
召回懸崖
0.566
測量樣本對
119 / 11k
向量分量help_outline
-0.160.010.18
σ 0.0313 · 244k 個數值
向量幾何help_outline
01024
各維度均值,懸停檢視區間
噪聲下限
0.300
有效維度
70 / 1024
維度截斷help_outline
32641282565121024
text-matching · 閾值隨所請求維度的變化
語言對help_outline
de-ruen-deen-koen-zhja-ko
各語言對之間的閾值跨度:0.024
選擇要比較的模型
論文 (1)
SIGIR 2026
二月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

概述

jina-embeddings-v5-text-small 是構建在 Qwen3-0.6B-Base 骨幹上的 677M 參數多語言文字向量模型。它支援 32K token 上下文,生成可用 Matryoshka 截斷至 32 維的 1024 維向量,並取得 1B 參數以下所有模型中最高 MTEB 平均。它是 Jina API 的預設向量模型,也是生產級 RAG 管線的首選推薦。

方法

該模型構建在 Qwen3-0.6B-Base 上,這是一個在 119 種語言上預訓練的多語言的語言模型。它採用 Last-Token-Pooling 生成向量。訓練遵循兩階段方案:(1) 從 Qwen3-Embedding-4B(4B 參數教師模型)進行向量蒸餾,將高品質向量表示轉移到 677M 學生模型;(2) 任務特定的對比損失在檢索、文字匹配、群聚和分類任務上微調模型。Geometric Orthogonal Regularization(GOR)確保向量在二進位量化下以最小效能損失保持穩健。Matryoshka Representation Learning 允許將維度從 1024 截斷到 32,同時在 256 維以上保持強檢索品質。32K 上下文視窗透過調整基頻的旋轉位置編碼實現,模型還額外在長上下文資料上訓練以獲得穩健的長文件檢索。

效能

在 MMTEB(多語言)上,該模型取得任務級平均 67.0 和類型級平均 58.9,是 1B 參數以下所有模型中最高的。任務級分數:分類 71.3、群聚 53.4、成對分類 82.9、重排序 65.7、檢索 64.9、STS 78.9。在英文 MTEB 上,它取得 71.7 平均,超越了帶指令的 Qwen3-0.6B(70.5)和 jina-embeddings-v3(65.7)。檢索專項:MTEB-M 64.88、RTEB 66.84、BEIR 56.67、LongEmbed 66.39。值得注意的是,該模型在成對分類上超越了其 4B 教師 Qwen3-Embedding-4B(MMTEB 42.0 對 26.8),同時體積小 6 倍,表明蒸餾與任務特定對比訓練相結合可以在特定任務上超越教師效能。

最佳實踐

選擇適當的 LoRA 適配器:非對稱查詢-文件檢索用 'retrieval'(查詢前綴 'Query:',段落前綴 'Document:'),對稱相似度用 'text-matching'(兩個輸入都用 'Document:' 前綴),群組相關文件用 'clustering',分類和情感分析用 'classification'。Matryoshka 截斷到 256–512 維適合儲存受限的索引;重排序請使用完整的 1024 維。支援二進位量化,效能損失極小。32K 上下文視窗原生處理長文件,無需分塊。使用餘弦相似度比較向量。可透過 Jina AI API、Hugging Face(Sentence Transformers、vLLM)和 llama.cpp 的量化變體取得。對於多模態工作負載,請改用 jina-embeddings-v5-omni-small。

提及此模型的部落格
八月 03, 2026 • 11 分鐘閱讀
jina-reranker-v3.5:透過混合注意力機制與自我知識蒸餾實現更快速的列表式重排器
一款 0.6B 的列表式重排器(listwise reranker),其在 BEIR 基準測試上的表現超越了 Qwen3-Reranker-4B,重排速度比 v3 快上 1.56 倍,並在半結構化檢索中提升了 9.6 的 nDCG@10。
Jina AI
三月 06, 2026 • 6 分鐘閱讀
從原始數值辨識向量模型
一個透過讀取原始數值來對向量模型進行指紋識別的微型 Transformer。無需特徵工程。
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
二月 19, 2026 • 7 分鐘閱讀
jina-embeddings-v5-text:全新的 SOTA 小型多語言向量模型
兩款效能領先的 1B 以下多語言向量模型,現已於 Elastic Inference Service、Llama.cpp 與 MLX 上架。
Jina AI
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 標誌
open_in_new
下載 Elastic 標誌
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業使用,不面向消費者。