Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login
向量模型
copyright CC BY-NC 4.0
open_in_new 釋出部落格

jina-embeddings-v5-text-nano

面向邊緣部署的業界領先多語言向量模型
許可證
copyright CC-BY-NC-4.0
釋出日期
calendar_month
2026-02-18
輸入
abc
文字
arrow_forward
輸出
more_horiz
向量
Matryoshka 維度 help_outline
32
64
128
256
512
768
模型詳情
參數: 239M
輸入詞元長度: 8K
輸出維度: 768
底座模型 help_outline
open_in_new
EuroBERT-210M
已訓練語言 help_outline
32 種語言
支援的語言 help_outline
108 種語言
量化版本 help_outline
GGUF
Apple 晶片支援 help_outline
MLX
相關模型
link
jina-embeddings-v3
link
jina-embeddings-v5-text-small
支援的任務
search 檢索
compare_arrows 文字匹配
bubble_chart 聚類
label 分類
可透過以下方式獲取
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
物理隔離
I/O 圖

文字

jina-embeddings-v5-text-nano

任務

向量

帕累託前緣help_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nano參數量(對數)nDCG@10
本模型
在前緣上
Jina AI
其他
LongEmbed
63.65
參數量
212M
按分數的排名
14 / 69
帕累託前緣
在前緣之後
取值分佈help_outline
AUC 0.8242
語料
翻譯對
文件檢索
程式碼
影像 / 頭圖
影像 / 標識
任務
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.7930.400.500.600.700.80
相關20.2%
困難負例1.7%
無關1.1%
推薦閾值
FPR 0.1 · 0.722
FPR 0.01 · 0.793
FPR 0.001 · 0.841
FPR 0.0001 · 0.865
均衡 · 0.678
AUC
0.8242
噪聲上限
0.840
召回懸崖
0.557
測量樣本對
119 / 11k
向量分量help_outline
-0.180.000.19
σ 0.0361 · 183k 個數值
嵌入幾何help_outline
0768
各維度均值,懸停檢視區間
噪聲下限
0.288
有效維度
69 / 768
維度截斷help_outline
3264128256512768
text-matching · 閾值隨所請求維度的變化
語言對help_outline
de-ruen-deen-koen-zhja-ko
各語言對之間的閾值跨度:0.027
選擇要比較的模型
論文 (1)
SIGIR 2026
二月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

概述

jina-embeddings-v5-text-nano 是一個 2.39 億參數的多語言文本向量模型,基於 EuroBERT-210M 主幹網路構建——這是一個在 15 種主要歐洲及全球語言上預訓練的雙向編碼器。該模型通過末詞元池化生成 768 維向量,支援最長 32K 詞元的上下文。模型包含四個面向特定任務的 LoRA 適配器(各 670 萬參數),分別用於檢索、語義相似度、聚類和分類。藉助 Matryoshka 表示學習,向量最低可截斷至 32 維。該模型以 Qwen3-Embedding-4B 為教師做向量蒸餾,並配合任務適配器訓練,效能足以媲美規模超過自身兩倍的模型,非常適合延遲敏感場景與邊緣部署。

方法

訓練流程與 jina-embeddings-v5-text-small 相同,同樣分兩個階段,只是應用在 EuroBERT-210M 主幹網路上。第一階段做向量蒸餾,用餘弦距離損失把 Qwen3-Embedding-4B 的知識遷移過來,其間由一個線性投影層把學生的 768 維向量映射到教師空間。訓練資料來自 300 多個資料集的多語言文本對。第二階段在凍結的主幹網路權重之上訓練四個面向特定任務的 LoRA 適配器(各 670 萬參數):檢索(InfoNCE + 蒸餾 + GOR)、文本匹配(CoSENT + 蒸餾)、聚類(配任務專用教師指令的再蒸餾)以及分類(雙向 InfoNCE + 關係型知識蒸餾)。EuroBERT 主幹網路提供了紮實的多語言覆蓋,涵蓋英語、法語、德語、西班牙語、中文、日語、阿拉伯語和印地語等 15 種主要的歐洲及全球語言。

效能

在多語言基準 MMTEB 上,jina-embeddings-v5-text-nano 僅用 2.39 億參數就取得任務級平均分 65.5、類型級平均分 57.7,優於所有 5 億參數以下的模型,包括 KaLM-mini-v2.5(60.1,4.94 億參數)、voyage-4-nano(58.9,4.8 億參數)和 Gemma-300M(61.1,3.08 億參數)。各項得分為:分類 69.2,聚類 52.7,配對分類 81.9,重排 64.6,檢索 63.3,STS 78.2。英文 MTEB 平均分 71.0,幾乎追平體量大得多的 jina-embeddings-v5-text-small(71.7)。檢索類基準上,MTEB-M 得 63.26,RTEB 得 64.08,BEIR 得 56.06,LongEmbed 得 63.65。向量在二值量化下依然穩健,藉助 GOR 正則化,MTEB 檢索的效能下降控制在 2 分以內。

最佳實踐

請根據任務選擇合適的 LoRA 介面卡:「retrieval」用於非對稱的查詢-文件檢索(查詢前加「Query:」,段落前加「Document:」);「text-matching」用於對稱相似度任務(兩側輸入都用「Document:」字首);「clustering」用於把相關文件歸類;「classification」用於分類。nano 版專為延遲敏感和資源受限的部署最佳化,準確率卻足以媲美兩倍於自身規模的模型。藉助 Matryoshka 截斷,向量可從 768 維降到最低 32 維;為獲得最佳效果,建議保持在 256 維以上。模型支援二值量化。EuroBERT 主幹網路對 15 種主要語言覆蓋紮實,包括英語、法語、德語、西班牙語、中文、日語、阿拉伯語和印地語。向量比對請使用餘弦相似度。可透過 Jina AI API、Hugging Face(Sentence Transformers 和 vLLM)獲取,也提供適用於 llama.cpp 的量化版本。
提及此模型的部落格
五月 12, 2026 • 7 分鐘閱讀
jina-embeddings-v5-omni: Embeddings for Text, Image, Audio and Video
One model, four modalities: text, image, audio, video. Best-in-class omni embeddings in 1.6B and 0.9B.
Han Xiao
三月 06, 2026 • 6 分鐘閱讀
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
二月 19, 2026 • 7 分鐘閱讀
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 徽標
open_in_new
下載 Elastic 徽標
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業人士使用。不面向任何消費者,也不鼓勵任何消費者使用。