Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
向量模型
copyright CC BY-NC 4.0
open_in_new 发布博客

jina-embeddings-v5-text-nano

面向边缘部署的业界领先多语言向量模型
许可证
copyright CC-BY-NC-4.0
发布日期
calendar_month
2026-02-18
输入
abc
文本
arrow_forward
输出
more_horiz
向量
Matryoshka 维度 help_outline
32
64
128
256
512
768
模型详情
参数: 239M
输入词元长度: 8K
输出维度: 768
底座模型 help_outline
open_in_new
EuroBERT-210M
已训练语言 help_outline
32 种语言
支持的语言 help_outline
108 种语言
量化版本 help_outline
GGUF
苹果芯片支持 help_outline
MLX
相关模型
link
jina-embeddings-v3
link
jina-embeddings-v5-text-small
支持的任务
search 检索
compare_arrows 文本匹配
bubble_chart 聚类
label 分类
可通过以下方式获取
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
物理隔离
I/O 图

文本

jina-embeddings-v5-text-nano

任务

向量

帕累托前沿help_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nano参数量(对数)nDCG@10
本模型
在前沿上
Jina AI
其他
LongEmbed
63.65
参数量
212M
按分数的排名
14 / 69
帕累托前沿
在前沿之后
取值分布help_outline
AUC 0.8242
语料
翻译对
文档检索
代码
图像 / 头图
图像 / 标识
任务
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.7930.400.500.600.700.80
相关20.2%
困难负例1.7%
无关1.1%
推荐阈值
FPR 0.1 · 0.722
FPR 0.01 · 0.793
FPR 0.001 · 0.841
FPR 0.0001 · 0.865
均衡 · 0.678
AUC
0.8242
噪声上限
0.840
召回悬崖
0.557
测量样本对
119 / 11k
向量分量help_outline
-0.180.000.19
σ 0.0361 · 183k 个数值
嵌入几何help_outline
0768
各维度均值,悬停查看区间
噪声下限
0.288
有效维度
69 / 768
维度截断help_outline
3264128256512768
text-matching · 阈值随所请求维度的变化
语言对help_outline
de-ruen-deen-koen-zhja-ko
各语言对之间的阈值跨度:0.027
选择要比较的模型
论文 (1)
SIGIR 2026
二月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

概述

jina-embeddings-v5-text-nano 是一个 2.39 亿参数的多语言文本向量模型,基于 EuroBERT-210M 主干网络构建——这是一个在 15 种主要欧洲及全球语言上预训练的双向编码器。该模型通过末词元池化生成 768 维向量,支持最长 32K 词元的上下文。模型包含四个面向特定任务的 LoRA 适配器(各 670 万参数),分别用于检索、语义相似度、聚类和分类。借助 Matryoshka 表示学习,向量最低可截断至 32 维。该模型以 Qwen3-Embedding-4B 为教师做向量蒸馏,并配合任务适配器训练,性能足以媲美规模超过自身两倍的模型,非常适合延迟敏感场景与边缘部署。

方法

训练流程与 jina-embeddings-v5-text-small 相同,同样分两个阶段,只是应用在 EuroBERT-210M 主干网络上。第一阶段做向量蒸馏,用余弦距离损失把 Qwen3-Embedding-4B 的知识迁移过来,其间由一个线性投影层把学生的 768 维向量映射到教师空间。训练数据来自 300 多个数据集的多语言文本对。第二阶段在冻结的主干网络权重之上训练四个面向特定任务的 LoRA 适配器(各 670 万参数):检索(InfoNCE + 蒸馏 + GOR)、文本匹配(CoSENT + 蒸馏)、聚类(配任务专用教师指令的再蒸馏)以及分类(双向 InfoNCE + 关系型知识蒸馏)。EuroBERT 主干网络提供了扎实的多语言覆盖,涵盖英语、法语、德语、西班牙语、中文、日语、阿拉伯语和印地语等 15 种主要的欧洲及全球语言。

性能

在多语言基准 MMTEB 上,jina-embeddings-v5-text-nano 仅用 2.39 亿参数就取得任务级平均分 65.5、类型级平均分 57.7,优于所有 5 亿参数以下的模型,包括 KaLM-mini-v2.5(60.1,4.94 亿参数)、voyage-4-nano(58.9,4.8 亿参数)和 Gemma-300M(61.1,3.08 亿参数)。各项得分为:分类 69.2,聚类 52.7,配对分类 81.9,重排 64.6,检索 63.3,STS 78.2。英文 MTEB 平均分 71.0,几乎追平体量大得多的 jina-embeddings-v5-text-small(71.7)。检索类基准上,MTEB-M 得 63.26,RTEB 得 64.08,BEIR 得 56.06,LongEmbed 得 63.65。向量在二值量化下依然稳健,借助 GOR 正则化,MTEB 检索的性能下降控制在 2 分以内。

最佳实践

请根据任务选择合适的 LoRA 适配器:「retrieval」用于非对称的查询-文档检索(查询前加「Query:」,段落前加「Document:」);「text-matching」用于对称相似度任务(两侧输入都用「Document:」前缀);「clustering」用于把相关文档归类;「classification」用于分类。nano 版专为延迟敏感和资源受限的部署优化,准确率却足以媲美两倍于自身规模的模型。借助 Matryoshka 截断,向量可从 768 维降到最低 32 维;为获得最佳效果,建议保持在 256 维以上。模型支持二值量化。EuroBERT 主干网络对 15 种主要语言覆盖扎实,包括英语、法语、德语、西班牙语、中文、日语、阿拉伯语和印地语。向量比对请使用余弦相似度。可通过 Jina AI API、Hugging Face(Sentence Transformers 和 vLLM)获取,也提供适用于 llama.cpp 的量化版本。
提及此模型的博客
五月 12, 2026 • 7 分钟阅读
jina-embeddings-v5-omni: Embeddings for Text, Image, Audio and Video
One model, four modalities: text, image, audio, video. Best-in-class omni embeddings in 1.6B and 0.9B.
Han Xiao
三月 06, 2026 • 6 分钟阅读
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
二月 19, 2026 • 7 分钟阅读
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 徽标
open_in_new
下载 Elastic 徽标
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业人士使用。不面向任何消费者,也不鼓励任何消费者使用。