Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
Elastic Inference Service
在 Elasticsearch 中原生运行 Jina 模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
向量模型
copyright CC BY-NC 4.0
open_in_new 发布博客

jina-embeddings-v5-text-small

业界领先的多语言向量模型,配备任务专属适配器
许可证
copyright CC-BY-NC-4.0
发布日期
calendar_month
2026-02-18
输入
abc
文本
arrow_forward
输出
more_horiz
向量
俄罗斯套娃维度 help_outline
32
64
128
256
512
1024
模型详情
参数: 677M
输入词元长度: 32K
输出维度: 1024
底座模型 help_outline
open_in_new
Qwen3-0.6B-Base
已训练语言 help_outline
32 种语言
支持的语言 help_outline
93 种语言
量化版本 help_outline
GGUF
苹果芯片支持 help_outline
MLX
相关模型
link
jina-embeddings-v3
link
jina-embeddings-v5-text-nano
支持的任务
search 检索
compare_arrows 文本匹配
bubble_chart 聚类
label 分类
可通过以下方式获取
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
物理隔离
I/O 图

文本

jina-embeddings-v5-text-small

任务

向量

Pareto fronthelp_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nanojina-embeddings-v5-text…Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
LongEmbed
66.39
Parameters
596M
Rank by score
8 / 69
Pareto front
Behind it
取值分布help_outline
AUC 0.8269
语料
翻译对
文档检索
代码
图像 / 头图
图像 / 标识
任务
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8080.400.500.600.700.800.90
相关10.9%
困难负例2.1%
无关0.9%
推荐阈值
FPR 0.1 · 0.717
FPR 0.01 · 0.808
FPR 0.001 · 0.860
FPR 0.0001 · 0.878
均衡 · 0.697
AUC
0.8269
噪声上限
0.855
召回悬崖
0.566
测量样本对
119 / 11k
向量分量help_outline
-0.160.010.18
σ 0.0313 · 244k 个数值
嵌入几何help_outline
01024
各维度均值,悬停查看区间
噪声下限
0.300
有效维度
70 / 1024
维度截断help_outline
32641282565121024
text-matching · 阈值随所请求维度的变化
语言对help_outline
de-ruen-deen-koen-zhja-ko
各语言对之间的阈值跨度:0.024
选择要比较的模型
论文 (1)
SIGIR 2026
二月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

概述

jina-embeddings-v5-text-small 是一个 0.6B 参数的多语言文本向量模型,基于 Qwen3-0.6B-Base 主干网络构建。它通过末词元池化生成 1024 维向量,并借助旋转位置编码(RoPE)与调整后的基频,支持最长 32K 词元的上下文。模型包含四个面向特定任务的 LoRA 适配器,分别用于检索、语义相似度、聚类和分类,均在冻结的主干网络权重之上独立训练。借助 Matryoshka 表示学习,向量最低可截断至 32 维。训练分两个阶段:先从 Qwen3-Embedding-4B 做向量蒸馏,迁移大型教师模型的知识;再针对每类任务用专门的损失函数训练对应适配器。模型支持以「Query:」和「Document:」前缀区分的非对称检索。

方法

训练分两个阶段。第一阶段做向量蒸馏,用投影后的学生向量与教师向量之间的余弦距离损失,把 Qwen3-Embedding-4B(40 亿参数的教师模型)的知识迁移到 Qwen3-0.6B-Base 学生模型。一个线性投影层负责把学生的 1024 维空间映射到教师的高维空间。通用蒸馏使用 300 多个数据集、覆盖 30 多种语言,训练 50,000 步;随后调整 RoPE 参数,在合成与真实长文档(1,000 至 4,096 词元)上做长上下文训练。第二阶段在冻结的主干网络权重之上训练四个 LoRA 适配器:检索适配器结合带难负样本的 InfoNCE 对比损失、持续蒸馏损失和全局正交正则项(GOR),以提升量化稳健性;文本匹配适配器用 CoSENT 排序损失处理分级相似度,对未打分的样本对则继续蒸馏;聚类适配器采用带聚类专用教师指令的再蒸馏;分类适配器采用双向 InfoNCE 损失,并辅以关系型知识蒸馏正则化。最终的检索适配器权重由多个检查点平均得到。

性能

在多语言基准 MMTEB 上,jina-embeddings-v5-text-small 取得任务级平均分 67.0、类型级平均分 58.9,在所有 10 亿参数以下的模型中位居第一。各项得分为:分类 71.3,聚类 53.4,配对分类 82.9,重排 65.7,检索 64.9,STS 78.9。英文 MTEB 平均分 71.7,优于带指令的 Qwen3-0.6B(70.5)和 jina-embeddings-v3(65.7)。检索类基准上,MTEB-M 检索 64.88,RTEB 66.84,BEIR 56.67,LongEmbed 66.39。该模型体量仅为教师模型 Qwen3-4B 的六分之一,却在配对分类上反超教师(MMTEB 上 42.0 对 26.8),其余各类成绩也都保持在同类前列。

最佳实践

请根据任务选择合适的 LoRA 适配器:「retrieval」用于非对称的查询-文档检索(查询前加「Query:」,段落前加「Document:」);「text-matching」用于查重、复述识别等对称相似度任务(两侧输入都用「Document:」前缀);「clustering」用于把相关文档归类;「classification」用于分类和情感分析。检索任务请务必使用正确的前缀,因为模型是按非对称编码训练的。借助 Matryoshka 截断,向量可从 1024 维降到最低 32 维;256 维以上性能依然稳健,低于该阈值则明显下滑,这与 Johnson-Lindenstrauss 定理的限制一致。得益于 GOR 正则化,二值量化的性能损失极小。32K 上下文窗口原生支持长文档,模型还额外在长上下文数据上做过训练,长文档检索更为稳健。向量比对请使用余弦相似度。该模型可通过 Jina AI API、Hugging Face(已集成 Sentence Transformers 和 vLLM)获取,也提供适用于 llama.cpp 的量化版本。
提及此模型的博客
八月 03, 2026 • 11 分钟阅读
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
三月 06, 2026 • 6 分钟阅读
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
二月 19, 2026 • 7 分钟阅读
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 徽标
open_in_new
下载 Elastic 徽标
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业人士使用。不面向任何消费者,也不鼓励任何消费者使用。