Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
Elastic Inference Service
在 Elasticsearch 中原生运行 Jina 模型。
MCP terminal命令行articlellms.txtsmart_toy智能体data_objectSchemamenu_book文档



登录
login
warning
此模型已被更新的模型取代。
向量模型
copyright CC BY-NC 4.0
open_in_new 发布博客

jina-embeddings-v3

业界领先的前沿多语言向量模型
许可证
copyright CC-BY-NC-4.0
发布日期
calendar_month
2024-09-18
输入
abc
文本
arrow_forward
输出
more_horiz
向量
俄罗斯套娃维度 help_outline
32
64
128
256
512
768
1024
迟分 help_outline
check_circle
Yes
模型详情
参数: 570M
输入词元长度: 8K
输出维度: 1024
底座模型 help_outline
open_in_new
XLM-RoBERTa Large
已训练语言 help_outline
32 种语言
支持的语言 help_outline
108 种语言
相关模型
link
jina-embeddings-v2-base-en
link
jina-embeddings-v2-base-zh
link
jina-embeddings-v2-base-de
link
jina-embeddings-v2-base-es
link
jina-embeddings-v2-base-code
支持的任务
search 检索
compare_arrows 文本匹配
call_split 分离
label 分类
可通过以下方式获取
Elastic Inference Service
Jina API
AWS SageMaker
微软云
谷歌云
Hugging Face
物理隔离
I/O 图

文本

jina-embeddings-v3

任务

向量

取值分布help_outline
AUC 0.8525
语料
翻译对
文档检索
代码
任务
default
classification
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
separation
text-matching
0.7410.200.400.600.80
相关21.8%
困难负例3.0%
无关1.0%
悬停或点击图表可移动阈值
推荐阈值
FPR 0.1 · 0.618
FPR 0.01 · 0.741
FPR 0.001 · 0.797
FPR 0.0001 · 0.824
均衡 · 0.597
AUC
0.8525
噪声上限
0.791
召回悬崖
0.385
测量样本对
119 / 11k
向量分量help_outline
-0.25-0.010.23
σ 0.0312 · 244k 个数值
嵌入几何help_outline
01024
各维度均值,悬停查看区间
噪声下限
0.496
有效维度
54 / 1024
维度截断help_outline
32641282565121024
classification · 阈值随所请求维度的变化
语言对help_outline
de-ruen-deen-koen-zhja-ko
各语言对之间的阈值跨度:0.072
选择要比较的模型
论文 (4)
ICLR 2026
一月 22, 2026
Embedding Compression via Spherical Coordinates
ACL 2025
十二月 17, 2024
AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark
ECIR 2025
九月 18, 2024
jina-embeddings-v3: Multilingual Embeddings With Task LoRA
SIGIR 2025
九月 07, 2024
Late Chunking: Contextual Chunk Embeddings Using Long-Context Embedding Models

概述

Jina Embeddings v3 是一款突破性的多语言文本向量模型,改变了企业跨语言理解和检索文本的方式。它的核心价值在于:在多语言、多任务场景下保持高性能的同时,把算力需求控制在可承受范围内。在讲究效率的生产环境中,该模型表现尤为突出,仅用 5.7 亿参数就达到业界领先水平,让无力承担大模型算力开销的团队也能用上。需要搭建可扩展的多语言搜索系统或跨语言分析内容的团队,会发现它格外有用。

方法

该模型的架构是向量技术上的一次重要创新:它以 24 层的 jina-XLM-RoBERTa 为基础,并加入面向特定任务的低秩自适应(LoRA)适配器。LoRA 适配器是专用的神经网络模块,可针对检索、分类、聚类等不同任务优化模型,而参数量几乎不增加,仅占总参数的 3% 以下。模型还引入 Matryoshka 表示学习(MRL),向量维度可从 1024 灵活降至最低 32 维而性能不受影响。训练分三个阶段:先在 89 种语言的多语言文本上预训练,再用成对文本微调以提升向量质量,最后训练专用适配器做任务优化。借助旋转位置编码(RoPE),模型支持最长 8,192 词元的上下文,并采用创新的基频调整技术,让短文本和长文本上的表现同步提升。

性能

在实际测试中,该模型的效率与性能之比十分出色:英语任务上胜过开源同类以及 OpenAI、Cohere 的闭源方案,多语言场景中同样表现优异。最令人意外的是,它的成绩超过了参数量为其 12 倍的 e5-mistral-7b-instruct,效率之高可见一斑。在 MTEB 基准评测中,全部任务平均分为 65.52,其中分类准确率(82.58)和句子相似度(85.80)尤为亮眼。跨语言表现也很稳定,多语言任务得 64.44。使用 MRL 降维后,低维下依然保持强劲:例如 64 维仍能保留完整 1024 维时 92% 的检索性能。

最佳实践

部署 Jina Embeddings v3 时,请按具体场景选择合适的任务适配器:搜索应用用 retrieval.query 和 retrieval.passage,聚类任务用 separation,归类任务用 classification,语义相似度用 text-matching。要发挥最佳性能,模型需要支持 CUDA 的硬件,不过架构高效,显存需求远低于体量更大的同类。生产部署方面,AWS SageMaker 集成提供了顺畅的扩容路径。该模型在多语言场景中表现出色,但用于低资源语言时建议额外做评估。它支持最长 8,192 词元的文档,面对超长文本时,配合迟分功能效果最佳。请勿把它用于实时生成或复杂推理任务,它是为向量化和检索而设计的,不做文本生成或直接问答。
提及此模型的博客
九月 18, 2024 • 10 分钟阅读
Jina Embeddings v3:前沿的多语言嵌入模型
jina-embeddings-v3 是一个前沿的多语言文本嵌入模型,拥有 5.7 亿参数和 8192 个 token 长度,在 MTEB 上的性能超过了 OpenAI 和 Cohere 最新的专有嵌入模型。
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
九月 27, 2024 • 15 分钟阅读
从 Jina Embeddings v2 迁移到 v3
我们收集了一些帮助你从 Jina Embeddings v2 迁移到 v3 的提示。
Alex C-G
Scott Martens
A digital upgrade theme with "V3" and a white "2", set against a green and black binary code background, with "Upgrade" centr
五月 12, 2026 • 7 分钟阅读
jina-embeddings-v5-omni:支持文本、图像、音频和视频的向量模型
一个模型,四种模态:文本、图像、音频、视频。业界领先的 1.6B 和 0.9B 全能型向量模型。
Han Xiao
二月 19, 2026 • 7 分钟阅读
jina-embeddings-v5-text:全新的 SOTA 小型多语言向量模型
两款性能领先的 1B 以下多语言向量模型,现已在 Elastic Inference Service、Llama.cpp 和 MLX 上可用。
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
九月 04, 2025 • 6 分钟阅读
Jina Code Embeddings:0.5B 和 1.5B 参数规模下的 SOTA 代码检索向量模型
代码生成大模型 → 代码向量模型:0.5B/1.5B 模型在 25 个代码检索基准测试中实现了 SOTA 性能。
Jina AI
Green "Code Embeddings" text displayed in a LED dot style on a black background, evoking a futuristic and technological atmos
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 徽标
open_in_new
下载 Elastic 徽标
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业人士使用。不面向任何消费者,也不鼓励任何消费者使用。