Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
Elastic Inference Service
在 Elasticsearch 中原生執行 Jina 模型。
MCP terminal命令列articlellms.txtsmart_toy智慧體data_objectSchemamenu_book文件



登入
login
warning
此模型已被更新的模型取代。
向量模型
copyright CC BY-NC 4.0
open_in_new 釋出部落格

jina-embeddings-v3

業界領先的前沿多語言向量模型
許可證
copyright CC-BY-NC-4.0
釋出日期
calendar_month
2024-09-18
輸入
abc
文字
arrow_forward
輸出
more_horiz
向量
Matryoshka 維度 help_outline
32
64
128
256
512
768
1024
遲分 help_outline
check_circle
Yes
模型詳情
引數: 570M
輸入詞元長度: 8K
輸出維度: 1024
底座模型 help_outline
open_in_new
XLM-RoBERTa Large
已訓練語言 help_outline
32 種語言
支援的語言 help_outline
108 種語言
相關模型
link
jina-embeddings-v2-base-en
link
jina-embeddings-v2-base-zh
link
jina-embeddings-v2-base-de
link
jina-embeddings-v2-base-es
link
jina-embeddings-v2-base-code
支援的任務
search 檢索
compare_arrows 文字匹配
call_split 分離
label 分類
可透過以下方式獲取
Elastic Inference Service
Jina API
AWS SageMaker
Microsoft Azure
谷歌雲
Hugging Face
物理隔離
I/O 圖

文字

jina-embeddings-v3

任務

向量

取值分佈help_outline
AUC 0.8525
語料
翻譯對
文件檢索
程式碼
任務
default
classification
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
separation
text-matching
0.7410.200.400.600.80
相關21.8%
困難負例3.0%
無關1.0%
懸停或點選圖表可移動閾值
推薦閾值
FPR 0.1 · 0.618
FPR 0.01 · 0.741
FPR 0.001 · 0.797
FPR 0.0001 · 0.824
均衡 · 0.597
AUC
0.8525
噪聲上限
0.791
召回懸崖
0.385
測量樣本對
119 / 11k
向量分量help_outline
-0.25-0.010.23
σ 0.0312 · 244k 個數值
嵌入幾何help_outline
01024
各維度均值,懸停檢視區間
噪聲下限
0.496
有效維度
54 / 1024
維度截斷help_outline
32641282565121024
classification · 閾值隨所請求維度的變化
語言對help_outline
de-ruen-deen-koen-zhja-ko
各語言對之間的閾值跨度:0.072
選擇要比較的模型
論文 (4)
ICLR 2026
一月 22, 2026
Embedding Compression via Spherical Coordinates
ACL 2025
十二月 17, 2024
AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark
ECIR 2025
九月 18, 2024
jina-embeddings-v3: Multilingual Embeddings With Task LoRA
SIGIR 2025
九月 07, 2024
Late Chunking: Contextual Chunk Embeddings Using Long-Context Embedding Models

概述

Jina Embeddings v3 是一款突破性的多語言文本向量模型,改變了企業跨語言理解和檢索文本的方式。它的核心價值在於:在多語言、多任務場景下保持高效能的同時,把算力需求控制在可承受範圍內。在講究效率的生產環境中,該模型表現尤為突出,僅用 5.7 億參數就達到業界領先水平,讓無力承擔大模型算力開銷的團隊也能用上。需要搭建可擴展的多語言搜尋系統或跨語言分析內容的團隊,會發現它格外有用。

方法

該模型的架構是向量技術上的一次重要創新:它以 24 層的 jina-XLM-RoBERTa 為基礎,並加入面向特定任務的低秩自適應(LoRA)介面卡。LoRA 介面卡是專用的神經網路模組,可針對檢索、分類、聚類等不同任務最佳化模型,而引數量幾乎不增加,僅佔總引數的 3% 以下。模型還引入 Matryoshka 表示學習(MRL),向量維度可從 1024 靈活降至最低 32 維而效能不受影響。訓練分三個階段:先在 89 種語言的多語言文字上預訓練,再用成對文字微調以提升向量品質,最後訓練專用介面卡做任務最佳化。藉助旋轉位置編碼(RoPE),模型支援最長 8,192 詞元的上下文,並採用創新的基頻調整技術,讓短文字和長文字上的表現同步提升。

效能

在實際測試中,該模型的效率與效能之比十分出色:英語任務上勝過開源同類以及 OpenAI、Cohere 的閉源方案,多語言場景中同樣表現優異。最令人意外的是,它的成績超過了引數量為其 12 倍的 e5-mistral-7b-instruct,效率之高可見一斑。在 MTEB 基準評測中,全部任務平均分為 65.52,其中分類準確率(82.58)和句子相似度(85.80)尤為亮眼。跨語言表現也很穩定,多語言任務得 64.44。使用 MRL 降維後,低維下依然保持強勁:例如 64 維仍能保留完整 1024 維時 92% 的檢索效能。

最佳實踐

部署 Jina Embeddings v3 時,請按具體場景選擇合適的任務介面卡:搜尋應用用 retrieval.query 和 retrieval.passage,聚類任務用 separation,歸類任務用 classification,語義相似度用 text-matching。要發揮最佳效能,模型需要支援 CUDA 的硬體,不過架構高效,視訊記憶體需求遠低於體量更大的同類。生產部署方面,AWS SageMaker 整合提供了順暢的擴容路徑。該模型在多語言場景中表現出色,但用於低資源語言時建議額外做評估。它支援最長 8,192 詞元的文件,面對超長文字時,配合遲分功能效果最佳。請勿把它用於實時生成或複雜推理任務,它是為向量化和檢索而設計的,不做文字生成或直接問答。
提及此模型的部落格
九月 18, 2024 • 10 分鐘閱讀
Jina Embeddings v3:前沿多語言嵌入式模型
jina-embeddings-v3 是一個具有突破性的多語言文本嵌入模型,擁有 570M 參數和 8192 個 token 長度,在 MTEB 基準測試中的表現超越了 OpenAI 和 Cohere 最新的專有嵌入模型。
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
九月 27, 2024 • 15 分鐘閱讀
從 Jina Embeddings v2 遷移到 v3
我們收集了一些建議,幫助您從 Jina Embeddings v2 遷移到 v3。
Alex C-G
Scott Martens
A digital upgrade theme with "V3" and a white "2", set against a green and black binary code background, with "Upgrade" centr
五月 12, 2026 • 7 分鐘閱讀
jina-embeddings-v5-omni:支援文字、圖片、音訊與影片的向量模型
單一模型,四種模態:文字、圖像、音訊、影片。同級最佳的 1.6B 與 0.9B 全能型向量模型。
Han Xiao
二月 19, 2026 • 7 分鐘閱讀
jina-embeddings-v5-text:全新的 SOTA 小型多語言向量模型
兩款效能領先的 1B 以下多語言向量模型,現已於 Elastic Inference Service、Llama.cpp 與 MLX 上架。
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
九月 04, 2025 • 6 分鐘閱讀
Jina Code Embeddings:0.5B 和 1.5B 參數規模下,最先進的程式碼檢索向量模型
程式碼生成大模型 → 程式碼向量模型:0.5B/1.5B 模型在 25 個程式碼檢索基準測試中實現了 SOTA 效能。
Jina AI
Green "Code Embeddings" text displayed in a LED dot style on a black background, evoking a futuristic and technological atmos
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 徽標
open_in_new
下載 Elastic 徽標
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業人士使用。不面向任何消費者,也不鼓勵任何消費者使用。