Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login
向量模型
Qwen 研究許可證
open_in_new 釋出部落格

jina-embeddings-v4

用於多模態和多語言檢索的通用向量模型
許可證
Qwen Research License
釋出日期
calendar_month
2025-06-24
輸入
abc
文字
image
圖片
picture_as_pdf
PDF
arrow_forward
輸出
more_horiz
向量
apps
多向量
Matryoshka 維度 help_outline
128
256
512
1024
2048
延遲分塊 help_outline
check_circle
Yes
模型詳情
參數: 3.8B
輸入詞元長度: 32K
輸入影像尺寸: 768×28×28
輸出維度: 2048
底座模型 help_outline
open_in_new
Qwen2.5-VL-3B-Instruct
已訓練語言 help_outline
34 種語言
支援的語言 help_outline
29 種語言
量化 help_outline
GGUF
相關模型
link
jina-embeddings-v3
link
jina-clip-v2
支援的任務
search 檢索
compare_arrows 文字匹配
code 程式碼
可透過以下方式獲取
Jina API
Hugging Face
物理隔離
I/O 圖 1

文字

jina-embeddings-v4

任務

向量

I/O 圖 2

圖片

jina-embeddings-v4

任務

向量

I/O 圖 3

多個

向量

文字

jina-embeddings-v4

任務

I/O 圖 4

多個

向量

圖片

jina-embeddings-v4

任務

帕累託前緣 help_outline
workspace_premium
RTEB public
LongEmbed
CoIR
ViDoRe v1
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B40506070bge-base-en-v1.5bge-m3bge-small-en-v1.5CodeRankEmbedCodeSage-baseCodeSage-largeCodeSage-large-v2CodeSage-smallCodeXEmbed-7BContrievere5-base-v2e5-mistral-7b-instructe5-small-v2granite-embedding-engli…granite-embedding-small…gte-base-en-v1.5gte-modernbert-basegte-Qwen2-1.5B-instructjina-code-embeddings-0.…jina-embeddings-v3modernbert-embed-baseNV-Embed-v2SFR-Embedding-2_RSFR-Embedding-Code-2B_RSFR-Embedding-Code-400M…snowflake-arctic-embed-…UniXcoderjina-embeddings-v4參數量(對數)nDCG@10
本模型
在前緣上
Jina AI
其他
CoIR
71.59
參數量
3.8B
按分數的排名
2 / 31
帕累託前緣
在前緣之後
取值分佈help_outline
AUC 0.8308
語料
翻譯對
文件檢索
程式碼
圖片 / 頭圖
圖片 / 標識
任務
code.passage
code.query
code.query → code.passage
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8360.400.500.600.700.800.90
相關6.7%
困難負例1.1%
無關0.8%
推薦閾值
FPR 0.1 · 0.714
FPR 0.01 · 0.836
FPR 0.001 · 0.877
FPR 0.0001 · 0.896
均衡 · 0.618
AUC
0.8308
噪聲上限
0.877
召回懸崖
0.516
測量樣本對
119 / 11k
向量分量help_outline
-0.19-0.020.15
σ 0.0221 · 487k 個數值
向量幾何help_outline
02048
各維度均值,懸停檢視區間
噪聲下限
0.496
有效維度
73 / 2048
維度截斷help_outline
12825651210242048
text-matching · 閾值隨所請求維度的變化
語言對help_outline
de-ruen-deen-koen-zhja-ko
各語言對之間的閾值跨度:0.069
選擇要比較的模型
論文 (2)
ICLR 2026
一月 22, 2026
Embedding Compression via Spherical Coordinates
EMNLP 2025
六月 24, 2025
jina-embeddings-v4: Universal Embeddings for Multimodal Multilingual Retrieval

概述

jina-embeddings-v4 是一個 3.8B 參數的多模態向量模型,將文字和影像表示統一在單一架構中。它獨特地支援單向量(dense)和多向量(late-interaction/ColBERT 風格)兩種輸出模式,使團隊無需切換模型即可在索引效率和檢索精度之間權衡。該模型在視覺豐富的文件檢索上取得 SOTA 效能,原生處理表格、圖表、示意圖和混合媒體格式。

方法

該架構將大型 transformer 編碼器主幹與基於 Qwen2.5-VL 的視覺編碼器相結合,透過共享注意力層處理文字(最多 32K token)和影像(768×28×28 補丁)。三個任務特定的 LoRA 適配器(各 60M 參數)使模型專門用於:非對稱查詢-文件檢索、語意文字相似性和程式碼搜尋。雙輸出設計是關鍵創新:模型可以生成單個 2048 維 dense 向量(用於快速 ANN 索引,可經 Matryoshka 截斷到 128 維),或一組 128 維 token 級向量用於 late-interaction 打分。訓練採用兩階段課程:在文字-影像和文字-文字對上聯合對比預訓練,然後是任務特定的 LoRA 適配器訓練。對超出 32K token 上下文視窗的文件支援 late chunking。適用 Qwen Research License。

效能

在 JinaVDR(視覺文件檢索)上,該模型平均得分 72.19,而 ColPali-v1.2 為 64.50。在 ViDoRe 上,它取得平均 84.11(多向量模式下 90.17),而 ColPali 為 83.90。跨模態檢索在 CLIP 基準上達到 84.11,超過 jina-clip-v2(81.12)和 nllb-clip-large-siglip(83.19)。文字檢索得分:MTEB-en 55.97、MMTEB 66.49、LongEmbed 67.11(jina-embeddings-v3 為 55.66)。語意相似度在 English STS 上達到 85.89,多語言 STS 上 72.70。程式碼檢索在 CoIR 上得分 71.59。跨模態對齊達到 0.71 餘弦相似度(OpenAI CLIP 為 0.15)。多向量模式在視覺豐富任務上一致優於單向量模式;單向量模式為標準文字檢索提供高效性能。

最佳實踐

根據流水線選擇輸出模式:大規模 ANN 索引用單向量(可用 Matryoshka 截斷到 128–512 維),視覺豐富文件的 top-k 候選重排序用多向量。透過 API 任務參數選擇 LoRA 適配器:查詢-文件搜尋用 'retrieval',語意相似性用 'text-matching',程式碼檢索用 'code'。對超過 32K token 的文件,使用 `late_chunking。每個 LoRA 適配器的 60M 參數開銷可忽略(記憶體增加 <2%),且三個適配器可同時載入。該模型在 Qwen Research License 下授權(無商用許可證不得商用)。生產部署請使用支援 CUDA 的 GPU;該模型可透過 Jina API、AWS、Azure 和 GCP 市場取得。純文字工作負載可考慮 jina-embeddings-v5-text-small`,它以一小部分計算成本提供更高的每參數精度。

提及此模型的部落格
三月 11, 2026 • 7 分鐘閱讀
從多模態大模型引導音訊向量模型
將任何多模態大模型轉換為小型音訊向量模型,僅需 25 分之一的數據量,表現即可超越 CLAP。
Han Xiao
Abstract illustration of a sound wave or heartbeat, formed by blue, orange, and gray dots on a white background.
二月 19, 2026 • 7 分鐘閱讀
jina-embeddings-v5-text:全新的 SOTA 小型多語言向量模型
兩款效能領先的 1B 以下多語言向量模型,現已於 Elastic Inference Service、Llama.cpp 與 MLX 上架。
Jina AI
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
九月 09, 2025 • 11 分鐘閱讀
Llama.cpp 與 GGUF 中的多模態向量模型
我們將多模態向量模型引入了 llama.cpp 和 GGUF,並在此過程中發現了一些令人驚訝的問題。
Andrei Ungureanu
Alex C-G
Cartoon llama in the center of a white background, emitting laser-like beams from its eyes. The illustration creates a playfu
九月 04, 2025 • 6 分鐘閱讀
Jina Code Embeddings:0.5B 和 1.5B 參數規模下,最先進的程式碼檢索向量模型
程式碼生成大模型 → 程式碼向量模型:0.5B/1.5B 模型在 25 個程式碼檢索基準測試中實現了 SOTA 效能。
Jina AI
Green "Code Embeddings" text displayed in a LED dot style on a black background, evoking a futuristic and technological atmos
八月 13, 2025 • 15 分鐘閱讀
最佳化僅解碼器向量模型的 GGUF
在 L4 GPU 上,一個 30 億參數的向量模型達到 4000 個詞元 / 秒的速度,這大概是使用 llama.cpp 所能達到的極限速度了。真的是這樣嗎?
Han Xiao
Text "DGUF for Embedding Models" written in yellow on a dark background, conveying a sleek, minimalistic, digital design.
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 標誌
open_in_new
下載 Elastic 標誌
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業使用,不面向消費者。