Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
Elastic Inference Service
在 Elasticsearch 中原生執行 Jina 模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login
向量模型
Qwen 研究許可證
open_in_new 釋出部落格

jina-embeddings-v4

用於多模態和多語言檢索的通用向量模型
許可證
Qwen Research License
釋出日期
calendar_month
2025-06-24
輸入
abc
文字
image
影象
picture_as_pdf
PDF
arrow_forward
輸出
more_horiz
向量
apps
多向量
Matryoshka 維度 help_outline
128
256
512
1024
2048
遲分 help_outline
check_circle
Yes
模型詳情
引數: 3.8B
輸入詞元長度: 32K
輸入影象尺寸: 768×28×28
輸出維度: 2048
底座模型 help_outline
open_in_new
Qwen2.5-VL-3B-Instruct
已訓練語言 help_outline
34 種語言
支援的語言 help_outline
29 種語言
量化版本 help_outline
GGUF
相關模型
link
jina-embeddings-v3
link
jina-clip-v2
支援的任務
search 檢索
compare_arrows 文字匹配
code 程式碼
可透過以下方式獲取
Jina API
Hugging Face
物理隔離
I/O 圖 1

文字

jina-embeddings-v4

任務

向量

I/O 圖 2

影象

jina-embeddings-v4

任務

向量

I/O 圖 3

多個

向量

文字

jina-embeddings-v4

任務

I/O 圖 4

多個

向量

影象

jina-embeddings-v4

任務

Pareto fronthelp_outline
RTEB public
LongEmbed
CoIR
ViDoRe v1
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v5-text…LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nanojina-embeddings-v4Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
LongEmbed
69.88
Parameters
3.8B
Rank by score
7 / 69
Pareto front
Behind it
取值分佈help_outline
AUC 0.8308
語料
翻譯對
文件檢索
程式碼
影象 / 頭圖
影象 / 標識
任務
code.passage
code.query
code.query → code.passage
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8360.400.500.600.700.800.90
相關6.7%
困難負例1.1%
無關0.8%
推薦閾值
FPR 0.1 · 0.714
FPR 0.01 · 0.836
FPR 0.001 · 0.877
FPR 0.0001 · 0.896
均衡 · 0.618
AUC
0.8308
噪聲上限
0.877
召回懸崖
0.516
測量樣本對
119 / 11k
向量分量help_outline
-0.19-0.020.15
σ 0.0221 · 487k 個數值
嵌入幾何help_outline
02048
各維度均值,懸停檢視區間
噪聲下限
0.496
有效維度
73 / 2048
維度截斷help_outline
12825651210242048
text-matching · 閾值隨所請求維度的變化
語言對help_outline
de-ruen-deen-koen-zhja-ko
各語言對之間的閾值跨度:0.069
選擇要比較的模型
論文 (2)
ICLR 2026
一月 22, 2026
Embedding Compression via Spherical Coordinates
EMNLP 2025
六月 24, 2025
jina-embeddings-v4: Universal Embeddings for Multimodal Multilingual Retrieval

概述

Jina Embeddings V4 是一款 38 億參數的多模態向量模型,可統一表示文本與圖像。它基於 Qwen2.5-VL-3B-Instruct 主幹網路構建,架構上同時支援單向量和遲交互式的多向量輸出,突破了傳統 CLIP 式雙編碼器模型的侷限。模型整合了三個面向特定任務的 LoRA 適配器(各 6000 萬參數),無需改動凍結的主幹網路權重,即可針對非對稱查詢-文件檢索、語義文本相似度和程式碼搜尋等不同場景最佳化效果。憑藉統一的處理路徑,它在表格、圖表、示意圖、螢幕截圖及圖文混排等視覺資訊豐富的內容上表現出色,顯著縮小了傳統架構中的模態鴻溝。該模型支援多語言,輸入文本最長 32,768 詞元,圖像可縮放至 2000 萬像素,適用於跨語言、跨領域的各類文件檢索與跨模態搜尋場景。

方法

Jina Embeddings V4 採用統一的多模態語言模型架構,與 CLIP 式雙編碼器方案截然不同。輸入走同一條通路:影象先經視覺編碼器轉成詞元序列,隨後文字與影象兩種模態一起送入帶上下文注意力層的語言模型解碼器處理。該架構提供兩種輸出模式以適配不同場景:單向量模式透過均值池化生成 2048 維向量,可藉助 Matryoshka 表示學習截斷至 128 維,適合高效的相似度檢索;多向量模式則透過投影層為每個詞元輸出 128 維向量,用於遲互動式檢索。模型包含三個面向特定任務的 LoRA 介面卡,分別做針對性最佳化:檢索介面卡採用基於字首的非對稱編碼,並用難負樣本訓練,服務於查詢-文件場景;文字匹配介面卡採用 CoSENT 損失處理語義相似度任務;程式碼介面卡則專攻自然語言到程式碼的檢索。訓練分兩個階段:先用來自 300 多個來源的文字-文字、文字-影象樣本對,以 InfoNCE 對比損失做配對訓練;再用三元組方法和為各領域定製的損失函式,對三個 LoRA 介面卡做任務專項微調。

效能

Jina Embeddings V4 在多類基準測試中都交出了極具競爭力的成績。視覺文件檢索方面,JinaVDR 平均分 72.19,ColPali-v1.2 為 64.50;ViDoRe 平均分 84.11,ColPali 為 83.90,多向量模式在 ViDoRe 上更是達到 90.17。跨模態檢索方面,CLIP Benchmark 得分 84.11,jina-clip-v2 為 81.12,nllb-clip-large-siglip 為 83.19。文字檢索方面,MTEB-en 得 55.97,MMTEB 得 66.49;長文件處理表現突出,LongEmbed 達 67.11,上一代僅 55.66。語義文字相似度表現紮實,英文 STS 任務得 85.89,多語言 STS 得 72.70。程式碼檢索在 CoIR 上達 71.59,不過 voyage-code-3(77.33)等專用模型在該領域得分更高。跨模態對齊度提升明顯,得分 0.71,而 OpenAI CLIP 僅為 0.15,有效緩解了多模態模型的模態鴻溝問題。在視覺資訊豐富的任務上,多向量模式始終優於單向量模式;常規檢索場景下,單向量模式則更為高效。

最佳實踐

要用好 Jina Embeddings V4,請根據實際需求選擇合適的 LoRA 適配器。查詢與文件結構不同的非對稱檢索場景請用「retrieval」適配器,並記得加上正確前綴以區分查詢和段落內容。「text-matching」適配器適合語義相似度任務和對稱檢索,也就是找相似內容而非回答問題的場景,如文件聚類、查重和內容推薦。程式設計相關場景請用「code」適配器,它針對自然語言到程式碼的檢索、程式碼到程式碼的相似檢索以及技術問答做了最佳化。輸出模式請按效能和效率需求來選:單向量適合高效相似度檢索和儲存受限的環境,維度可從 2048 截斷到 128 至 512,品質損失在可接受範圍內;多向量則為複雜檢索任務提供更高精度,尤其在處理視覺資訊豐富的文件時,遲交互評分能捕捉更細緻的關聯。統一架構讓它能直接處理圖文混合輸入,視覺文件無需另配編碼器或做 OCR 預處理。跨模態對齊能力和多語言支援,也讓它很適合國際化應用。生產部署規劃記憶體時,請把每個 LoRA 適配器 6000 萬參數的開銷計算在內;三個適配器同時常駐僅增加不到 2% 的記憶體佔用,推理時可靈活切換任務。
提及此模型的部落格
三月 11, 2026 • 7 分鐘閱讀
Bootstrapping Audio Embeddings from Multimodal LLMs
Turn any multimodal LLM into a small audio embedding model that beats CLAP with 25x less data.
Han Xiao
Abstract illustration of a sound wave or heartbeat, formed by blue, orange, and gray dots on a white background.
二月 19, 2026 • 7 分鐘閱讀
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
九月 09, 2025 • 11 分鐘閱讀
Multimodal Embeddings in Llama.cpp and GGUF
We brought multimodal embeddings to llama.cpp and GGUF, and uncovered a few surprising issues along the way.
Andrei Ungureanu
Alex C-G
Cartoon llama in the center of a white background, emitting laser-like beams from its eyes. The illustration creates a playfu
九月 04, 2025 • 6 分鐘閱讀
Jina Code Embeddings: SOTA Code Retrieval at 0.5B and 1.5B
Code generation LLMs → code embeddings: 0.5B/1.5B models achieve SOTA performance across 25 code retrieval benchmarks.
Jina AI
Green "Code Embeddings" text displayed in a LED dot style on a black background, evoking a futuristic and technological atmos
八月 13, 2025 • 15 分鐘閱讀
Optimizing GGUFs for Decoder-Only Embedding Models
4000 tokens/sec for a 3B-parameter embedding model on L4 GPU is probably as fast as you'll get with llama.cpp. Or is it?
Han Xiao
Text "DGUF for Embedding Models" written in yellow on a dark background, conveying a sleek, minimalistic, digital design.
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 徽標
open_in_new
下載 Elastic 徽標
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業人士使用。不面向任何消費者,也不鼓勵任何消費者使用。