Elastic
Jina AI
모델
API
keyboard_arrow_down
Reader
어떤 URL이든 Markdown으로 변환하여 LLM 그라운딩을 개선하세요.
Embeddings
멀티모달 및 다국어 임베딩.
Reranker
검색 관련성을 극대화하는 리랭커.
MCP
terminal
CLI
article
llms.txt
smart_toy
에이전트
data_object
스키마
menu_book
문서
로그인
login
Embeddings
copyright CC BY-NC 4.0
open_in_new 릴리스 노트

jina-embeddings-v5-text-nano

엣지 배포를 위한 최첨단 다국어 벡터
라이선스
copyright CC-BY-NC-4.0
출시일
calendar_month
2026-02-18
입력
abc
텍스트
arrow_forward
출력
more_horiz
벡터
Matryoshka 차원 help_outline
32
64
128
256
512
768
모델 세부정보
매개변수: 239M
입력 토큰 길이: 8K
출력 크기: 768
기본 모델 help_outline
open_in_new
EuroBERT-210M
훈련된 언어 help_outline
32 언어
지원되는 언어 help_outline
108 언어
양자화 help_outline
GGUF
Apple Silicon 지원 help_outline
MLX
관련 모델
link
jina-embeddings-v3
link
jina-embeddings-v5-text-small
지원되는 작업
search 검색
compare_arrows 텍스트 일치
bubble_chart 클러스터링
label 분류
다음을 통해 이용 가능
Elastic Inference Service
Jina API
AWS SageMaker
Hugging Face
망분리
I/O 다이어그램

텍스트

jina-embeddings-v5-text-nano

작업

벡터

파레토 프론트help_outline
MMTEB
MIRACL
RTEB public
LongEmbed
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B30B20406080all-MiniLM-L12-v2all-mpnet-base-v2bge-m3e5-basee5-smalle5-small-v2EmbeddingGemma-300Mgranite-embedding-278m-…granite-embedding-311m-…granite-embedding-engli…granite-embedding-small…GritLM-7BGritLM-8x7Bgte-basegte-Qwen2-1.5B-instructgte-Qwen2-7B-instructgte-smallinf-retriever-v1jasper_en_vision_langua…jina-embeddings-v2-base…jina-embeddings-v3jina-embeddings-v4jina-embeddings-v5-text…LaBSELLM2Vec-Mistral-7B-Inst…multilingual-e5-largenomic-embed-text-v1nomic-embed-text-v1.5NV-Embed-v1NV-Embed-v2Qwen3-Embedding-4BSFR-Embedding-Mistralsnowflake-arctic-embed-…snowflake-arctic-embed-…snowflake-arctic-embed-…stella_en_1.5B_v5voyage-4-nano파라미터 수(로그)nDCG@10
이 모델
프론트에 있음
Jina AI
기타
LongEmbed
63.65
파라미터
212M
점수 순위
14 / 69
파레토 프론트
프론트 아래
값 분포help_outline
AUC 0.8242
코퍼스
번역 쌍
문서 검색
코드
이미지 / 배너
이미지 / 로고
태스크
classification
clustering
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.7930.400.500.600.700.80
관련20.2%
하드 네거티브1.7%
무관1.1%
권장 컷오프
FPR 0.1 · 0.722
FPR 0.01 · 0.793
FPR 0.001 · 0.841
FPR 0.0001 · 0.865
균형 · 0.678
AUC
0.8242
노이즈 상한
0.840
재현율 절벽
0.557
측정 쌍 수
119 / 11k
벡터 성분help_outline
-0.180.000.19
σ 0.0361 · 183k 개 값
임베딩 기하 구조help_outline
0768
차원별 평균, 마우스를 올리면 범위 표시
노이즈 하한
0.288
유효 차원
69 / 768
차원 절단help_outline
3264128256512768
text-matching · 요청 차원 수에 따른 컷오프
언어 쌍help_outline
de-ruen-deen-koen-zhja-ko
쌍 간 컷오프 편차: 0.027
비교할 모델을 선택하세요
논문 (1)
SIGIR 2026
2월 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation

개요

jina-embeddings-v5-text-nano는 EuroBERT-210M 백본을 기반으로 구축된 2억 3,900만 파라미터의 다국어 텍스트 임베딩 모델입니다. EuroBERT-210M은 15개의 주요 유럽 및 세계 언어로 사전 학습된 양방향 인코더입니다. 이 모델은 last-token 풀링을 통해 768차원 임베딩을 생성하며 최대 32K 토큰의 컨텍스트 길이를 지원합니다. 또한 검색, 의미 유사도, 클러스터링, 분류를 위한 네 가지 작업별 LoRA 어댑터(각각 670만 파라미터)를 포함합니다. Matryoshka 표현 학습을 통해 임베딩을 최소 32차원까지 잘라낼 수 있습니다. Qwen3-Embedding-4B로부터의 임베딩 증류 후 작업별 어댑터 학습을 거쳐 훈련된 이 모델은 크기가 두 배 이상인 모델과 견줄 만한 성능을 달성하므로, 지연 시간에 민감한 환경과 엣지 배포에 적합합니다.

방법

학습은 jina-embeddings-v5-text-small과 동일한 2단계 과정을 따르되 EuroBERT-210M 백본에 적용됩니다. 1단계 임베딩 증류는 학생의 768차원 임베딩을 교사의 공간으로 매핑하는 선형 투영 레이어와 코사인 거리 손실을 사용하여 Qwen3-Embedding-4B로부터 지식을 전이합니다. 학습에는 300개 이상의 데이터셋에서 가져온 다양한 다국어 텍스트 쌍을 사용합니다. 2단계에서는 고정된 백본 가중치 위에서 네 가지 작업별 LoRA 어댑터(각각 670만 파라미터)를 학습합니다. 검색(InfoNCE + 증류 + GOR), 텍스트 매칭(CoSENT + 증류), 클러스터링(작업별 교사 지시문을 사용한 재증류), 분류(양방향 InfoNCE + 관계형 지식 증류)입니다. EuroBERT 백본은 영어, 프랑스어, 독일어, 스페인어, 중국어, 일본어, 아랍어, 힌디어를 포함한 15개 주요 유럽 및 세계 언어에 대한 강력한 다국어 커버리지를 제공합니다.

성능

MMTEB(다국어)에서 jina-embeddings-v5-text-nano는 단 2억 3,900만 매개변수로 작업 수준 평균 65.5, 유형 수준 평균 57.7을 달성하여 KaLM-mini-v2.5(60.1, 4억 9,400만 매개변수), voyage-4-nano(58.9, 4억 8,000만 매개변수), Gemma-300M(61.1, 3억 800만 매개변수)을 포함한 5억 미만 매개변수의 모든 모델을 능가했습니다. 분류 69.2, 클러스터링 52.7, 쌍 분류 81.9, 재순위화 64.6, 검색 63.3, STS 78.2를 기록했습니다. 영어 MTEB에서는 평균 71.0을 달성하여 훨씬 큰 jina-embeddings-v5-text-small(71.7)에 거의 근접했습니다. 검색 벤치마크에서는 MTEB-M 63.26, RTEB 64.08, BEIR 56.06, LongEmbed 63.65를 기록했습니다. 임베딩은 이진 양자화에서도 견고함을 유지하며, GOR 정규화가 MTEB 검색의 성능 저하를 2점 미만으로 제한합니다.

모범 사례

작업에 따라 적절한 LoRA 어댑터를 선택하십시오. 비대칭 쿼리-문서 검색에는 'retrieval' 어댑터(쿼리 앞에 'Query:', 단락 앞에 'Document:' 추가), 대칭 유사도 작업에는 'text-matching' 어댑터(두 입력 모두에 'Document:' 접두사 추가), 관련 문서 그룹화에는 'clustering' 어댑터, 분류 작업에는 'classification' 어댑터를 사용하십시오. 이 나노모델은 지연 시간에 민감하고 리소스가 제한된 환경에 최적화되어 있으며, 크기가 두 배 이상인 모델과 유사한 정확도를 유지합니다. 마트료시카 절단법을 통해 임베딩 차원을 768에서 32까지 줄일 수 있지만, 최상의 결과를 얻으려면 차원을 256 이상으로 유지하십시오. 이진 양자화가 지원됩니다. EuroBERT 백본은 영어, 프랑스어, 독일어, 스페인어, 중국어, 일본어, 아랍어, 힌디어 등 15개 주요 언어에 대한 강력한 지원을 제공합니다. 임베딩 비교는 코사인 유사도를 사용하여 수행됩니다. 이는 Jina AI API, Hugging Face(Sentence Transformers 및 vLLM), 그리고 llama.cpp의 양자화 변형을 통해 얻을 수 있습니다.
이 모델을 언급하는 블로그
5월 12, 2026 • 7 분 소요
jina-embeddings-v5-omni: Embeddings for Text, Image, Audio and Video
One model, four modalities: text, image, audio, video. Best-in-class omni embeddings in 1.6B and 0.9B.
Han Xiao
3월 06, 2026 • 6 분 소요
Identifying Embedding Models from Raw Numerical Values
A tiny transformer that fingerprints embedding models by reading raw numerical digits. No feature engineering.
Han Xiao
Fingerprint illustration made from numbers, showcasing digital and high-tech design on a light background.
2월 19, 2026 • 7 분 소요
jina-embeddings-v5-text: New SOTA Small Multilingual Embeddings
Two sub-1B multilingual embeddings with best-in-class performance, available on Elastic Inference Service, Llama.cpp and MLX.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
현재 언어 / 테마
Search Foundation
Reader
Embeddings
Reranker
Jina API 키 받기
속도 제한
회사 소개
소식
Jina 로고 다운로드
open_in_new
Elastic 로고 다운로드
open_in_new
API 상태
Elastic © 2026.보안이용약관개인정보 보호쿠키 관리제 개인 정보를 판매하거나 공유하지 마세요.
본 웹사이트 및 관련 콘텐츠, 소프트웨어, 제품, 서비스는 전문가용으로만 제작되었습니다. 일반 소비자를 위한 것이 아니며, 소비자의 사용을 권장하지 않습니다.