Elastic
Jina AI
모델
API
keyboard_arrow_down
Reader
어떤 URL이든 Markdown으로 변환하여 LLM 그라운딩을 개선하세요.
Embeddings
멀티모달 및 다국어 임베딩.
Reranker
검색 관련성을 극대화하는 리랭커.
Elastic Inference Service
Jina 모델을 Elasticsearch에서 네이티브 방식으로 실행하세요.
MCP terminalCLIarticlellms.txtsmart_toy에이전트data_object스키마menu_book문서



로그인
login
warning
이 모델은 최신 모델로 대체되어 더 이상 권장되지 않습니다.
Embeddings
copyright CC BY-NC 4.0
open_in_new 릴리스 노트

jina-embeddings-v3

SOTA 성능을 갖춘 최첨단 다국어 벡터 모델
라이선스
copyright CC-BY-NC-4.0
출시일
calendar_month
2024-09-18
입력
abc
텍스트
arrow_forward
출력
more_horiz
벡터
Matryoshka 차원 help_outline
32
64
128
256
512
768
1024
Late Chunking help_outline
check_circle
Yes
모델 세부정보
매개변수: 570M
입력 토큰 길이: 8K
출력 크기: 1024
기본 모델 help_outline
open_in_new
XLM-RoBERTa Large
훈련된 언어 help_outline
32 언어
지원되는 언어 help_outline
108 언어
관련 모델
link
jina-embeddings-v2-base-en
link
jina-embeddings-v2-base-zh
link
jina-embeddings-v2-base-de
link
jina-embeddings-v2-base-es
link
jina-embeddings-v2-base-code
지원되는 작업
search 검색
compare_arrows 텍스트 일치
call_split 분리
label 분류
다음을 통해 이용 가능
Elastic Inference Service
Jina API
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
망분리
I/O 다이어그램

텍스트

jina-embeddings-v3

작업

벡터

값 분포help_outline
AUC 0.8525
코퍼스
번역 쌍
문서 검색
코드
태스크
default
classification
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
separation
text-matching
0.7410.200.400.600.80
관련21.8%
하드 네거티브3.0%
무관1.0%
차트에 마우스를 올리거나 클릭하면 컷오프가 이동합니다
권장 컷오프
FPR 0.1 · 0.618
FPR 0.01 · 0.741
FPR 0.001 · 0.797
FPR 0.0001 · 0.824
균형 · 0.597
AUC
0.8525
노이즈 상한
0.791
재현율 절벽
0.385
측정 쌍 수
119 / 11k
벡터 성분help_outline
-0.25-0.010.23
σ 0.0312 · 244k 개 값
임베딩 기하 구조help_outline
01024
차원별 평균, 마우스를 올리면 범위 표시
노이즈 하한
0.496
유효 차원
54 / 1024
차원 절단help_outline
32641282565121024
classification · 요청 차원 수에 따른 컷오프
언어 쌍help_outline
de-ruen-deen-koen-zhja-ko
쌍 간 컷오프 편차: 0.072
비교할 모델을 선택하세요
논문 (4)
ICLR 2026
1월 22, 2026
Embedding Compression via Spherical Coordinates
ACL 2025
12월 17, 2024
AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark
ECIR 2025
9월 18, 2024
jina-embeddings-v3: Multilingual Embeddings With Task LoRA
SIGIR 2025
9월 07, 2024
Late Chunking: Contextual Chunk Embeddings Using Long-Context Embedding Models

개요

Jina Embeddings v3는 조직이 언어 간 텍스트 이해 및 검색을 처리하는 방식을 바꾸는 획기적인 다국어 텍스트 임베딩 모델입니다. 본질적으로 이는 컴퓨팅 요구 사항을 관리 가능한 수준으로 유지하면서 여러 언어와 작업 전반에 걸쳐 고성능을 유지해야 하는 주요 과제를 해결합니다. 이 모델은 효율성이 중요한 프로덕션 환경에서 특히 탁월합니다. 단 5억 7천만 개의 매개변수만으로 최첨단 성능을 달성하므로 더 큰 모델의 계산 오버헤드를 감당할 수 없는 팀도 활용할 수 있습니다. 확장 가능한 다국어 검색 시스템을 구축하거나 언어 장벽을 넘어 콘텐츠를 분석해야 하는 조직에 특히 유용합니다.

방법

모델의 아키텍처는 24개 계층의 jina-XLM-RoBERTa를 기반으로 구축되고 작업별 LoRA(낮은 순위 적응형) 어댑터로 향상된 벡터 기술의 주요 혁신을 나타냅니다. LoRA 어댑터는 매개변수 수를 크게 늘리지 않고 검색, 분류 또는 클러스터링과 같은 다양한 작업에 대해 모델을 최적화하는 특수 신경망 구성 요소입니다. 전체 매개변수는 3% 미만으로 증가합니다. 이 모델은 Matryoshka Representation Learning(MRL)을 통합하여 성능을 유지하면서 벡터를 1024차원에서 32차원으로 유연하게 줄일 수 있습니다. 훈련에는 89개 언어의 다국어 텍스트에 대한 초기 사전 훈련, 벡터 품질 개선을 위한 쌍으로 된 텍스트의 미세 조정, 작업 최적화를 위한 특수 어댑터 훈련의 세 단계가 포함됩니다. 이 모델은 RoPE(회전 위치 벡터)를 통해 최대 8,192개의 토큰까지 컨텍스트 길이를 지원하고 혁신적인 기본 주파수 조정 기술을 사용하여 짧은 텍스트와 긴 텍스트 모두의 성능을 향상시킵니다.

성능

이 모델은 실제 테스트에서 뛰어난 효율성 대 성능 비율을 보여주었으며, 영어 작업에서 오픈 소스 대안과 OpenAI 및 Cohere의 독점 솔루션을 모두 능가하는 동시에 다국어 시나리오에서도 좋은 성능을 보였습니다. 가장 놀라운 점은 매개변수가 12배 더 많은 e5-mistral-7b-instruct보다 더 나은 결과를 달성하여 뛰어난 효율성을 보여준다는 것입니다. MTEB 벤치마크 평가에서는 전 태스크 평균 65.52점을 달성했으며, 특히 분류 정확도(82.58)와 문장 유사성(85.80)에서 좋은 성적을 거두었습니다. 이 모델은 언어 전반에 걸쳐 일관된 성능을 유지하며 다국어 작업에서 64.44점을 받았습니다. 차원 축소를 위해 MRL을 사용하면 낮은 차원에서도 강력한 성능이 유지됩니다. 예를 들어 64차원은 전체 1024차원에 비해 92%의 검색 성능을 유지합니다.

모범 사례

Jina Embeddings v3를 효과적으로 배포하려면 각 팀은 특정 사용 사례를 고려하여 적절한 작업 어댑터를 선택해야 합니다. 검색 애플리케이션에는 retrieval.query와 retrieval.passage를, 클러스터링 작업에는 separation을, 분류 작업에는 classification을, 의미적 유사성에는 text-matching을 사용합니다. 이 모델은 최상의 성능을 위해 CUDA 지원 하드웨어가 필요하지만, 효율적인 아키텍처 덕분에 대규모 대안보다 훨씬 적은 GPU 메모리를 사용합니다. 프로덕션 배포 시 AWS SageMaker 통합을 통해 확장성을 간소화할 수 있습니다. 이 모델은 다국어 애플리케이션에서는 우수한 성능을 보이지만, 리소스가 부족한 언어의 경우 추가 평가가 필요할 수 있습니다. 최대 8,192개 토큰의 긴 문서를 지원하지만, 매우 긴 텍스트의 경우 late chunking 기능을 사용할 때 최상의 성능을 얻을 수 있습니다. 실시간 생성이나 복잡한 추론이 필요한 작업에는 이 모델을 사용하지 않는 것이 좋습니다. 이 모델은 임베딩 및 검색을 위해 설계되었으며, 텍스트 생성이나 직접적인 질의응답에는 적합하지 않습니다.
이 모델을 언급하는 블로그
9월 18, 2024 • 10 분 소요
Jina Embeddings v3: 첨단 다국어 임베딩 모델
jina-embeddings-v3는 570M 파라미터와 8192 토큰 길이를 가진 최첨단 다국어 텍스트 임베딩 모델로, MTEB에서 OpenAI와 Cohere의 최신 독점 임베딩보다 뛰어난 성능을 보입니다.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
9월 27, 2024 • 15 분 소요
Jina Embeddings v2에서 v3로의 마이그레이션
Jina Embeddings v2에서 v3로 마이그레이션하는 데 도움이 될 만한 팁들을 모아보았습니다.
Alex C-G
Scott Martens
A digital upgrade theme with "V3" and a white "2", set against a green and black binary code background, with "Upgrade" centr
5월 12, 2026 • 7 분 소요
jina-embeddings-v5-omni: 텍스트, 이미지, 오디오 및 비디오를 위한 벡터 모델(Embeddings)
하나의 모델, 네 가지 모달리티: 텍스트, 이미지, 오디오, 비디오. 1.6B 및 0.9B 크기의 동급 최강 옴니 向量模型(Embeddings).
Han Xiao
2월 19, 2026 • 7 분 소요
jina-embeddings-v5-text: 새로운 SOTA 소형 다국어 임베딩(Embeddings)
최고 수준의 성능을 자랑하는 1B 미만의 다국어 向量模型 두 가지가 Elastic Inference Service, Llama.cpp 및 MLX에서 제공됩니다.
Han Xiao
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
6월 30, 2025 • 8 분 소요
jina-embeddings-v4의 양자화 인식 훈련
양자화는 더 작은 向量模型 (Embeddings)을 제공합니다. 미세 조정된 양자화가 손실 없는 向量模型 (Embeddings)을 제공한다는 것을 보여드리겠습니다.
Andrei Ungureanu
Scott Martens
Bo Wang
Retro-style digital screen displaying four pixelated images: a cat, a woman, an abstract figure, and a man's portrait, with l
현재 언어 / 테마
Search Foundation
Reader
Embeddings
Reranker
Jina API 키 받기
속도 제한
회사 소개
소식
Jina 로고 다운로드
open_in_new
Elastic 로고 다운로드
open_in_new
API 상태
Elastic © 2026.보안이용약관개인정보 보호쿠키 관리제 개인 정보를 판매하거나 공유하지 마세요.
본 웹사이트 및 관련 콘텐츠, 소프트웨어, 제품, 서비스는 전문가용으로만 제작되었습니다. 일반 소비자를 위한 것이 아니며, 소비자의 사용을 권장하지 않습니다.