Embeddings
검색, RAG, 에이전트 애플리케이션을 위한 최고 성능의 멀티모달·다국어·롱컨텍스트 임베딩입니다.
벡터 모델 API
검색 및 RAG 시스템을 개선하려면 저희 임베딩 모델을 사용해 보세요. 무료 체험으로 시작하세요!
chevron_leftchevron_right
curl "https://api.jina.ai/v1/embeddings" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{
"model": null,
"normalized": true,
"embedding_type": "float",
"input": [
text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.",
text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.",
text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.",
text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。",
text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。"
+ 입력을 추가하세요
]
}
EOFEOFkey
API 키
visibility_off
사용 가능한 토큰
0
v5-omni: 모든 양식을 포괄하는 벡터입니다.
텍스트, 이미지, 오디오, 비디오 등 모든 데이터가 하나의 공유 임베딩 공간을 사용하며, 두 가지 크기로 제공됩니다. v5-omni-small(16억)은 파라미터 20억 개 미만 중 가장 우수한 성능의 오픈 웨이트 옴니 모델입니다. v5-omni-nano(9억)는 10억 개 미만의 파라미터로도 경쟁력 있는 검색 성능을 제공합니다. 두 모델 모두 v5-text와 바이트 단위로 호환되므로 재인덱싱이 필요하지 않습니다.
v5-text: 최신이자 가장 진보된 소규모 다국어 벡터 모델
jina-embeddings-v5-text는 두 가지 효율적인 크기(677M 소형 모델 및 239M 나노스케일 모델)로 5세대 벡터 품질을 제공하며, 작업별 LoRA 어댑터, 마트료시카 차원, 32K 컨텍스트 및 엣지 배포를 위한 GGUF/MLX 양자화를 통해 MMTEB, MTEB 영어 및 검색 작업에서 새로운 벤치마크를 설정합니다.
구매 방법 두 가지
저희 API를 구독하시거나 클라우드 서비스 제공업체를 통해 구매하세요.
radio_button_unchecked
cloud
3 클라우드 서비스 제공업체와 협력
AWS 또는 Azure를 사용하고 계신가요? 저희 모델을 회사의 클라우드 플랫폼에 직접 배포하고 CSP 계정을 통해 비용을 청구할 수 있습니다.
온프레미스 배포
AWS Sagemaker 및 Microsoft Azure와 곧 Google Cloud Services에 Jina Embeddings 모델을 배포하거나 영업팀에 문의하여 가상 프라이빗 클라우드 및 온프레미스 서버에 대한 맞춤형 Kubernetes 배포를 받으세요.
API 통합
당사의 Embedding API는 다양한 유명 데이터베이스, 벡터 스토어, RAG 및 LLMOps 프레임워크와 기본적으로 통합되어 있습니다. 시작하려면 나열된 통합 중 하나에 API 키를 복사하여 붙여넣기만 하면 빠르고 원활하게 사용할 수 있습니다.
벡터 스토어
LLMOps
RAG
관찰 가능성
MongoDB
DataStax
Qdrant
Pinecone
Chroma
Weaviate
Milvus
Epsilla
MyScale
LlamaIndex
Haystack
Langchain
Dify
SuperDuperDB
DashVector
Portkey
Baseten
TiDB
LanceDB
Carbon
우리의 논문
최첨단 검색 모델이 어떻게 처음부터 학습되는지 알아보고 최신 논문도 확인해 보세요. EMNLP, SIGIR, ICLR, NeurIPS, ICML의 저희 팀을 만나보세요!
7월 20, 2026
SIGIR 2026
5월 11, 2026
SIGIR 2026
2월 17, 2026
ICLR 2026
1월 22, 2026
12월 29, 2025
ICLR 2026
12월 04, 2025
AAAI 2026
10월 01, 2025
NeurIPS 2025
8월 31, 2025
EMNLP 2025
6월 24, 2025
ICLR 2025
3월 04, 2025
ACL 2025
12월 17, 2024
ICLR 2025
12월 12, 2024
ECIR 2025
9월 18, 2024
SIGIR 2025
9월 07, 2024
EMNLP 2024
8월 30, 2024
WWW 2025
6월 21, 2024
ICML 2024
5월 30, 2024
2월 26, 2024
10월 30, 2023
EMNLP 2023
7월 20, 2023
총 20개의 논문.
벡터 모델 학습
벡터란 무엇이며 벡터화해야 하는 이유는 무엇입니까? 시작하는 데 도움이 되는 몇 가지 기사가 있습니다. 당사의 종합 가이드를 통해 벡터 모델에 대해 처음부터 자세히 알아보세요.
벡터 모델의 진화 포스터
1950년 이후 텍스트 벡터 모델의 진화를 담은 매혹적인 인포그래픽과 인상적인 비주얼로, 당신의 공간에 어울리는 완벽한 포스터를 찾아보세요.
Jina 임베딩 모델은 어떻게 학습되었나요?
keyboard_arrow_down
귀하의 멀티모달 벡터 모델은 무엇입니까?
keyboard_arrow_down
귀하의 모델은 어떤 언어를 지원합니까?
keyboard_arrow_down
단일 문장 입력의 최대 길이는 얼마입니까?
keyboard_arrow_down
단일 요청에 몇 개의 문장을 포함할 수 있나요?
keyboard_arrow_down
멀티모달 임베딩 모델에 이미지를 어떻게 전송하나요?
keyboard_arrow_down
Jina Embeddings 모델은 OpenAI 및 Cohere의 최신 벡터 모델과 어떻게 비교됩니까?
keyboard_arrow_down
OpenAI의 text-embedding-3-large에서 Jina Embeddings 모델로 마이그레이션하는 방법은 무엇입니까?
keyboard_arrow_down
jina-clip 및 jina-embeddings 모델을 사용할 때 토큰은 어떻게 계산되나요?
keyboard_arrow_down
이미지나 오디오를 임베딩하는 모델을 제공하나요?
keyboard_arrow_down
개인 또는 회사 데이터를 사용하여 Jina 벡터 모델 모델을 미세 조정할 수 있습니까?
keyboard_arrow_down
귀하의 서비스를 AWS, Azure 또는 GCP에 비공개로 배포할 수 있나요?
keyboard_arrow_down
'task' 매개변수란 무엇이며 언제 사용해야 하나요?
keyboard_arrow_down
지연 상호작용(late-interaction) 검색이란 무엇이며 어떤 모델이 지원하나요?
keyboard_arrow_down
지연 청킹이란 무엇인가요? 어떤 상황에서 사용해야 하나요?
keyboard_arrow_down
API에서 지원하는 컨텍스트 길이가 모델의 최대 용량과 다른 이유는 무엇입니까?
keyboard_arrow_down
jina-embeddings-v4는 무료인데 왜 이렇게 느린가요?
keyboard_arrow_down
임베딩 API의 사용량 제한은 얼마인가요?
keyboard_arrow_down
각 임베딩 모델의 컨텍스트 길이 제한은 얼마인가요?
keyboard_arrow_down
이미지 및 PDF 파일의 크기 제한은 어떻게 되나요?
keyboard_arrow_down
속도 제한
속도 제한은 세 가지 방식으로 추적됩니다. RPM(분당 요청 수)과 TPM(분당 토큰 수)입니다. 제한은 IP/API 키별로 적용되며 RPM 또는 TPM 임계값 중 먼저 도달하는 쪽에서 트리거됩니다. 요청 헤더에 API 키를 제공하면 IP 주소 대신 키별로 속도 제한을 추적합니다.
Columns
arrow_drop_down
| 제품 | API 엔드포인트 | 설명arrow_upward | API 키 없음key_off | 무료 API 키 사용 시key | 유료 API 키 사용 시key | 프리미엄 API 키 사용 시key | 평균 지연 | 토큰 사용량 계산 | 허용 요청 | |
|---|---|---|---|---|---|---|---|---|---|---|
| Reader API | https://r.jina.ai | URL을 LLM 친화적인 텍스트로 변환 | 20 RPM | 500 RPM | 500 RPM | trending_up5000 RPM | 7.9s | 출력 응답의 토큰 수를 기준으로 합니다. | GET/POST | |
| Reader API | https://s.jina.ai | 웹을 검색하고 결과를 LLM 친화적인 텍스트로 변환합니다. | block | 100 RPM | 100 RPM | trending_up1000 RPM | 2.5s | 각 요청에는 10000개의 토큰으로 시작하는 고정된 수의 토큰이 필요합니다. | GET/POST | |
| Reranker API | https://api.jina.ai/v1/rerank | 쿼리 기준으로 문서 순위 매기기 | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart 입력 크기에 따라 다름 help | 입력 요청의 토큰 수를 기준으로 합니다. | POST | |
| 벡터 모델 API | https://api.jina.ai/v1/embeddings | 텍스트/이미지를 고정 길이 벡터로 변환 | block | 100 RPM & 100,000 TPM | 500 RPM & 2,000,000 TPM | trending_up5,000 RPM & 50,000,000 TPM | ssid_chart 입력 크기에 따라 다름 help | 입력 요청의 토큰 수를 기준으로 합니다. | POST | |
| Classifier API | https://api.jina.ai/v1/train | 훈련 샘플을 사용하여 분류기 훈련 | block | 25 RPM & 25,000 TPM | 125 RPM & 500,000 TPM | 1,250 RPM & 12,000,000 TPM | ssid_chart 입력 크기에 따라 다름 | 토큰 계산 방식: input_tokens × num_iters | POST | |
| Classifier API (제로샷) | https://api.jina.ai/v1/classify | 제로샷 분류를 사용하여 입력 분류 | block | 25 RPM & 25,000 TPM | 125 RPM & 500,000 TPM | 1,250 RPM & 12,000,000 TPM | ssid_chart 입력 크기에 따라 다름 | 토큰 계산 방식: input_tokens + label_tokens | POST | |
| Classifier API (퓨샷) | https://api.jina.ai/v1/classify | 훈련된 퓨샷 분류기를 사용하여 입력을 분류합니다. | block | 25 RPM & 25,000 TPM | 125 RPM & 500,000 TPM | 1,250 RPM & 12,000,000 TPM | ssid_chart 입력 크기에 따라 다름 | 토큰 계산 방식: input_tokens | POST | |
| Segmenter API | https://api.jina.ai/v1/segment | 긴 텍스트를 단어와 문장으로 분할 | 20 RPM | 200 RPM | 200 RPM | 1,000 RPM | 0.3s | 토큰 사용은 계산되지 않습니다. | GET/POST | |
| DeepSearch | https://deepsearch.jina.ai/v1/chat/completions | 추론하고, 검색하고, 반복하여 최상의 답을 찾으세요 | block | 50 RPM | 50 RPM | 500 RPM | 56.7s | 전체 프로세스에서 총 토큰 수를 계산합니다. | POST |
CC BY-NC 라이센스 자가 점검
play_arrow
Azure, AWS 또는 GCP에서 당사의 공식 API 또는 공식 이미지를 사용하고 계십니까?
play_arrow
예
play_arrow
아니요
API 관련 FAQ
code
Reader, Embedding, Reranker, Classifier 및 Fine-Tuned Model API에 동일한 API 키를 사용할 수 있습니까?
keyboard_arrow_down
code
API 키의 토큰 사용량을 볼 수 있나요?
keyboard_arrow_down
code
API 키를 잊어버린 경우 어떻게 해야 합니까?
keyboard_arrow_down
code
API 키가 만료되나요?
keyboard_arrow_down
code
API 키 간에 토큰 잔액을 전송할 수 있나요?
keyboard_arrow_down
code
내 API 키를 파기할 수 있나요?
keyboard_arrow_down
code
일부 모델을 처음 요청할 때 속도가 느린 이유는 무엇입니까?
keyboard_arrow_down
code
제 API 데이터가 모델 학습에 사용되나요?
keyboard_arrow_down
code
Jina API의 사용량 제한은 얼마인가요?
keyboard_arrow_down
code
API에 배치 크기 제한이 있나요?
keyboard_arrow_down
청구 관련 자주 묻는 질문
attach_money
API 요금은 문장 수나 요청 수에 따라 청구되나요?
keyboard_arrow_down
attach_money
신규 사용자가 무료 평가판을 받을 수 있나요?
keyboard_arrow_down
attach_money
실패한 요청에 대해 토큰이 차감되나요?
keyboard_arrow_down
attach_money
어떤 결제 방법이 허용되나요?
keyboard_arrow_down
attach_money
토큰 구매 시 송장을 발행받을 수 있나요?
keyboard_arrow_down


























