Elastic
Jina AI
모델
API
keyboard_arrow_down
Reader
어떤 URL이든 Markdown으로 변환하여 LLM 그라운딩을 개선하세요.
Embeddings
멀티모달 및 다국어 임베딩.
Reranker
검색 관련성을 극대화하는 리랭커.
MCP
terminal
CLI
article
llms.txt
smart_toy
에이전트
data_object
스키마
menu_book
문서
로그인
login

영업팀에 문의

Jina AI와 함께 비즈니스를 성장시키세요.

nights_stay 영업팀이 잠시 자리를 비우었습니다. 53시간 후에 돌아옵니다.

구매 방법 두 가지

저희 API를 구독하시거나 클라우드 서비스 제공업체를 통해 구매하세요.
radio_button_unchecked
cloud
3 클라우드 서비스 제공업체와 협력
AWS 또는 Azure를 사용하고 계신가요? 저희 모델을 회사의 클라우드 플랫폼에 직접 배포하고 CSP 계정을 통해 비용을 청구할 수 있습니다.
AWS SageMaker
Embeddings
Reranker
Microsoft Azure
Embeddings
Reranker
Google Cloud
Embeddings
radio_button_checked
Jina Search Foundation API 사용
당사의 모든 제품에 접근할 수 있는 가장 쉬운 방법입니다. 언제든지 토큰을 재충전하세요.
더 많은 토큰으로 이 API 키를 충전하세요
위치에 따라 미국 달러, 유로 또는 기타 통화로 요금이 청구될 수 있습니다. 세금이 적용될 수 있습니다.
재충전하려면 올바른 API 키를 입력하세요.
속도 제한 이해하기
속도 제한은 IP 주소/API 키당 1분 동안 API에 보낼 수 있는 최대 요청 수(RPM)입니다. 아래에서 각 제품과 등급의 속도 제한에 대해 자세히 알아보세요.
keyboard_arrow_down
속도 제한
속도 제한은 두 가지 방식으로 추적됩니다. RPM(분당 요청 수)과 TPM(분당 토큰 수)입니다. 제한은 IP/API 키별로 적용되며 RPM 또는 TPM 임계값 중 먼저 도달하는 쪽에서 트리거됩니다. 요청 헤더에 API 키를 제공하면 IP 주소 대신 키별로 속도 제한을 추적합니다.
제품API 엔드포인트설명arrow_upwardAPI 키 없음key_off무료 API 키 사용 시key유료 API 키 사용 시key프리미엄 API 키 사용 시key평균 지연토큰 사용량 계산허용 요청
Reader APIhttps://r.jina.aiURL을 LLM 친화적인 텍스트로 변환20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s출력 응답의 토큰 수를 기준으로 합니다.GET/POST
Reader APIhttps://s.jina.ai웹 검색 후 결과를 LLM 친화적인 텍스트로 변환block100 RPM100 RPMtrending_up1000 RPM2.5s각 요청에는 10000개의 토큰으로 시작하는 고정된 수의 토큰이 필요합니다.GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank쿼리 기준으로 문서 순위 매기기block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
입력 크기에 따라 다름
help
입력 요청의 토큰 수를 기준으로 합니다.POST
벡터 모델 APIhttps://api.jina.ai/v1/embeddings텍스트/이미지를 고정 길이 벡터로 변환block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
입력 크기에 따라 다름
help
입력 요청의 토큰 수를 기준으로 합니다.POST

자주 묻는 질문

Jina AI × Elastic

handshake
Jina 브랜드는 유지되나요?
keyboard_arrow_down
네. 지나(Jina)는 엘라스틱(Elastic) 산하의 모델 브랜드입니다. 알리바바의 큐웬(Qwen), 오픈에이지(OpenAI)의 GPT, 문샷(Moonshot)의 키미(Kimi)와 같은 관계라고 생각하시면 됩니다. 지나의 법적 지위가 엘라스틱으로 이전됨으로써, 지나 AI는 브랜드로서 검색 기반 모델 개발에 전적으로 집중할 수 있게 되었습니다.
handshake
Jina AI는 앞으로 어떤 분야에 집중할 계획인가요?
keyboard_arrow_down
저희는 임베딩, 리랭커, 그리고 멀티모달 및 Reader 모델을 포함한 소형 모델을 제공하여 검색 환경을 최적화합니다. 저희의 목표는 아직 완성된 것은 아니지만, 검색 모델 분야의 선두 주자가 되는 것은 변함없이 확고합니다.
handshake
API 및 클라우드 마켓플레이스 서비스는 계속해서 출시될까요?
keyboard_arrow_down
네. Reader API, Embeddings API, Reranker API는 현재 개발 및 유지 관리 중이며, 모델은 클라우드 마켓플레이스 플랫폼에 지속적으로 출시되고 있습니다. 이전과 마찬가지로 API 서비스를 이용하실 수 있습니다. 다만, 미국 수출 통제 대상 국가 또는 단체에는 서비스를 제공할 수 없습니다.
handshake
Hugging Face에 오픈 웨이트 모델을 계속 공개하실 건가요?
keyboard_arrow_down
네. 엘라스틱에서 Jina는 검색 기반 모델의 한계를 끊임없이 확장하고 있으며, 저희는 또한 개방형 가중치 모델을 꾸준히 출시하고 있습니다.
handshake
이러한 오픈 모델은 어떤 라이선스로 배포되나요?
keyboard_arrow_down
현재 대부분의 모델은 CC-BY-NC 4.0 라이선스를 사용하고 있으며, 앞으로도 계속 사용될 예정입니다. 이전 버전인 v1 및 v2 모델은 Apache-2.0 라이선스를 사용했으며 상업적 용도로 사용 가능했습니다. 그러나 jina-embeddings-v4는 기본 모델에 사용된 것과 동일한 Qwen Research License를 사용합니다. 이 라이선스는 상업적 사용을 전면 금지하며, 어떠한 상업용 라이선스에도 포함되지 않습니다. 모델에 적용되는 라이선스는 모델의 생성 버전이 아닌 Hugging Face 페이지에서 확인해야 합니다. CC-BY-NC 4.0 라이선스 하에서는 가중치를 다운로드, 평가, 벤치마킹 및 연구 목적으로 사용할 수 있습니다(출처를 명시해야 함). 상업용 제품에서 사용하려면 Elastic에서 별도 SKU로 판매하는 상업용 라이선스가 필요합니다. 문의 사항은 Elastic Sales로 연락해 주세요.
handshake
연구 논문 발표를 계속하실 건가요?
keyboard_arrow_down
네. 저희가 출시하는 모든 모델은 엄격한 연구 논문을 통해 뒷받침되며, ICLR, EMNLP, SIGIR, NeurIPS, ICML과 같은 주요 학회에 지속적으로 논문을 제출하고 있습니다.
handshake
저는 현재 Jina나 Elastic 고객이 아니지만, Reader API, Model API 또는 클라우드 마켓플레이스 이미지를 사용하고 싶습니다. 어떻게 하면 될까요?
keyboard_arrow_down
이전과 마찬가지로 저희 웹사이트 또는 해당 클라우드 마켓플레이스를 통해 간단히 등록하고 결제하시면 됩니다.
handshake
Elastic에서 Jina 모델의 상업용 라이선스를 구매할 수 있나요?
keyboard_arrow_down
네. 2026년 8월 10일부터 Elastic은 Jina 모델의 상업용 라이선스를 자체 SKU로 직접 판매할 예정입니다. 이 라이선스는 자체 관리형 온프레미스 또는 물리적으로 격리된 인프라에서 Jina 모델을 실행하는 데 사용되며, Elastic의 직접 판매 채널, 연방 정부 채널 및 클라우드 서비스 제공업체(CSP)를 통해 구매할 수 있습니다. 제품명은 Jina On-Prem입니다. 견적 문의는 Elastic 영업팀으로 연락해 주세요.
handshake
Jina On-Prem이란 무엇인가요?
keyboard_arrow_down
Jina On-Prem은 상용 라이선스와 함께 자체 인프라 내에서 Jina 모델을 완벽하게 실행할 수 있도록 지원하는 독립형 Docker 컨테이너 세트를 제공합니다. 이러한 컨테이너는 외부 연결을 설정하지 않습니다. Hugging Face 또는 모델 레지스트리 호출, 라이선스 서버, 원격 측정 또는 로깅 엔드포인트가 필요하지 않으므로 물리적으로 격리된 네트워크 환경에서 사용할 수 있습니다. 임베디드 모델, 재정렬 모델, Reader 모델을 포함한 모든 Jina 모델을 지원하며, Elastic Inference Service(EIS), OpenAI, Cohere, Voyage AI, Gemini용 API 패턴을 제공하므로 기존 애플리케이션에서 코드 변경 없이 실행할 수 있습니다. Jina On-Prem은 독립형 SKU로, Elastic Resource Units(ERU) 기반이 아니며 Elasticsearch를 실행하지 않아도 사용할 수 있습니다. 또한 오픈 소스 Elasticsearch와도 호환됩니다. 2026년 8월 10일부터 주문 가능합니다. 재고 및 조건에 대한 자세한 내용은 엘라스틱 영업팀으로 문의하세요.
handshake
지나 온프렘의 가격은 얼마인가요?
keyboard_arrow_down
이는 연간 라이선스 비용으로, 배포된 모델의 규모와 추론 실행에 사용된 하드웨어를 기준으로 책정됩니다. 사용자 수, 노드 수, 모델 크기 또는 토큰 수에 따라 부과되지 않습니다. 순수 CPU 배포의 경우에도 추론에 사용된 프로세서 수를 기준으로 계산됩니다. 가격 책정은 셀프 서비스가 아니므로, 배포 규모에 맞는 맞춤 견적을 받으시려면 Elastic 영업팀에 문의하세요.
handshake
Jina On-Prem의 목표 사용자는 누구인가요?
keyboard_arrow_down
일부 조직은 클라우드 기반 AI 서비스로 데이터를 전송할 수 없거나 전송하기를 꺼립니다. 대표적인 예로는 물리적으로 격리되고 보안 수준이 매우 높은 환경, 공공 부문 및 국방 분야, 금융 서비스 및 의료와 같은 규제 산업, 극도로 높은 지연 시간이 요구되거나 오프라인 상태인 시스템, 그리고 토큰 기반 청구 방식보다 고정적이고 예측 가능한 추론 비용을 선호하는 팀 등이 있습니다. 귀사의 구축 환경이 이러한 범주에 속하는 경우, Elastic 영업팀에 문의하여 자세한 내용을 상담받으실 수 있습니다.
handshake
저는 Elastic 고객입니다. 아무것도 배포하지 않고 Elastic Cloud에서 Jina 모델을 사용할 수 있나요?
keyboard_arrow_down
네. Jina 모델은 Elastic Inference Service(EIS)를 통해 제공되므로 데이터 수집 및 검색에 사용하기 위해 머신 러닝 노드를 구성하거나 GPU 인프라를 관리할 필요가 없습니다. EIS에서 일반적으로 사용 가능한 모델은 jina-embeddings-v5-text-small, jina-embeddings-v5-text-nano, jina-embeddings-v5-omni-small, jina-embeddings-v5-omni-nano, jina-embeddings-v3, jina-clip-v2, 그리고 jina-reranker-v3.5, jina-reranker-v3, jina-reranker-v2-base-multilingual, jina-reranker-m0 리랭커입니다. 최신 모델 목록, 지원 지역 및 각 모델에 대한 최소 스택 버전은 Elastic 문서를 참조하세요.
handshake
Hugging Face에서 웨이트 파일을 다운로드했습니다. 이 파일을 실제 운영 환경에서 사용하려면 라이선스를 취득해야 하나요?
keyboard_arrow_down
모델의 라이선스에 따라 자세한 내용은 해당 모델의 Hugging Face 페이지를 참조하세요. Apache-2.0은 별도 구매 없이 상업적 사용이 가능합니다. 평가, 벤치마킹 및 연구는 CC-BY-NC 4.0 라이선스에 따라 무료로 이용할 수 있지만, 상업적 용도로 사용하려면 상업용 라이선스(Jina On-Prem에서 제공하는 라이선스)가 필요합니다. 연구용 라이선스는 상업적 사용을 전면 금지하며, 다른 모델에 제공되는 상업용 라이선스에는 포함되지 않습니다. 따라서 예산과 관계없이 연구용 모델은 상용 용도로 적합하지 않습니다. 참고로 이는 데이터 사용량에 대한 것이며, 관리형 API 또는 공식 클라우드 마켓플레이스 이미지에 대한 상업적 호출에는 별도 라이선스 구매가 필요하지 않습니다. 구매 관련 문의는 Elastic 영업팀으로 연락해 주세요.
handshake
지나(Jina) 모델에 대한 계약 또는 맞춤 제작 계약을 체결하고 싶습니다. 어떻게 해야 하나요?
keyboard_arrow_down
Elastic 영업팀(Elastic Sales)에 문의하세요. Jina 모델에 대한 상업용 라이선스, 계약 및 지원은 이제 모두 Elastic의 표준 영업 및 지원 프로세스를 통해 처리됩니다.
handshake
저는 중국 회사로서 귀사의 서비스를 구매했습니다. 중국어로 된 송장을 받을 수 있을까요?
keyboard_arrow_down
셀프 서비스 API 충전은 청구서 발행이 불가능합니다. 이러한 유형의 결제에 대한 청구서는 결제를 처리하는 업체에서 자동으로 발행되며 중국에서는 발행할 수 없습니다. 계약 구매(Jina On-Prem 포함)의 경우, 다른 계약 업체 및 청구 방식에 대해 논의하려면 Elastic 영업팀에 문의하세요.
handshake
저는 Elastic 고객인데 임베딩 및 재정렬에 대한 모범 사례를 배우고 싶거나, Jina AI의 개발 상황에 관심이 있습니다. 어떻게 해야 할까요?
keyboard_arrow_down
Elastic 영업팀(Elastic Sales)에 문의해 주시면, 고객, Jina AI 팀, Elastic 간의 미팅을 주선해 드리겠습니다.
handshake
제 라이선스 기간 중에 새로운 모델이 출시되면 포함되나요?
keyboard_arrow_down
라이선스 기간 동안 출시된 동일 카테고리의 모든 모델이 포함됩니다. 재계약이나 별도 구매가 필요 없으며, 라이선스 키는 개별 모델이 아닌 카테고리별로 발급되므로 변경되지 않습니다. 단, 상업적 사용이 허용되지 않는 라이선스가 적용된 모델은 예외이며, 이러한 모델은 어떠한 상업용 라이선스에도 포함되지 않습니다. 구체적인 계약 범위는 Elastic 영업팀에 문의하여 확인하세요.
handshake
상업용 라이선스에는 어떤 지원이 포함되어 있나요? 누가 지원을 제공하나요?
keyboard_arrow_down
본 라이선스는 엔터프라이즈급 지원을 포함하며 표준 서비스 수준 계약(SLA)을 준수합니다. 배포는 전적으로 사용자에게 달려 있습니다. 컨테이너 이미지를 다운로드하여 사용자 환경에서 직접 실행하면 되며, 설치 관련 문제가 발생할 경우 지원팀에서 도움을 드립니다. 지원 및 모든 계약 관련 사항은 Elastic의 표준 절차를 따릅니다. 구체적인 SLA는 Elastic 영업팀에 문의하여 확인하세요.
handshake
Jina가 Elastic에 합병된 후에는 어떤 데이터 처리 용어가 적용되나요?
keyboard_arrow_down
데이터 처리는 Jina AI GmbH의 이전 계약 조건이 아닌 Elastic의 데이터 처리 계약에 따라 규정됩니다. 이는 구매 문서에 있어 매우 중요하며, 인수 전에 작성된 문서 중 이전 계약을 참조하는 부분이 있다면 반드시 검토해야 합니다. 현재 계약 조건 및 해당 조건에서의 적용 가능성에 대한 자세한 내용은 Elastic 영업팀에 문의하세요.

API 키를 어떻게 얻나요?

video_not_supported

속도 제한은 무엇입니까?

속도 제한
속도 제한은 두 가지 방식으로 추적됩니다. RPM(분당 요청 수)과 TPM(분당 토큰 수)입니다. 제한은 IP/API 키별로 적용되며 RPM 또는 TPM 임계값 중 먼저 도달하는 쪽에서 트리거됩니다. 요청 헤더에 API 키를 제공하면 IP 주소 대신 키별로 속도 제한을 추적합니다.
제품API 엔드포인트설명arrow_upwardAPI 키 없음key_off무료 API 키 사용 시key유료 API 키 사용 시key프리미엄 API 키 사용 시key평균 지연토큰 사용량 계산허용 요청
Reader APIhttps://r.jina.aiURL을 LLM 친화적인 텍스트로 변환20 RPM500 RPM500 RPMtrending_up5000 RPM7.9s출력 응답의 토큰 수를 기준으로 합니다.GET/POST
Reader APIhttps://s.jina.ai웹 검색 후 결과를 LLM 친화적인 텍스트로 변환block100 RPM100 RPMtrending_up1000 RPM2.5s각 요청에는 10000개의 토큰으로 시작하는 고정된 수의 토큰이 필요합니다.GET/POST
Reranker APIhttps://api.jina.ai/v1/rerank쿼리 기준으로 문서 순위 매기기block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
입력 크기에 따라 다름
help
입력 요청의 토큰 수를 기준으로 합니다.POST
벡터 모델 APIhttps://api.jina.ai/v1/embeddings텍스트/이미지를 고정 길이 벡터로 변환block100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
입력 크기에 따라 다름
help
입력 요청의 토큰 수를 기준으로 합니다.POST

상업용 라이센스가 필요합니까?

CC BY-NC 라이선스 자가 점검

play_arrow
저희 관리형 API를 사용하고 계신가요, 아니면 Azure, AWS 또는 GCP의 공식 미러를 사용하고 계신가요?
play_arrow
예
별도의 라이선스 구매는 필요하지 않습니다. 상업적 사용은 서비스 약관에 이미 포함되어 있습니다. 이 웹사이트 또는 클라우드 마켓플레이스를 통해 등록 및 결제하세요.
play_arrow
아니요
play_arrow
상업용 제품이나 서비스를 위해 자체 모델 웨이트를 운영하고 계신가요?
play_arrow
아니요
라이선스 구매는 필요하지 않습니다. 당사가 모델 배포에 사용하는 모든 라이선스에 따라 다운로드, 평가, 벤치마킹 및 연구 목적으로 사용할 수 있으며, 단 출처를 명시해야 합니다.
play_arrow
예
play_arrow
이 모델은 어떤 라이선스 계약을 사용하나요? 허깅 페이스(Hugging Face)의 해당 모델 페이지에 명시되어 있습니다.
play_arrow
Apache-2.0
Apache 2.0은 라이선스 없이 상업적 사용을 허용합니다. 이전 버전인 v1 및 v2에서는 이 라이선스를 사용했습니다.
play_arrow
CC BY-NC 4.0
상업용 라이선스가 필요합니다. Elastic은 2026년 8월 10일부터 Jina 모델용 상업용 라이선스를 Jina On-Prem이라는 독립형 SKU로 판매하고 있습니다. 이 라이선스는 자체 호스팅, 온프레미스 및 물리적으로 격리된(에어갭) 배포 환경을 지원하며 Elasticsearch 구독이 필요하지 않습니다.
이미 Elastic 고객이시라면, 담당 팀에서 기존 계약에 이를 추가할 수 있습니다.
Elastic Sales에 문의하세요.
play_arrow
Qwen 연구 라이선스
연구용 라이선스는 어떠한 상업적 용도도 허용하지 않으며, 다른 모델에 제공되는 상업용 라이선스에도 포함되지 않습니다. 이 모델은 상업적 옵션을 제공하지 않으며, 자체 호스팅 및 API 접근은 지원되지 않습니다. 다른 두 가지 라이선스 옵션 중 하나를 이용해 주시기 바랍니다.

기타 질문

Reader 관련 자주 묻는 질문
Reader API 사용과 관련된 비용은 얼마입니까?
keyboard_arrow_down
기본 사용은 무료입니다. URL 앞에 "https://r.jina.ai/"만 추가하면 됩니다. API 키를 제공하면 사용량 제한이 증가하고 콘텐츠 길이에 따라 토큰 수수료가 발생합니다. 사용량 제한에 대한 자세한 내용은 질문 16을 참조하세요.
Reader API는 어떻게 작동하나요?
keyboard_arrow_down
Reader API는 서버에서 URL을 가져와 LLM이 바로 사용할 수 있는 깔끔한 텍스트를 반환합니다. X-Engine 헤더를 사용하여 가져오기 엔진을 선택할 수 있습니다. direct는 일반 HTTP 가져오기 요청을 수행하여 가장 빠른 속도를 제공합니다. 기본 엔진은 헤드리스 브라우저에서 페이지를 렌더링하므로 가져오기 전에 클라이언트 측 JavaScript가 실행됩니다. cf-browser-rendering은 Cloudflare에서 제공하는 실험적인 렌더링 엔진입니다. 내비게이션, 헤더, 푸터, 광고와 같은 기본 요소는 제거되고 주요 콘텐츠는 Markdown으로 변환됩니다. 동일 페이지의 다른 도형을 가져오려면 X-Respond-With를 사용하고, 특정 CSS 선택자를 유지하거나 제거하려면 X-Target-Selector 또는 X-Remove-Selector를 사용하세요.
Reader API는 오픈 소스인가요?
keyboard_arrow_down
Reader 서비스 코드는 Jina AI GitHub 조직에서 찾을 수 있습니다. Reader에서 사용하는 모델(ReaderLM-v2 및 jina-vlm)은 CC-BY-NC 4.0 라이선스(오픈소스가 아님)에 따라 배포됩니다. 비상업적 용도로는 무료로 다운로드하여 사용할 수 있지만, 상업적 용도로 사용하려면 상업용 라이선스가 필요합니다. Elastic은 2026년 8월 10일부터 이 라이선스를 별도로 판매하고 있습니다. 구매를 원하시면 Elastic Sales에 문의하세요.
Reader API의 일반적인 대기 시간은 얼마나 됩니까?
keyboard_arrow_down
이는 주로 검색 엔진과 페이지 자체에 따라 달라집니다. 일반적인 검색 엔진은 간단한 페이지를 몇 백 밀리초 만에 불러올 수 있지만, 기본 브라우저 엔진은 페이지를 불러오기 전에 로드하고 실행해야 하므로 보통 몇 초가 걸립니다. 대규모 단일 페이지 애플리케이션, 속도가 느린 원본 서버, 대용량 PDF 파일의 경우 시간이 훨씬 더 오래 걸립니다. 5분 이내에 동일한 URL에 반복적으로 접속하면 캐시에서 페이지를 불러와 거의 즉시 결과를 반환하므로 "핫 URL"이 "콜드 URL"보다 훨씬 빠릅니다.
페이지를 직접 스크랩하는 대신 Reader API를 사용해야 하는 이유는 무엇입니까?
keyboard_arrow_down
스크래핑은 복잡하고 신뢰하기 어려울 수 있으며, 특히 복잡하거나 동적인 페이지의 경우 더욱 그렇습니다. Reader API는 깔끔하고 LLM에 바로 쓸 수 있는 텍스트를 간결하고 안정적으로 출력해 줍니다.
Reader API는 여러 언어를 지원합니까?
keyboard_arrow_down
Reader API는 언어에 구애받지 않고 페이지의 원래 언어로 콘텐츠를 반환하며, 번역 기능은 제공하지 않습니다. 콘텐츠 협상은 X-Locale 헤더를 통해 이루어지며, 이 헤더는 렌더링에 사용되는 브라우저의 로케일을 설정합니다. 따라서, 웹사이트에서 각 로케일에 따라 다른 태그를 사용하는 경우, 원하는 버전의 콘텐츠를 제공할 수 있습니다.
Reader API는 웹사이트 접근 제어를 준수합니까?
keyboard_arrow_down
네. Reader는 표준 웹 클라이언트처럼 작동하며 웹사이트의 접근 제어 정책을 준수합니다. 웹사이트에서 요청을 차단하는 경우, Reader는 해당 결정을 따릅니다. 사용자는 Reader를 사용할 때 방문하는 웹사이트의 이용 약관을 준수하고 제3자의 지적 재산권을 침해하지 않도록 할 책임이 있습니다.
Reader API가 PDF 파일에서 콘텐츠를 추출할 수 있습니까?
keyboard_arrow_down
네, Reader API는 기본적으로 PDF 파일에서 콘텐츠를 추출할 수 있습니다.
Reader API가 웹페이지의 미디어 콘텐츠를 처리할 수 있나요?
keyboard_arrow_down
네, Reader는 x-with-generated-alt 헤더를 사용하여 웹페이지의 이미지에 캡션을 붙일 수 있습니다. 이를 통해 alt 태그가 없는 이미지에 설명 alt 태그가 추가되어 LLM이 시각적 콘텐츠를 이해할 수 있습니다. 동영상 요약 기능은 향후 릴리스에서 제공될 예정입니다.
로컬 HTML 파일에서 Reader API를 사용할 수 있습니까?
keyboard_arrow_down
아니요, Reader API는 공개적으로 액세스 가능한 URL의 콘텐츠만 처리할 수 있습니다.
Reader API는 콘텐츠를 캐시합니까?
keyboard_arrow_down
5분 이내에 동일한 URL을 요청하면 Reader API가 캐시된 콘텐츠를 반환합니다.
로그인 후 Reader API를 사용하여 콘텐츠에 액세스할 수 있나요?
keyboard_arrow_down
네, 이는 쿠키 기반 세션을 허용하는 페이지에 적용됩니다. 세션 쿠키를 전달하려면 X-Set-Cookie 헤더를 사용하세요. Reader는 URL을 가져올 때 일반 Set-Cookie와 동일한 <name>=<value> 형식을 사용하여 이러한 쿠키를 전달하고, 선택적으로 domain=을 사용하여 범위를 지정합니다. 쿠키를 포함하는 요청은 캐시되지 않으므로 각 요청은 완전히 새로운 가져오기로 간주됩니다. 이는 로그인 프로세스를 자동으로 수행하는 것이 아니라 기존 자격 증명을 다시 사용하는 것이므로, 사용자는 직접 자격 증명을 가져와 대상 웹사이트의 서비스 약관을 준수해야 합니다. 대화형 로그인, 다단계 인증(MFA) 또는 페이지 자체에서 획득한 홀더 토큰이 필요한 프로세스는 이 범위에 포함되지 않습니다.
Reader API를 사용하여 arXiv의 PDF에 액세스할 수 있나요?
keyboard_arrow_down
예, Reader의 기본 PDF 지원을 사용하거나(https://r.jina.ai/https://arxiv.org/pdf/2310.19923v4) arXiv의 HTML 버전을 사용할 수 있습니다(https://r.jina.ai/https://arxiv.org/html/2310.19923v4)
Reader에서 이미지 캡션은 어떻게 작동하나요?
keyboard_arrow_down
Reader는 지정된 URL의 모든 이미지에 캡션을 붙이고, Image [idx]: [caption] 형식의 alt 태그를 추가합니다(원래 alt 태그가 없는 경우). 이를 통해 다운스트림 LLM이 추론, 요약 등에서 이미지와 상호작용할 수 있습니다.
Reader의 확장성은 어느 정도인가요? 프로덕션에서 사용할 수 있나요?
keyboard_arrow_down
Reader API는 확장성이 뛰어나도록 설계되었습니다. 실시간 트래픽에 따라 자동으로 확장되며, 최대 동시 요청 수는 현재 약 4,000개입니다. Jina AI의 핵심 제품 중 하나로 적극적으로 유지 관리하고 있으니 프로덕션에서 마음껏 사용하세요.
Reader API의 속도 제한은 무엇입니까?
keyboard_arrow_down
아래 표에서 최신 속도 제한 정보를 확인하세요. 우리는 Reader API의 속도 제한과 성능을 개선하기 위해 적극적으로 노력하고 있으므로 이에 따라 이 표도 업데이트될 예정입니다.
speed속도 제한
ReaderLM이란 무엇인가요? 어떻게 사용하나요?
keyboard_arrow_down
ReaderLM-v2는 15억 4천만 개의 파라미터를 가진 소형 언어 모델로, 원시 HTML을 간결한 Markdown 또는 JSON으로 변환하고 JSON 스키마 또는 자연어 명령어를 사용하여 구조화된 데이터를 추출합니다. x-respond-with: readerlm-v2 요청 헤더를 사용하여 Reader API를 통해 사용하거나 AWS, Azure 또는 GCP Marketplace에서 배포할 수 있습니다. 대량의 이미지나 스캔 문서를 처리하는 시나리오의 경우, 24억 개의 파라미터를 가진 시각적 언어 판독기 모델인 jina-vlm을 사용할 수 있습니다.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
웹 페이지에서 구조화된 데이터를 추출하는 방법은 무엇인가요?
keyboard_arrow_down
JSON 스키마 정의와 함께 x-json-schema 헤더를 사용하거나, 자연어 지시문과 함께 x-instruction 헤더를 사용하세요. 두 기능 모두 ReaderLM-v2와 함께 작동하여 어떤 웹페이지에서든 가격, 제목, 날짜 등 특정 필드를 구조화된 JSON 형식으로 추출합니다.
Reader가 웹사이트의 봇 방지 시스템을 능동적으로 우회하나요?
keyboard_arrow_down
아니요. Reader는 웹사이트의 방어 체계, 봇 방지 시스템 또는 접근 제어를 적극적으로 우회하거나 무력화하지 않습니다. 웹사이트에서 당사 서비스를 봇으로 감지하여 요청을 차단하는 경우, 당사는 해당 결과를 존중합니다. 당사는 표준 웹 클라이언트로 작동하며 탐지 시스템을 우회하도록 설계된 어떠한 기술도 사용하지 않습니다. Reader를 사용하는 동안 제3자의 지적 재산권 및 방문하는 웹사이트의 이용 약관을 준수하는 것은 여전히 ​​사용자 본인의 책임입니다.
무료 API 키에서 유료 API 키로 업그레이드하면 더 많은 웹사이트에 접속할 수 있나요?
keyboard_arrow_down
아니요. 무료 API 키에서 유료 API 키로 업그레이드한다고 해서 다른 웹사이트에 접속할 수 있거나 웹사이트 접속 제한을 우회할 수 있는 것은 아닙니다. 두 등급의 주요 차이점은 요청 처리량 제한과 성능 최적화입니다. 유료 API 키는 더 높은 요청 처리량과 더 빠른 처리 속도를 제공하지만, 당사 서비스를 차단한 웹사이트에 접속할 수 있도록 허용하지는 않습니다.
내 인프라 내에서 Reader를 실행할 수 있습니까?
keyboard_arrow_down
네. Reader 모델은 독립형 오프라인 Docker 컨테이너로 제공되며, Elastic이 2026년 8월 10일부터 별도 SKU로 판매해 온 Jina On-Prem 상용 라이선스에 따라 판매됩니다. 이 모델은 물리적으로 격리되고 방화벽으로 보호된 환경에 적합하며, 컨테이너는 외부 연결을 설정하지 않습니다. 단, 공용 웹페이지에 접속하려면 네트워크 액세스가 필요합니다. 온프레미스 배포의 장점은 추출된 모델을 로컬에서 실행할 수 있다는 점입니다. 견적 문의는 Elastic 영업팀으로 연락해 주세요.
벡터 모델에 대해 자주 묻는 질문(FAQ)
Jina 임베딩 모델은 어떻게 학습되었나요?
keyboard_arrow_down
훈련 과정, 데이터 소스 및 평가에 대한 자세한 내용은 arXiv에 게시된 기술 보고서를 참조하세요. jina-embeddings-v5 텍스트 모델 훈련은 두 단계로 나뉩니다. 첫 번째 단계에서는 더 큰 교사 모델에서 임베딩 벡터를 추출하고, 두 번째 단계에서는 고정된 백본 가중치를 기반으로 작업별 LoRA 어댑터를 훈련합니다. v5-omni 멀티모달 변형의 경우 세 번째 단계가 추가되는데, 이 단계에서는 텍스트 백본과 어댑터는 고정된 상태로 유지되고 교차 모달 프로젝터만 훈련됩니다.
launcharXiv
귀하의 멀티모달 벡터 모델은 무엇입니까?
keyboard_arrow_down
jina-embeddings-v5-omni-small(약 17억 4천만 개의 파라미터, 1024개의 차원, 32,000개의 컨텍스트)과 jina-embeddings-v5-omni-nano(약 10억 4천만 개의 파라미터, 768개의 차원, 8,000개의 컨텍스트)는 현재 사용 가능한 멀티모달 모델입니다. 이 모델들은 텍스트, 이미지, 오디오, 비디오, PDF 파일을 공유 벡터 공간에 저장하므로, 한 모달리티에서 인덱싱한 후 다른 모달리티에서 다시 인덱싱할 필요 없이 쿼리할 수 있습니다. 일반 텍스트 출력은 각각 jina-embeddings-v5-text-small 및 jina-embeddings-v5-text-nano와 동일하므로, 기존 텍스트 인덱스에 멀티모달 입력을 추가할 때 다시 임베딩할 필요가 없습니다. jina-clip-v2(8억 6천 5백만 개의 파라미터)는 보다 가벼운 텍스트 및 이미지 옵션으로 계속 사용할 수 있습니다.
launcharXiv
귀하의 모델은 어떤 언어를 지원합니까?
keyboard_arrow_down
2024년 이후 출시된 모든 모델은 다국어를 지원합니다. jina-embeddings-v5-text-small 및 v5-omni 모델은 Qwen3 백본을 기반으로 구축되었으며 광범위한 다국어 지원 기능을 제공합니다. jina-embeddings-v5-text-nano는 EuroBERT-210M을 기반으로 구축되었으며 영어, 프랑스어, 독일어, 스페인어, 중국어, 일본어, 아랍어, 힌디어 등 15개의 주요 유럽 및 세계 언어를 지원합니다. jina-embeddings-v3 및 jina-clip-v2는 89개 언어를 지원합니다. 각 언어에 대한 벤치마크 데이터는 해당 모델의 기술 보고서에 있는 MMTEB 결과를 참조하세요.
launcharXiv
단일 입력에 대한 최대 컨텍스트 길이는 얼마입니까?
keyboard_arrow_down
컨텍스트 길이는 모델에 따라 다릅니다. jina-embeddings-v5-text-small 및 jina-embeddings-v5-omni-small은 최대 32,768개의 토큰을 지원하는 반면, jina-embeddings-v5-text-nano 및 jina-embeddings-v5-omni-nano는 8,192개의 토큰을 지원합니다. jina-embeddings-v4 및 jina-code-embeddings 모델은 32,768개의 토큰을 지원하고, jina-embeddings-v3, jina-clip-v2 및 jina-colbert-v2는 8,192개의 토큰을 지원합니다. truncate: true로 설정하지 않으면 입력값이 제한을 초과할 경우 오류가 발생합니다.
하나의 요청에 포함될 수 있는 최대 입력값 개수는 몇 개입니까?
keyboard_arrow_down
요청에 포함할 수 있는 항목 수에는 엄격한 제한이 없습니다. API는 최적의 GPU 활용을 위해 토큰 수를 기준으로 입력을 내부적으로 일괄 처리하므로 단일 요청에 원하는 만큼의 텍스트나 이미지를 보낼 수 있습니다. 단, PDF 파일은 예외적으로 요청당 하나의 PDF 파일만 보낼 수 있습니다.
이미지, 오디오, 비디오 또는 PDF 파일을 멀티모달 모델로 전송하려면 어떻게 해야 하나요?
keyboard_arrow_down
image, audio, video, 또는 pdf 키를 사용하여 형식화된 객체를 input 배열에 전달하세요. 이 키의 값은 공개 URL 또는 base64로 인코딩된 바이트일 수 있습니다. 모델은 각 모달리티에 대한 데이터를 적절한 인코더로 라우팅하며, 단일 배치 내에서 여러 모달리티를 자유롭게 혼합할 수 있습니다. 지원되는 오디오 형식은 WAV, MP3, FLAC, OGG, M4A 및 Opus이며, 비디오는 초당 32프레임의 균일 샘플링으로 처리됩니다. 각 요청에는 PDF 파일을 1개까지 첨부할 수 있습니다.
Jina 임베딩은 최신 OpenAI, Cohere 및 Voyage 모델과 비교했을 때 어떤 차이가 있습니까?
keyboard_arrow_down
jina-embeddings-v5-text-small(매개변수 6억 7,700만 개)은 10억 개 미만의 매개변수를 가진 모델 중 MMTEB 데이터셋에서 가장 뛰어난 성능을 보이며, 작업 수준 평균 점수 67.0을 달성했고, 영어 MTEB 데이터셋에서는 71.7이라는 더욱 높은 평균 점수를 기록했습니다. jina-embeddings-v5-text-nano(매개변수 2억 3,900만 개)는 MMTEB 데이터셋에서 65.5점을 기록하며, 5억 개 미만의 매개변수를 가진 모든 평가 모델보다 우수한 성능을 보였습니다. 저희의 설계 목표는 전체 매개변수 개수가 아닌 매개변수당 성능이므로, 이러한 모델들은 대부분의 다른 모델보다 낮은 배포 비용으로 동등하거나 더 나은 검색 품질을 제공합니다. 모든 v5 모델은 Matryoshka 표현 학습을 지원하므로 재학습 없이 차원을 32로 줄일 수 있습니다.
OpenAI의 text-embedding-3-large에서 Jina Embeddings 모델로 마이그레이션하는 방법은 무엇입니까?
keyboard_arrow_down
마이그레이션 프로세스는 매우 간단합니다. 당사의 API 엔드포인트는 OpenAI의 입력 및 출력 JSON 스키마(text-embedding-3-large)와 일치하므로 대부분의 코드베이스에서는 기본 URL, API 키 및 모델 이름만 변경하면 됩니다. Jina On-Prem 컨테이너에도 동일하게 적용되며, 이 컨테이너는 Elastic Inference Service(EIS), Cohere, Voyage AI 및 Gemini 스키마를 제공하므로 Jina 모델이 기존 코드 경로의 모델을 직접 대체할 수 있습니다. 단, 서로 다른 모델 패밀리의 임베딩 벡터는 호환되지 않으므로 두 공급자의 벡터를 단일 인덱스에 혼합하는 대신 코퍼스를 다시 임베딩해야 합니다. Jina On-Prem 컨테이너 자체에 대한 자세한 내용은 Elastic 영업팀에 문의하세요.
이미지 및 기타 텍스트 이외의 입력값에 대한 항을 계산하는 방법은 무엇입니까?
keyboard_arrow_down
텍스트는 표준 방식으로 계산됩니다. 텍스트가 아닌 입력은 해당 인코더를 통해 토큰으로 변환되는데, 이 변환 비용은 사용하는 모델에 따라 크게 달라지므로 추측에 의존하기보다는 직접 입력 데이터를 사용하여 측정해 보시기 바랍니다. 참고로 600x600 픽셀 이미지의 변환 비용은 대략 다음과 같습니다. • jina-embeddings-v5-omni-small: 약 363 토큰 • jina-embeddings-v5-omni-nano: 약 362 토큰 • jina-embeddings-v4: 약 4,840 토큰 • jina-clip-v2: 약 16,000 토큰 v5-omni 모델은 이전 모델에 비해 이미지당 변환 비용이 1~2배 낮습니다. 각 응답에는 해당 요청에 대한 정확한 토큰 수를 포함하는 usage 객체가 있으며, 멀티모달 입력에 대한 image_tokens 분석 정보도 포함되어 있어 각 호출의 비용을 확인할 수 있습니다.
이미지, 오디오 또는 비디오를 삽입할 수 있는 모델을 제공하시나요?
keyboard_arrow_down
예. jina-embeddings-v5-omni-small과 jina-embeddings-v5-omni-nano는 텍스트, 이미지, 오디오, 비디오 및 PDF를 동일한 공유 벡터 공간에 임베드합니다. jina-embeddings-v4와 jina-clip-v2는 텍스트와 이미지를 처리합니다.
Jina 임베딩 모델은 개인 데이터나 기업 데이터에 맞춰 미세 조정할 수 있나요?
keyboard_arrow_down
두 가지 접근 방식이 있습니다. 셀프 서비스 방식은 FineTuning API를 사용합니다. 이 API는 사용자가 도메인을 설명하면 합성 학습 데이터를 생성하고, 레이블이 지정된 데이터 세트를 직접 구축할 필요 없이 미세 조정된 모델을 반환합니다. 독점 데이터, 전용 인프라 또는 기본 모델 선택기에 없는 모델에 대한 미세 조정이 필요한 경우, 상업적 계약에 따라 Elastic 영업팀에 문의하세요. 이러한 작업은 범위 및 계약 측면에서 Elastic에서 처리합니다.
문의하기
해당 모델을 비공개로 호스팅할 수 있나요? 예를 들어, 제 자체 인프라나 클라우드 계정에 호스팅할 수 있나요?
keyboard_arrow_down
네, 두 가지 옵션이 있습니다. Jina 모델은 AWS, Azure 및 GCP Marketplace에서 사용할 수 있으므로 자체 클라우드 계정에 배포할 수 있습니다. 자체 관리형, 온프레미스 또는 물리적으로 격리된 인프라의 경우 Elastic은 2026년 8월 10일부터 Jina On-Prem이라는 상용 라이선스를 제공합니다. 이 라이선스는 외부 호출이나 라이선스 서버가 필요 없는 완전 오프라인 Docker 컨테이너 형태로 모델을 제공합니다. 견적을 받으시려면 Elastic 영업팀으로 문의하세요.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
'task' 매개변수란 무엇이며 언제 사용해야 하나요?
keyboard_arrow_down
task 매개변수는 특정 작업에 적합한 LoRA 어댑터를 선택하여 최적의 결과를 얻도록 합니다. retrieval.query는 검색의 쿼리 측에, retrieval.passage는 문서 측에, text-matching은 대칭 유사도(예: 중복 제거 또는 재작성 감지)에, classification은 분류에, separation은 클러스터링에 사용됩니다. 검색은 비대칭적이므로 쿼리/문서 측을 바꾸면 성능이 크게 저하됩니다. 이 매개변수를 지원하는 모델에는 jina-embeddings-v5, jina-embeddings-v4, jina-embeddings-v3이 있습니다.
레이트 인터랙션(Late-interaction) 검색이란 무엇이며 어떤 모델이 지원하나요?
keyboard_arrow_down
레이트 인터랙션(Late-interaction)은 문서를 단일 벡터로 병합하는 대신 토큰 수준 벡터를 유지합니다. 이로 인해 인덱스 크기는 증가하지만 더 세밀한 세부 정보를 보존할 수 있습니다. jina-embeddings-v4는 output_type 매개변수를 통해 밀집(단일 벡터) 및 레이트 인터랙션(다중 벡터) 출력을 모두 지원하며, jina-colbert-v2는 레이트 인터랙션 전용 모델입니다. 대부분의 검색 프로세스에서는 밀집 v5 모델 후 리랭커를 사용하는 것이 정확도/비용 측면에서 더 나은 균형을 제공합니다.
지연 청킹이란 무엇인가요? 어떤 상황에서 사용해야 하나요?
keyboard_arrow_down
지연 청킹은 먼저 긴 컨텍스트 모델을 사용하여 전체 문서를 임베딩한 다음, 어휘 수준 표현에서 청크 임베딩을 도출합니다. 각 청크를 개별적으로 임베딩하는 단순 청킹과 달리, 지연 청킹은 청크 간 컨텍스트를 유지하여 문서 내에서 이전에 정의된 콘텐츠를 참조하는 청크가 있는 RAG 파이프라인에서 검색 품질을 향상시킵니다. 이 기능은 late_chunking 매개변수를 사용하여 활성화할 수 있습니다.
API에서 강제하는 컨텍스트 길이가 모델에서 지원하는 컨텍스트 길이와 다른 이유는 무엇입니까?
keyboard_arrow_down
일부 모델은 관리형 API에서 처리할 수 있는 것보다 더 긴 컨텍스트를 처리할 수 있도록 아키텍처적으로 설계되었습니다. 매우 긴 시퀀스는 상당한 양의 GPU 메모리를 소모할 수 있으며, 대부분의 사용 사례에 대해 처리량, 지연 시간 및 비용의 균형을 맞추도록 서비스 구성을 최적화합니다. 전체 아키텍처 컨텍스트 길이가 필요한 경우 모델을 직접 실행하세요. 셀프-매니지드(직접 관리형) 배포에 대해서는 Elastic Sales에 문의하세요.
jina-embeddings-v4는 무료인데 왜 이렇게 느린가요?
keyboard_arrow_down
jina-embeddings-v4는 Qwen 연구 라이선스(Qwen Research License)에 따라 배포되는 Qwen2-VL 기본 모델을 기반으로 구축되었으며, 연구 및 비상업적 용도로만 사용하도록 설계되었습니다. 따라서 상업적 라이선스를 제공할 수 없으며, API를 통해 무료로 제공됩니다. 또한, 이 모델은 38억 개의 파라미터를 가지고 있어 요청당 처리 속도가 느리고, 인프라 비용 관리를 위해 처리량을 제한했습니다. 프로덕션 환경에는 적합하지 않으므로 Elastic Inference Service 또는 Jina On-Prem을 통해 제공되지 않습니다. 프로덕션 환경에서는 jina-embeddings-v5 시리즈를 사용하세요. 이 시리즈는 더 빠르고 벤치마크 결과를 더 정확하게 가져오며, Elastic Sales를 통해 상업적 라이선스를 이용할 수 있습니다.
임베딩 API의 사용량 제한은 얼마인가요?
keyboard_arrow_down
API 키 유형에 따라 요청 제한이 다릅니다.

무료: 100 RPM, 100K TPM
유료: 500 RPM, 2M TPM
프리미엄: 5,000 RPM, 50M TPM

악용을 방지하기 위해 60초마다 10,000건의 요청으로 IP 주소당 추가 제한이 적용됩니다. 제한은 키별로 적용되며 60초 단위로 계산되므로 요청이 폭주하더라도 대기열에 쌓이지 않고 분산 처리됩니다. 제한을 초과하는 요청은 HTTP 429 오류를 반환하며 지수 백오프 알고리즘을 사용하여 재시도됩니다. 프리미엄 수준 이상의 제한이 필요하거나 공유 테넌트 제한 없이 전용 용량이 필요한 경우 Elastic 영업팀에 문의하세요.
어떤 임베딩 모델을 선택해야 할까요?
keyboard_arrow_down
텍스트 검색에는 jina-embeddings-v5-text-small을 먼저 사용하는 것이 좋습니다. 이 모델은 10억 파라미터 미만 모델 중 가장 강력하며 32K 컨텍스트를 처리할 수 있습니다. 정확도보다 지연 시간, 비용 또는 엣지 하드웨어가 더 중요한 경우에는 jina-embeddings-v5-text-nano를 사용하세요. 이미지, 오디오, 비디오 또는 PDF를 처리할 때는 jina-embeddings-v5-omni-small 또는 v5-omni-nano를 사용하세요. 이 모델들의 텍스트 출력은 해당 텍스트 모델과 완전히 동일하므로 재임베딩 없이 기존 인덱스에 이러한 모달리티를 추가할 수 있습니다. 소스 코드는 jina-code-embeddings-0.5b 또는 1.5b를 참조하세요. 동일 시리즈 내에서는 최신 버전일수록 성능이 우수합니다.
이미지 및 PDF 파일의 크기 제한은 어떻게 되나요?
keyboard_arrow_down
이미지 파일의 최대 크기는 5MB이고, PDF 파일의 최대 크기는 8MB입니다. 이 제한을 초과하는 파일은 거부되고 오류 메시지가 표시됩니다.
Reranker 관련 자주 묻는 질문
Reranker API 비용은 얼마입니까?
keyboard_arrow_down
임베딩 API와 마찬가지로 리랭커 API는 토큰 기반 가격 구조를 사용하며, 모든 Jina API는 공통 키와 토큰을 공유합니다. 새로 활성화된 API 키에는 간편한 온보딩을 위한 무료 토큰이 포함되어 있으며, 사용자는 토큰 패키지를 구매할 수도 있습니다. 자세한 내용은 가격 섹션을 참조하세요.
Jina의 리랭커 간 차이점은 무엇인가요?
keyboard_arrow_down
jina-reranker-v3.5는 현재 저희의 주력 제품으로, 0.6B 파라미터, 131,000 토큰 컨텍스트를 지원하는 다국어 리스트와이즈 리랭커로, jina-reranker-v3의 드롭인 대체품입니다. 모든 지표에서 v3보다 뛰어난 성능을 보여주며, 특히 정형 데이터 및 법률 관련 검색에서 가장 큰 개선을 보였고, 속도는 1.22배에서 1.56배 더 빠릅니다. jina-reranker-v3도 여전히 사용 가능합니다. jina-reranker-m0은 시각적 문서를 순위 매기는 멀티모달 재정렬 도구입니다. jina-reranker-v2-base-multilingual은 100개 이상의 언어를 지원하는 소형 크로스 인코더로, Qwen 기반 모델이 아닌 다른 모델이 필요할 때 매우 유용합니다. jina-colbert-v2는 89개 언어에서 레이트 인터랙션을 사용합니다.
Jina의 리랭커는 어떤 라이선스로 제공되나요?
keyboard_arrow_down
jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual, jina-colbert-v2는 모두 CC-BY-NC 4.0 라이선스로 배포됩니다. 비상업적 목적으로 무료로 사용, 공유 및 수정할 수 있습니다. 상업적 용도로 사용하려면 상업용 라이선스가 필요하며, Elastic은 2026년 8월 10일부터 Jina On-Prem이라는 이름으로 별도 SKU를 판매하고 있습니다. 견적을 받으시려면 Elastic Sales에 문의하세요. 이전 버전인 jina-reranker-v1-* 모델은 여전히 ​​Apache-2.0 라이선스를 사용합니다.
리랭커는 여러 언어를 지원합니까?
keyboard_arrow_down
네, 이제 모든 리랭킹 도구가 다국어를 지원합니다. jina-reranker-v3.5는 MIRACL 및 다국어 검색 기능 모두에서 버전 3보다 개선되었습니다. jina-reranker-v3와 jina-reranker-v2-base-multilingual은 100개 이상의 언어를 지원하고, jina-reranker-m0은 다국어 시각적 문서 정렬을 처리하며, jina-colbert-v2는 89개 언어를 지원합니다.
각 재정렬자에 대한 최대 컨텍스트 길이는 얼마입니까?
keyboard_arrow_down
컨텍스트 길이는 모델에 따라 다릅니다.

jina-reranker-v3.5: 131,072개 토큰(쿼리 및 모든 문서 포함), 자동 잘림 활성화
jina-reranker-v3: 131,072개 토큰, 자동 잘림 활성화
jina-reranker-m0: 10,000개 토큰
jina-reranker-v2-base-multilingual: 1,024개 토큰, 긴 문서에 대한 자동 청킹 활성화
jina-colbert-v2: 8,192개 토큰

v1 및 v2 리랭커의 경우 쿼리는 자동으로 잘리고, 긴 문서는 블록 간 최대 풀링을 사용하여 청크됩니다.
한 번의 쿼리로 재정렬할 수 있는 문서 수에 제한이 있나요?
keyboard_arrow_down
요청당 문서 수에는 엄격한 제한이 없습니다. 임베딩 API와 마찬가지로, 리랭커 API는 GPU 활용도를 최적화하기 위해 토큰 수를 기준으로 입력을 일괄 처리합니다. 따라서 단일 요청에 필요한 만큼의 문서를 전송할 수 있습니다.
100개의 문서를 리랭킹할 때 예상되는 지연 시간은 얼마나 됩니까?
keyboard_arrow_down
지연 시간은 문서와 쿼리의 길이에 따라 크게 달라지며 100밀리초에서 7초까지입니다. 예를 들어 64 토큰 쿼리로 각각 256 토큰인 문서 100개를 리랭킹하는 데 약 150밀리초가 걸립니다. 문서 길이를 4096 토큰으로 늘리면 시간이 3.5초로 늘어납니다. 쿼리 길이를 512 토큰으로 늘리면 시간은 7초까지 더 늘어납니다.
쿼리와 100개의 문서를 재정렬하는 데 드는 시간 비용(밀리초)은 다음과 같습니다.
각 문서의 토큰 수
쿼리의 토큰 수256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
순위 재조정 도구를 비공개로 호스팅할 수 있나요? 예를 들어, 제 자체 인프라나 클라우드 계정에 호스팅할 수 있을까요?
keyboard_arrow_down
네. 이러한 주문 재정렬 도구는 AWS, Azure 및 GCP 마켓플레이스에서 찾을 수 있으며, 사용자의 클라우드 계정에 배포할 수 있습니다. 자체 관리형, 온프레미스 또는 물리적으로 격리된 인프라의 경우, Elastic은 모델을 완전 오프라인 Docker 컨테이너로 제공하는 상용 라이선스(Jina On-Prem)를 제공합니다. 견적을 받으시려면 Elastic 영업팀에 문의하세요.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
도메인별 데이터를 기반으로 순위를 미세 조정할 수 있는 리랭킹 도구를 제공하시나요?
keyboard_arrow_down
미세 조정을 맡기기 전에 jina-reranker-v3.5를 사용해 보세요. 이 버전은 자체 증류 기법을 사용하여 특정 도메인에 맞게 특별히 학습되었으므로 매우 견고하며 법률 및 구조화된 데이터 검색에서 버전 3보다 크게 개선되었습니다. 최적화된 청킹을 사용하는 적절한 기성 리랭커는 미세 조정보다 데이터 격차를 해소하는 데 더 효과적인 경우가 많으며, 테스트는 무료입니다. 그래도 데이터 요구 사항을 충족하지 못하는 경우 도메인별 맞춤형 리랭커를 고려해 보세요. 구체적인 요구 사항에 대해서는 Elastic Sales에 문의하세요.
문의하기
문서의 최소 이미지 크기는 얼마입니까?
keyboard_arrow_down
jina-reranker-m0 모델이 허용하는 최소 이미지 크기는 28x28픽셀입니다.
리스트와이즈(listwise) 리랭킹이란 무엇이며 포인트와이즈(pointwise)와 어떻게 다른가요?
keyboard_arrow_down
jina-reranker-v3와 jina-reranker-v3.5는 리스트 기반 아키텍처를 사용합니다. 쿼리와 모든 후보 문서가 단일 컨텍스트 윈도우를 공유하고, 점수 계산은 단일 순방향 전파를 통해 완료되므로 모델이 문서들을 서로 비교할 수 있습니다. jina-reranker-v2-base-multilingual과 같은 기존의 포인트 기반 리랭킹 모델은 각 문서에 대해 쿼리와 독립적으로 점수를 매깁니다. 리스트 기반 점수 계산은 관련성이 일반적으로 후보 문서 집합 내의 다른 문서들과 상대적이기 때문에 더 정확합니다.
API에서 강제하는 컨텍스트 길이가 모델에서 지원하는 컨텍스트 길이와 다른 이유는 무엇입니까?
keyboard_arrow_down
일부 재정렬 아키텍처는 관리형 API에서 처리할 수 있는 것보다 더 긴 컨텍스트를 처리할 수 있습니다. 매우 긴 시퀀스는 상당한 양의 GPU 메모리를 소비할 수 있으며, Elastic은 처리량, 지연 시간 및 비용의 균형을 맞추기 위해 대부분의 사용 사례에 맞게 서비스 구성을 조정합니다. 전체 아키텍처 컨텍스트 길이가 필요한 경우 자체 인프라에서 모델을 실행하고 상업용 라이선스에 대해 Elastic 영업팀에 문의하세요.
Reranker API의 사용량 제한은 얼마인가요?
keyboard_arrow_down
API 키 유형에 따라 요청 제한이 다릅니다.

무료 버전: 100 RPM, 10만 TPM
유료 버전: 500 RPM, 200만 TPM
프리미엄 버전: 5,000 RPM, 5천만 TPM

또한 IP 주소 기반 제한이 있으며, 60초당 최대 1만 건의 요청이 허용됩니다. 이러한 제한은 임베딩 및 리랭커 API에도 적용되며, 동일한 키를 사용하는 모든 Jina API에서 토큰은 공유됩니다.
어떤 리랭커를 선택해야 할까요?
keyboard_arrow_down
텍스트의 경우 jina-reranker-v3.5를 사용하세요. 이 모델은 jina-reranker-v3를 직접 대체합니다. 요청 스키마는 동일하게 유지되므로 모델 문자열만 변경하면 전체 마이그레이션이 완료됩니다. 후보가 이미지 또는 풍부한 시각적 콘텐츠를 포함하는 문서인 경우 jina-reranker-m0를 사용하세요. 더 작은 모델이 필요하거나 Qwen 백본 아키텍처를 기반으로 하지 않는 모델이 필요한 경우 jina-reranker-v2-base-multilingual를 사용하세요.
API 관련 FAQ
code
Jina의 모든 API에서 동일한 API 키를 사용할 수 있나요?
keyboard_arrow_down
네. 하나의 API 키로 Jina AI의 핵심 검색 제품인 Reader, Embeddings, Reranker, Classifier, Segmenter API의 모든 기능을 사용할 수 있으며, 모든 API는 동일한 토큰을 공유합니다.
code
API 키의 토큰 사용량을 볼 수 있나요?
keyboard_arrow_down
예, 키 및 청구 탭에 API 키를 입력하면 최근 토큰 사용량과 남은 토큰 잔액을 볼 수 있습니다. API 키 제어판에 로그인한 경우 API 키 관리 탭에서도 이러한 세부정보를 볼 수 있습니다.
code
API 키를 잊어버린 경우 어떻게 해야 합니까?
keyboard_arrow_down
재충전 키를 분실하여 되찾고 싶으신 경우 등록된 이메일을 사용하여 jina.ai 지원팀에 문의해 도움을 받으세요. API Key의 안전한 보관과 손쉬운 접근을 위해 로그인을 권장합니다.
문의하기
code
API 키가 만료되나요?
keyboard_arrow_down
아니요, API 키는 만료되지 않습니다. 키가 유출된 경우 API 키 관리 패널에서 직접 키를 취소하세요. 취소는 즉시 적용됩니다. 서비스 중단을 방지하려면 먼저 새 키를 신청할 수 있습니다. 남은 토큰 잔액은 계정에 그대로 유지되며 키가 취소되더라도 손실되지 않습니다. 관리 패널에 접속할 수 없거나 계정이 유출되었다고 의심되는 경우 Elastic 지원팀에 문의하세요.
문의하기
code
API 키 간에 토큰 잔액을 전송할 수 있나요?
keyboard_arrow_down
예, 프리미엄 키에서 다른 키로 토큰을 이전할 수 있습니다. API 키 관리 대시보드에서 계정에 로그인한 후, 이전하려는 키의 설정에서 남아 있는 모든 유료 토큰을 이동하세요.
code
내 API 키를 파기할 수 있나요?
keyboard_arrow_down
예. API 키가 손상되었다고 생각되면 파기할 수 있습니다. 키를 파기하면 이를 저장한 모든 사용자에 대해 키가 즉시 비활성화되며, 남아 있는 모든 토큰 잔액 및 관련 자산은 영구적으로 사용할 수 없게 됩니다. 프리미엄 키가 있는 경우, 소각하기 전에 남은 유료 토큰 잔액을 다른 키로 이전하도록 선택할 수 있습니다. 이 작업은 취소할 수 없습니다. 키를 파기하려면 API 키 대시보드의 키 설정으로 이동하세요.
code
일부 모델을 처음 요청할 때 속도가 느린 이유는 무엇입니까?
keyboard_arrow_down
이는 서버리스 아키텍처가 사용량이 낮을 때 특정 모델을 오프로드하기 때문입니다. 초기 요청은 모델을 활성화하거나 "준비"하는데 몇 초 정도 걸릴 수 있습니다. 초기 활성화 후 후속 요청은 훨씬 빠르게 처리됩니다.
code
제 API 데이터가 모델 학습에 사용되나요?
keyboard_arrow_down
아니요. 저희는 귀하의 API 요청, 입력 또는 출력을 임베딩, 리랭커 또는 기타 모델을 학습시키는 데 사용하지 않습니다. 귀하의 데이터는 귀하의 것입니다.
code
Jina API의 사용량 제한은 얼마인가요?
keyboard_arrow_down
각 API 키에는 다음과 같은 요청 제한이 있습니다.

무료 버전: 100 RPM, 10만 TPM
유료 버전: 500 RPM, 200만 TPM
프리미엄 버전: 5,000 RPM, 5천만 TPM

또한, IP 주소당 60초마다 1만 건의 요청 제한이 있습니다. 제한은 엔드포인트별로 다르므로, 각 엔드포인트에 대한 자세한 제한 사항은 위의 요청 제한 표를 참조하세요.
code
API에 배치 크기 제한이 있나요?
keyboard_arrow_down
Embeddings API와 Reranker API 모두 배치 크기 제한이 없습니다. 필요에 따라 요청당 원하는 만큼의 항목이나 문서를 전송할 수 있습니다. 두 API 모두 최적의 GPU 활용을 위해 토큰 수를 기준으로 입력을 내부적으로 배치 처리합니다.
code
Jina API는 Elasticsearch의 Jina 모델과 동일한가요?
keyboard_arrow_down
아니요, 이 세 가지는 서로 다른 접근 방식입니다. 이 웹사이트의 Jina API는 셀프 서비스 방식으로 사용량에 따라 비용을 지불하며, Jina API 키가 필요합니다. Elastic Inference Service(EIS)는 Elastic Cloud에서 Jina 모델을 실행하며, 비용은 Elastic 구독료에 포함되므로 인프라를 관리할 필요가 없습니다. Jina On-Prem은 Elastic에서 2026년 8월 10일부터 독립형 SKU로 판매하는 상용 라이선스로, 자체 관리형 온프레미스 또는 물리적으로 격리된 인프라에서 모델을 실행할 수 있습니다. EIS 및 On-Prem 방식에 대한 자세한 내용은 Elastic 영업팀에 문의하세요.
청구 관련 자주 묻는 질문
attach_money
API 요금은 문장 수나 요청 수에 따라 청구되나요?
keyboard_arrow_down
우리의 가격 모델은 처리된 총 토큰 수를 기반으로 하므로 사용자는 이러한 토큰을 원하는 수의 문장에 유연하게 할당할 수 있으며 다양한 텍스트 분석 요구에 맞는 비용 효율적인 솔루션을 제공합니다.
attach_money
신규 사용자가 무료 평가판을 받을 수 있나요?
keyboard_arrow_down
네. 신규 사용자는 모든 모델에서 사용할 수 있는 무료 토큰이 포함된 API 키를 자동으로 받게 됩니다. 무료 토큰을 모두 사용한 후에는 "토큰 구매" 탭에서 해당 키로 토큰을 추가로 구매할 수 있습니다.
attach_money
실패한 요청에 대해 토큰이 차감되나요?
keyboard_arrow_down
아니요, 실패한 요청에 대해서는 토큰이 차감되지 않습니다.
attach_money
어떤 결제 방법이 허용되나요?
keyboard_arrow_down
결제는 Stripe을 통해 처리되며 귀하의 편의를 위해 신용 카드, Google Pay, PayPal을 포함한 다양한 결제 방법을 지원합니다.
attach_money
토큰 구매 시 송장을 발행받을 수 있나요?
keyboard_arrow_down
셀프 서비스 토큰 구매의 경우, Stripe는 구매 시점에 Stripe 계정에 연결된 이메일 주소로 청구서를 발송합니다. 공식 구매 주문서, 협상 계약서, 구매 문서 또는 Stripe 대신 Elastic을 통해 처리되는 통합 청구서가 필요한 경우, Elastic 영업팀에 문의하세요.
attach_money
API 토큰 대신 상업용 라이선스를 구매하려면 어떻게 해야 하나요?
keyboard_arrow_down
이 사이트에서 토큰을 구매하시면 관리형 Jina API 사용 권한만 부여됩니다. 이 토큰에는 자체 인프라에서 모델 가중치를 실행할 수 있는 라이선스가 포함되어 있지 않습니다. 이러한 이유로 Elastic은 2026년 8월 10일부터 해당 라이선스를 토큰 단위가 아닌 연간 단위로 별도 판매하고 있습니다. 견적을 받으시려면 Elastic 영업팀으로 문의하세요.
attach_money
신용카드 대신 송장이나 구매 주문서로 결제할 수 있나요?
keyboard_arrow_down
셀프 서비스 토큰 구매는 Stripe를 통해 처리되며, 청구서는 Stripe 계정 이메일 주소로 자동으로 발송됩니다. 셀프 서비스 충전 지원 한도를 초과하는 구매 주문, 구매 프로세스 또는 거래량의 경우 Elastic 영업팀으로 문의하세요.
attach_money
결제는 완료했는데 잔액이나 사용 한도가 변경되지 않았습니다. 무엇을 확인해야 할까요?
keyboard_arrow_down
잔액 및 사용량 제한은 계정이 아닌 API 키에 적용됩니다. 따라서 계정 페이지가 아닌 API 키 자체를 먼저 확인하세요. "API 키 및 결제" 탭에 키를 입력하여 잔액과 등급을 확인할 수 있습니다. 계정에 여러 개의 키가 있는 경우, 토큰은 애플리케이션에서 실제로 사용 중인 키가 아닌, 이전에 발급받은 키로 지급될 수 있습니다. 또한, 결제 후 새로운 등급이 적용되는 데 약간의 시간이 소요될 수 있습니다. 키에 잔액이 표시되지만 기존 등급으로 제한되는 경우, 고객 지원팀에 문의해 주세요.
attach_money
자동 충전을 취소하거나, 자동 충전 기능을 끄거나, 저장된 결제 수단을 삭제하려면 어떻게 해야 하나요?
keyboard_arrow_down
셀프 서비스 결제는 고객 포털의 "API 키 및 결제" 탭에서 관리할 수 있습니다. 여기에서 자동 충전을 비활성화하고 저장된 결제 수단을 삭제할 수 있습니다. 자동 충전 비활성화는 이후의 금액 차감만 중지하는 것이며, 구매한 잔액은 계속 사용할 수 있습니다. 계정 및 계정 정보를 삭제하거나 환불을 요청하려면 고객 지원팀에 문의해 주세요. 계정 삭제는 수동으로 처리되며 영업일 기준 며칠이 소요됩니다. 삭제가 완료되면 서면으로 확인해 드립니다.
현재 언어 / 테마
Search Foundation
Reader
Embeddings
Reranker
Jina API 키 받기
속도 제한
회사 소개
소식
Jina 로고 다운로드
open_in_new
Elastic 로고 다운로드
open_in_new
API 상태
Elastic © 2026.보안이용약관개인정보 보호쿠키 관리제 개인 정보를 판매하거나 공유하지 마세요.
본 웹사이트와 모든 관련 콘텐츠, 소프트웨어, 제품 및 서비스는 전문 목적 사용을 위한 것입니다. 소비자 사용은 의도되지 않았습니다.