개요
jina-reranker-v2-base-multilingual는 278M 파라미터의 크로스 엔코더 리랭커로, 1,024토큰 컨텍스트 윈도우(Flash Attention 2 사용 시 524,288토큰)로 100개 이상의 언어를 지원합니다. 영어 전용 제한을 깬 최초의 Jina 리랭커로, AirBench에서 SOTA 성능을 달성하고 함수 호출 및 SQL 스키마 매칭을 포함한 구조화 데이터 작업에서 강한 결과를 보여주었습니다. 비교 가능한 모델보다 문서를 15배 빠르게 처리합니다.
방법
모델은 Flash Attention 2로 강화된 크로스 엔코더 아키텍처를 사용해 언어 장벽을 넘어 쿼리와 문서를 직접 비교할 수 있게 합니다. 278M 파라미터의 BERT 기반 인코더는 1,024토큰 기본 컨텍스트(Flash Attention 2로 524,288토큰까지 확장 가능)에 대해 대칭 양방향 어텐션과 ALiBi 위치 인코딩을 사용합니다. 학습은 4단계 점진적 과정을 따랐습니다: (1) 영어 언어 능력, (2) 크로스 언어 정렬, (3) 다국어 데이터 도입, (4) 어려운 음의 정제. 이 단계별 접근은 단일 언어 모델에 다국어 데이터를 추가할 때 흔히 발생하는 재난적 망각을 방지했습니다. Flash Attention 2 구현은 핵심 효율성 혁신으로, bge-reranker-v2-m3 대비 15배 높은 처리량을 가능하게 합니다.
성능
모델은 RAG 시스템을 위한 AirBench 리더보드에서 SOTA 성능을 달성하고 MKQA(26개 언어)에서 강한 결과를 보입니다. 구조화 데이터 작업에서 뛰어납니다: ToolBench(함수 호출)의 높은 리콜과 NSText2SQL(SQL 스키마 매칭). 가장 인상적인 점은 bge-reranker-v2-m3과 같은 비교 가능한 모델보다 문서를 15배 빠르게 처리해 실시간 적용에 실용적이라는 것입니다. 100개 이상의 언어 지원과 구조화 데이터 처리 능력은 에이전틱 RAG 시스템과 다국어 API 문서 검색에 특히 적합합니다. 2026년에 jina-reranker-v3.5가 리스트와이즈 상호작용, 131K 컨텍스트, 도메인별 학습으로 이 모델을 대체합니다.
모범 사례
모델은 CUDA 지원 GPU가 필요하며 Jina Reranker API, 주요 RAG 프레임워크(Haystack, LangChain), 클라우드 마켓플레이스(AWS, Azure, GCP)를 통해 접근 가능합니다. 언어 장벽과 데이터 유형을 넘어 정확한 이해가 필요한 시나리오에서 강합니다: 다국어 콘텐츠를 다루는 글로벌 기업, API 문서 검색, 다국어 코드베이스에 걸친 코드 검색. 1,024토큰 컨텍스트 윈도우와 긴 문서용 자동 청킹으로 긴 콘텐츠를 효율적으로 처리합니다. 언어 간 검색 정확도를 향상하거나, 에이전틱 RAG를 위한 함수 호출 능력, 또는 다국어 코드베이스의 코드 검색 개선이 필요할 때 이 모델을 사용하세요. 새 프로젝트에는 jina-reranker-v3.5가 리스트와이즈 랭킹, 131K 컨텍스트, 도메인별 개선 사항을 제공합니다.









