ニュース

検索 AI を加速する、1 トークンずつ。

RSS
注目
学術論文
arXiv
9月 02, 2026
jina-ocr-v1: Efficient Document Parsing with Speculative Decoding and Dense Verifiable Rewards
arXiv
7月 20, 2026
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
SIGIR 2026
5月 11, 2026
jina-embeddings-v5-omni: Geometry-preserving Embeddings via Locked Aligned Towers
SIGIR 2026
2月 17, 2026
jina-embeddings-v5-text: Task-Targeted Embedding Distillation
ICLR 2026
1月 22, 2026
Embedding Compression via Spherical Coordinates
arXiv
12月 29, 2025
Vision Encoders in Vision-Language Models: A Survey
ICLR 2026
12月 04, 2025
Jina-VLM: Small Multilingual Vision Language Model
AAAI 2026
10月 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
NeurIPS 2025
8月 31, 2025
Efficient Code Embeddings from Code Generation Models
EMNLP 2025
6月 24, 2025
jina-embeddings-v4: Universal Embeddings for Multimodal Multilingual Retrieval
ICLR 2025
3月 04, 2025
ReaderLM-v2: Small Language Model for HTML to Markdown and JSON
ACL 2025
12月 17, 2024
AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark
ICLR 2025
12月 12, 2024
jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images
ECIR 2025
9月 18, 2024
jina-embeddings-v3: Multilingual Embeddings With Task LoRA
SIGIR 2025
9月 07, 2024
Late Chunking: Contextual Chunk Embeddings Using Long-Context Embedding Models
EMNLP 2024
8月 30, 2024
Jina-ColBERT-v2: A General-Purpose Multilingual Late Interaction Retriever
WWW 2025
6月 21, 2024
Leveraging Passage Embeddings for Efficient Listwise Reranking with Large Language Models
ICML 2024
5月 30, 2024
Jina CLIP: Your CLIP Model Is Also Your Text Retriever
arXiv
2月 26, 2024
Multi-Task Contrastive Learning for 8192-Token Bilingual Text Embeddings
arXiv
10月 30, 2023
Jina Embeddings 2: 8192-Token General-Purpose Text Embeddings for Long Documents
EMNLP 2023
7月 20, 2023
Jina Embeddings: A Novel Set of High-Performance Sentence Embedding Models
合計で 21 件の論文があります。

9月 14, 2026 • 9 読む時間
jina-ocr-v1:低予算GPUで高速な文書解析を実現
jina-ocr-v1 は、34億のパラメータ数と5億7000万の有効パラメータ数を持つビジョン言語モデルであり、OmniDocBench v1.6 で 91.1、olmOCR-Bench で 83.4 のスコアを記録しています。
8月 03, 2026 • 11 読む時間
jina-reranker-v3.5: ハイブリッドアテンションと自己蒸留による高速なリストワイズ・リランカー
BEIRベンチマークで Qwen3-Reranker-4B を上回る性能を発揮し、v3 と比較して最大 1.56 倍の高速化を実現。さらに、半構造化データ検索において nDCG@10 で 9.6 ポイントの向上を達成した 0.6B のリストワイズ型重排器。
5月 12, 2026 • 7 読む時間
jina-embeddings-v5-omni:テキスト、画像、音声、動画のための向量模型
1つのモデルで、テキスト、画像、音声、動画という4つのモダリティに対応。1.6Bおよび0.9Bのクラス最高レベルのオムニ・ベクトルモデルです。
3月 11, 2026 • 7 読む時間
マルチモーダル大模型からのオーディオベクトルモデルのブートストラップ
任意のマルチモーダル LLM を、25分の1のデータ量で CLAP を凌駕する小規模なオーディオ埋め込みモデルへと変換。
3月 06, 2026 • 6 読む時間
生の数値から埋め込みモデルを特定する
生の数値を読み取ることで埋め込みモデルをフィンガープリント化する、小さな Transformer。特徴量エンジニアリングは不要。
2月 19, 2026 • 7 読む時間
jina-embeddings-v5-text: 新しい SOTA 小型多言語ベクトルモデル
<input> 1B 未満の最高の性能を誇る 2 つの多言語対応ベクトルモデル(Embeddings)が、Elastic Inference Service、Llama.cpp、および MLX で利用可能になりました。 </input>
12月 04, 2025 • 7 読む時間
Jina-VLM: 小規模多言語Vision Language Model
新しい2BのVision Language Modelが、多言語VQAでSOTAを達成し、テキストのみのタスクでは壊滅的な忘却が発生しません。
10月 03, 2025 • 7 読む時間
Jina Reranker v3: SOTA多言語検索向け0.6B Listwise 重排器
クエリとすべての候補ドキュメントを単一のコンテキストウィンドウで考慮する、新しい0.6Bパラメータのリストワイズ重排器。
9月 09, 2025 • 11 読む時間
Llama.cpp と GGUF におけるマルチモーダル 向量模型
llama.cpp と GGUF にマルチモーダルなベクトルモデルを導入し、その過程でいくつかの意外な問題を発見しました。
9月 04, 2025 • 6 読む時間
Jina Code Embeddings: 0.5B および 1.5B で SOTA のコード検索を実現
コード生成LLM → コードのベクトルモデル:0.5B/1.5Bのモデルが25のコード検索ベンチマークでSOTA(最高性能)を達成。