NeoMME Collection Meet NeoMME: a family of 260M and 800M Multimodal-Native Multilingual Encoders • 12 items • Updated 8 days ago • 30
view article Article Training and Finetuning Multi-Vector Embedding Models with Sentence Transformers tomaarsen • 16 days ago • 125
view article Article mDenseOn with the mLateOn: Open Multilingual, Long-Context, and Code Retrieval Models lightonai • Jul 30 • 37
mDenseOn & mLateOn Collection A collection of open state-of-the-art single and multi-vector models and datasets for multilingual, long context and code retrieval • 19 items • Updated Aug 6 • 18
SHIFT: Semantic Harmonization via Index-side Feature Transformation for Multilingual Information Retrieval Paper • 2606.18801 • Published Jun 17 • 2
MIMO: Multilingual Information Retrieval via Monolingual Objectives Paper • 2605.31171 • Published May 29 • 4
SemBridge: Language Transfer in Sparse Encoders via Multilingual Semantic Bridges Paper • 2605.26002 • Published May 25 • 6
MLAIRE: Multilingual Language-Aware Information Retrieval Evaluation Protocal Paper • 2605.07249 • Published May 8 • 5
LAMAR: An Open Language-Aware Multilingual Alignment Reranker Paper • 2607.22042 • Published Jul 24 • 17
view article Article NVIDIA Nemotron 3 Embed Ranks #1 Overall on RTEB, Advancing Agentic Retrieval nvidia • Jul 16 • 59
Inference-Free Multimodal Learned Sparse Retrieval for Production-Scale Visual Document Search Paper • 2605.30917 • Published May 29 • 8
jina-embeddings-v5-text: Task-Targeted Embedding Distillation Paper • 2602.15547 • Published Feb 17 • 31
Is Position Bias in Dense Retrievers Built In-or Learned from Data? Paper • 2605.26578 • Published May 26 • 21
DenseOn & LateOn Collection A collection of open state-of-the-art single and multi-vector models for English retrieval • 9 items • Updated Jul 30 • 13
view article Article DenseOn with the LateOn: Open State-of-the-Art Single and Multi-Vector Models lightonai • Apr 21 • 45
view article Article Training and Finetuning Multimodal Embedding & Reranker Models with Sentence Transformers tomaarsen • Apr 16 • 81
e5-omni: Explicit Cross-modal Alignment for Omni-modal Embeddings Paper • 2601.03666 • Published Jan 7 • 5