Jina Embeddings v3
8K context multilingual embedding with task-specific LoRAs
Verdict
Long context embeddings up to 8192 tokens — ideal for document-level retrieval. Task-specific LoRA adapters for retrieval, classification, and similarity. Good API and open weights.
Other Embedding Models
- text-embedding-3-largeProduction
OpenAI's most capable embedding model with 3072 dimensions
- Gemini EmbeddingProduction
Google's unified embedding model — topped the MTEB multilingual leaderboard at launch
- Cohere Embed v3Production
Multilingual embedding model optimised for search and RAG
- Voyage AI 3Production
Specialised embeddings for code, legal, finance, and multilingual
- BGE-M3Stable
BAAI multi-granularity multilingual embedding with dense + sparse
- E5-Mistral-7BStable
Large LLM-based embedding model for maximum retrieval quality

