J
Jina CLIP v2
Jina AI
📐 Embedding
Jina AI's CLIP model, cross-modal text-image embeddings supporting 89 languages with Matryoshka representations. 865M params.
Specifications
Input modalitiestext, image
Output modalitiesembedding
Relative speed●●●●○ Fast
Context window8,192 tokens
Vision inputYes
Input price$0.0875 / 1M
Pricing
$0.0875 / 1M input tokens
Platform credit pricing — live rates on the Models page.