Skip to main content

Jina CLIP v2

Jina AI 📐 Embedding

Jina AI's CLIP model, cross-modal text-image embeddings supporting 89 languages with Matryoshka representations. 865M params.

Specifications

Input modalitiestext, image
Output modalitiesembedding
Relative speed●●●●○ Fast
Context window8,192 tokens
Input price$0.0875 / 1M

Pricing

$0.0875 / 1M input tokens

Platform credit pricing — live rates on the Models page.