Répertoire de modèles IA
Chaque modèle. Chaque fournisseur. Données en direct, prix réels, capacités honnêtes. Mis à jour quotidiennement par notre moniteur API.
Données en direct — mis à jour quotidiennement
Capture de performance par IA. Téléchargez une image de personnage + votre vidéo de performance pour transférer votre mouvement au personnage.
$0.0875/unit
videoimage
🎬 VidéoEn savoir plus →
nouveau
Runway's current video-to-video model. Edit existing footage with text prompts; accepts 2-30 second inputs.
$0.4900/unit
video
🎬 VidéoEn savoir plus →
Synthèse vocale ultra-rapide en temps réel optimisée pour les applications à faible latence
In: $0.0192/1M
🗣 VoixEn savoir plus →
Synthèse vocale multilingue prenant en charge 15 langues dont l'arabe, le japonais et le chinois
In: $0.0192/1M
🗣 VoixEn savoir plus →
Synthèse vocale haute qualité avec prosodie naturelle et expression émotionnelle dans 15 langues
In: $0.0192/1M
🗣 VoixEn savoir plus →
Modèle de synthèse vocale original de Deepgram — 12 voix anglaises à moitié prix d'Aura 2. Rapide et fiable.
In: $0.0262/1M
Stream
🗣 VoixEn savoir plus →
Dernier modèle de synthèse vocale de Deepgram — plus de 90 voix naturelles dans 8 langues (EN, FR, DE, ES, IT, NL, JA), latence inférieure à 200 ms. Noms de voix inspirés de la mythologie grecque.
In: $0.0525/1M
Stream
🗣 VoixEn savoir plus →
Modèle de synthèse vocale stable de Sarvam pour les langues indiennes et l'anglais. Retourne de l'audio WAV encodé en base64. Qualité constante en production.
In: $0.000315/1M
🗣 VoixEn savoir plus →
Dernier modèle de synthèse vocale de Sarvam — plus de 30 voix dans les langues indiennes et l'anglais. Prosodie naturelle avec intonation culturelle. Actuellement en bêta.
In: $0.000630/1M
🗣 VoixEn savoir plus →
ByteDance Seed 1.8, multimodal agent model (text, image & video in → text), strong tool use + reasoning, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000438/1MOut: $0.0035/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
ByteDance Seed 2.0 Code (preview), coding-specialized agent (text & image in → text), strong tool use + reasoning. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000875/1MOut: $0.0053/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
ByteDance Seed 2.0 Lite, efficient multimodal agent (text, image & video in → text), tool use + reasoning, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000438/1MOut: $0.0035/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
ByteDance Seed 2.0 Mini, fast lightweight multimodal agent (text, image & video in → text), tool use. Native via BytePlus (Ark).
131K ctx33K sortieIn: $0.000175/1MOut: $0.000700/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
ByteDance Seed 2.0 Pro, flagship multimodal agent (text, image & video in → text), strong tool use + reasoning, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000875/1MOut: $0.0053/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
ByteDance Seed 2.1 Turbo, fast multimodal reasoning agent (text & image in → text), strong tool use + thinking, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000875/1MOut: $0.0044/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Modèle spécialisé pour la génération, la complétion et la compréhension de code.
262K ctx8K sortieIn: $0.000525/1MOut: $0.0016/1M
Streamchat
💬 LLMEn savoir plus →
Génération vidéo 10 secondes, 4K, 60 ips avec physique réaliste.
$0.3500/unit
image
🎬 VidéoEn savoir plus →
Modèle d'image open source SOTA. Support natif du texte chinois, 6B paramètres.
$0.0175/unit
🎨 ImageEn savoir plus →
Traduction automatique neuronale de haute qualité prenant en charge 33 langues
In: $0.0437/1M
🌐 TraductionEn savoir plus →
DeepSeek V4 Flash, fast, cost-effective daily driver. 1M context, thinking + non-thinking modes.
1M ctx66K sortieIn: $0.000385/1MOut: $0.0012/1M
ToolsStreamchatreasoningtools
💬 LLMEn savoir plus →
DeepSeek flagship V4. 512K context, advanced reasoning + tool use.
524K ctx66K sortieIn: $0.0012/1MOut: $0.0035/1M
ToolsStreamchatreasoningtools
💬 LLMEn savoir plus →
Modèle TTS le plus expressif avec balises audio, mode dialogue, émulation d'accent et plus de 70 langues. Idéal pour le contenu long.
In: $0.3850/1M
🗣 VoixEn savoir plus →
Extension de l'image au-delà de ses bords par outpainting IA
$0.0350/unit
image
🎨 ImageEn savoir plus →
Fable 5 by Anthropic.
1M ctx128K sortieIn: $0.0175/1MOut: $0.0875/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
TTS à latence ultra-faible pour l'IA conversationnelle en temps réel. ~75 ms de latence.
In: $0.1925/1M
🗣 VoixEn savoir plus →
Le meilleur de FLUX, offrant une génération d'images à la pointe de la technologie à une vitesse fulgurante
$0.0700/unit
🎨 ImageEn savoir plus →
Un modèle premium offrant des performances maximales sur tous les aspects — qualité, cohérence et vitesse grandement améliorées
$0.1400/unit
🎨 ImageEn savoir plus →
Un modèle unifié offrant édition locale, modifications génératives et génération texte-vers-image
$0.0700/unit
🎨 ImageEn savoir plus →
Directement distillé de FLUX.1 [pro], un modèle à poids ouverts distillé par guidance pour un usage non commercial
$0.0437/unit
🎨 ImageEn savoir plus →
Génération d'images à la pointe avec un suivi de prompt et une qualité visuelle de premier ordre
$0.0875/unit
🎨 ImageEn savoir plus →
Spécialisé dans la typographie et le rendu de texte avec guidance et étapes de génération ajustables
$0.0875/unit
🎨 ImageEn savoir plus →
Modèle FLUX open source ultra-rapide optimisé pour la génération en temps réel au moindre coût. Licence Apache 2.0.
$0.0245/unit
🎨 ImageEn savoir plus →
Modèle FLUX le plus rapide avec inférence en moins d'une seconde. 9B paramètres avec encodeur de texte Qwen3 pour une compréhension supérieure des prompts.
$0.0262/unit
🎨 ImageEn savoir plus →
FLUX 2.0 de la plus haute qualité avec capacité de recherche ancrée pour des images photoréalistes jusqu'à 4 mégapixels
$0.1400/unit
🎨 ImageEn savoir plus →
FLUX 2.0 de qualité production avec édition multi-référence et contrôle précis des couleurs, poses et composition
$0.0525/unit
🎨 ImageEn savoir plus →
Sakana's multi-agent conductor, orchestrates a pool of frontier models for complex reasoning. Billed per token, orchestration included.
272K ctx16K sortieIn: $0.0088/1MOut: $0.0525/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Modèle rapide et efficace avec réflexion adaptative pour les tâches complexes
1M ctx66K sortieIn: $0.000525/1MOut: $0.0044/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Synthèse vocale à faible latence de Google avec prosodie naturelle et style contrôlable. Prend en charge 24 langues.
In: $0.0350/1M
🗣 VoixEn savoir plus →
Modèle haut débit économique pour les applications soucieuses du budget
1M ctx66K sortieIn: $0.000175/1MOut: $0.000700/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Réflexion et raisonnement améliorés pour les problèmes complexes
1M ctx66K sortieIn: $0.0022/1MOut: $0.0175/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Synthèse vocale premium avec expressivité améliorée, tonalité plus riche et rythme précis. Idéal pour une sortie de haute qualité.
In: $0.0700/1M
🗣 VoixEn savoir plus →
Le modèle de pointe le plus rapide de Google. Surpasse le 2.5 Pro à 1/4 du coût avec un contexte de 1M
1M ctx66K sortieIn: $0.000875/1MOut: $0.0053/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Latest price-performant, low-latency controllable speech generation. 30 voices, 24 languages.
In: $0.0700/1M
🗣 VoixEn savoir plus →
Cost-efficient high-throughput model for budget-conscious applications.
1M ctx66K sortieIn: $0.000438/1MOut: $0.0026/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Modèle agentique le plus performant de Google avec contexte de 1M de tokens, 77,1 % ARC-AGI-2 en raisonnement et utilisation native d'outils.
1M ctx66K sortieIn: $0.0035/1MOut: $0.0210/1M
ToolsStreamtoolsreasoningimage+2
💬 LLMEn savoir plus →
Fast flagship with adaptive thinking for complex tasks.
1M ctx66K sortieIn: $0.0026/1MOut: $0.0158/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Cost-efficient GA Flash model for high-throughput multimodal tasks.
1M ctx66K sortieIn: $0.000525/1MOut: $0.0044/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Google's latest GA Flash model for fast multimodal reasoning and agentic workloads.
1M ctx66K sortieIn: $0.0026/1MOut: $0.0131/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
nouveau
Google's most capable Flash model for agentic workflows and multimodal reasoning.
1.048576M ctx66K sortieIn: $0.0026/1MOut: $0.0131/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Cost-efficient text embeddings — 3072-dim vectors for search, clustering, and RAG.
In: $0.000262/1M
🔍 EmbeddingEn savoir plus →
Google's latest embedding model — 3072-dim vectors for retrieval and semantic search (multimodal upstream; text wired).
In: $0.000350/1M
🔍 EmbeddingEn savoir plus →
Google's open-weight mixture-of-experts model, 26B total, 4B active parameters for fast inference
262K ctx33K sortieIn: $0.000105/1MOut: $0.000577/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Google's open-weight dense model with 262K context and strong multilingual reasoning
262K ctx33K sortieIn: $0.000245/1MOut: $0.000700/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Transformez des images de référence avec des prompts textuels. Préserve l'identité tout en modifiant la pose, l'éclairage et l'arrière-plan.
$0.0875/unit
image
🎨 ImageEn savoir plus →
Génération d'images rapide basée sur référence. 2,5 fois plus rapide, préserve l'identité et le style.
$0.0350/unit
image
🎨 ImageEn savoir plus →
Modèle phare image-vers-vidéo de Runway. Fidélité, stabilité et contrôlabilité exceptionnelles. Nécessite une image en entrée.
$0.0875/unit
image
🎬 VidéoEn savoir plus →
Modèle vidéo le plus performant de Runway. N°1 sur le benchmark texte-vers-vidéo d'Artificial Analysis. Texte-vers-vidéo ou image-vers-vidéo avec physique et mouvement humain exceptionnels.
$0.2100/unit
image
🎬 VidéoEn savoir plus →
Précédent modèle phare avec mode de réflexion. Architecture MoE, contexte 128K.
128K ctx8K sortieIn: $0.0010/1MOut: $0.0039/1M
Streamreasoning
💬 LLMEn savoir plus →
Modèle léger optimisé pour l'efficacité. Contexte 128K.
128K ctx8K sortieIn: $0.000350/1MOut: $0.0019/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Modèle de niveau gratuit. Idéal pour les tests et les charges de travail légères.
128K ctx4K sortie
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Vision-language model for image understanding and analysis.
66K ctx16K sortieIn: $0.0010/1MOut: $0.0032/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Modèle phare avec raisonnement, code et capacités agentiques. Contexte 128K.
128K ctx8K sortieIn: $0.0010/1MOut: $0.0039/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Modèle avec vision pour la compréhension et l'analyse d'images.
128K ctx8K sortieIn: $0.000525/1MOut: $0.0016/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Modèle de vision gratuit. Idéal pour tester la compréhension d'images.
128K ctx4K sortie
Streamimage
💬 LLMEn savoir plus →
Modèle de vision léger. Rapide et économique pour les tâches d'image.
128K ctx4K sortieIn: $0.000070/1MOut: $0.000700/1M
ToolsStreamreasoningtoolsimage
💬 LLMEn savoir plus →
Dernier modèle phare. 358B paramètres, contexte 204K, sortie 131K. N°1 sur LiveCodeBench.
205K ctx131K sortieIn: $0.0010/1MOut: $0.0039/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Lightweight, completely free GLM-4.7 variant with 200K context.
205K ctx131K sortie
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Lightweight, high-speed and affordable GLM-4.7 variant with 200K context.
205K ctx131K sortieIn: $0.000122/1MOut: $0.000700/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Modèle Zhipu le plus performant. 744B paramètres (40B actifs MoE), 28,5T tokens d'entraînement. Conçu pour l'ingénierie de systèmes complexes et les tâches agentiques.
205K ctx131K sortieIn: $0.0018/1MOut: $0.0056/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Variante rapide de GLM-5 avec vitesse optimisée et qualité compétitive.
In: $0.0021/1MOut: $0.0070/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Z.ai's current flagship for agentic and coding tasks.
205K ctx131K sortieIn: $0.0024/1MOut: $0.0077/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Z.ai's latest flagship for agentic and coding tasks.
205K ctx131K sortieIn: $0.0024/1MOut: $0.0077/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
nouveau
Z.ai's newest flagship for agentic and coding tasks. Always reasons; text-only input.
205K ctx131K sortieIn: $0.0024/1MOut: $0.0077/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
nouveau
Z.ai's fast, low-cost GLM-5.3 variant: 1M context, tools, always reasons; text and image input.
1M ctx131K sortieIn: $0.000262/1MOut: $0.000875/1M
ToolsStreamtoolsreasoningvision+1
💬 LLMEn savoir plus →
Native multimodal coding model. 744B MoE (40B active), 203K context. Optimized for design-to-code, GUI automation, and vision-grounded agentic tasks.
205K ctx131K sortieIn: $0.0021/1MOut: $0.0070/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Z.ai's image generation model with strong prompt adherence and text rendering.
$0.0262/unit
🎨 ImageEn savoir plus →
Specialized OCR model for extracting text from images and documents.
8K ctx8K sortieIn: $0.000053/1MOut: $0.000053/1M
Streamimage
OpenAI's latest image generation model (high-quality tier).
$0.3693/unit
imageimage_editimage
🎨 ImageEn savoir plus →
OpenAI GPT-3.5 Turbo (chat completions endpoint).
In: $0.000875/1MOut: $0.0026/1M
tools
💬 LLMEn savoir plus →
OpenAI GPT-3.5 Turbo 16K (chat completions endpoint).
In: $0.0053/1MOut: $0.0070/1M
tools
💬 LLMEn savoir plus →
OpenAI GPT-4 Turbo (chat completions endpoint).
In: $0.0175/1MOut: $0.0525/1M
toolsvisionimage
💬 LLMEn savoir plus →
OpenAI GPT-4.1 (chat completions endpoint).
1.047576M ctx33K sortieIn: $0.0035/1MOut: $0.0140/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-4.1 Mini (chat completions endpoint).
1.047576M ctx33K sortieIn: $0.000700/1MOut: $0.0028/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-4o (chat completions endpoint).
128K ctx16K sortieIn: $0.0044/1MOut: $0.0175/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-4o Mini (chat completions endpoint).
128K ctx16K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-5 (chat completions endpoint).
272K ctx128K sortieIn: $0.0022/1MOut: $0.0175/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-5 Mini (chat completions endpoint).
272K ctx128K sortieIn: $0.000438/1MOut: $0.0035/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-5 Nano (chat completions endpoint).
272K ctx128K sortieIn: $0.000087/1MOut: $0.000700/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-5 Pro (chat completions endpoint).
272K ctx128K sortieIn: $0.0262/1MOut: $0.2100/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
OpenAI GPT-5 Search API (chat completions endpoint).
272K ctx128K sortieIn: $0.0022/1MOut: $0.0175/1M
Streamweb_searchimage
💬 LLMEn savoir plus →
OpenAI GPT-5.1 (chat completions endpoint).
272K ctx128K sortieIn: $0.0022/1MOut: $0.0175/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-5.2 (chat completions endpoint).
272K ctx128K sortieIn: $0.0031/1MOut: $0.0245/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-5.2 Pro (chat completions endpoint).
272K ctx128K sortieIn: $0.0367/1MOut: $0.2940/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
OpenAI GPT-5.3 Codex (chat completions endpoint).
272K ctx128K sortieIn: $0.0031/1MOut: $0.0245/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
OpenAI mid-tier flagship (March 2026).
272K ctx128K sortieIn: $0.0044/1MOut: $0.0262/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI fast/cheap chat model.
272K ctx128K sortieIn: $0.0013/1MOut: $0.0079/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI cheapest tier, very fast.
272K ctx128K sortieIn: $0.000350/1MOut: $0.0022/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI GPT-5.4 Pro (chat completions endpoint).
272K ctx128K sortieIn: $0.0525/1MOut: $0.3150/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
OpenAI flagship chat model (April 2026 release).
272K ctx128K sortieIn: $0.0088/1MOut: $0.0525/1M
ToolsStreamtoolsimage
💬 LLMEn savoir plus →
OpenAI premium tier with deep reasoning. April 2026.
272K ctx128K sortieIn: $0.0525/1MOut: $0.3150/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
OpenAI GPT-5.6 Luna — high-volume streaming tasks, fast + economical 5.6 tier.
272K ctx128K sortieIn: $0.0018/1MOut: $0.0105/1M
ToolsStreamtoolsreasoningvision+1
💬 LLMEn savoir plus →
OpenAI GPT-5.6 Sol — frontier logic + deep reasoning, the flagship 5.6 tier.
272K ctx128K sortieIn: $0.0088/1MOut: $0.0525/1M
ToolsStreamtoolsreasoningvision+1
💬 LLMEn savoir plus →
OpenAI GPT-5.6 Terra — balanced business logic, mid 5.6 tier.
272K ctx128K sortieIn: $0.0044/1MOut: $0.0262/1M
ToolsStreamtoolsreasoningvision+1
💬 LLMEn savoir plus →
Non-reasoning variant of Grok 4.20. Fastest 4.20 path for chat and high-throughput tasks.
1M ctx8K sortieIn: $0.0022/1MOut: $0.0044/1M
ToolsStreamchattoolsimage
💬 LLMEn savoir plus →
Reasoning-mode variant of Grok 4.20. Slower but stronger on multi-step problems.
1M ctx8K sortieIn: $0.0022/1MOut: $0.0044/1M
ToolsStreamchatreasoningtools+1
💬 LLMEn savoir plus →
xAI's flagship general-purpose model. 1M context, balanced reasoning and chat.
1M ctx8K sortieIn: $0.0022/1MOut: $0.0044/1M
ToolsStreamchattoolsreasoning+1
💬 LLMEn savoir plus →
xAI's newest flagship, launched July 2026. 500K context, strongest reasoning + coding, trained alongside Cursor.
500K ctx8K sortieIn: $0.0035/1MOut: $0.0105/1M
ToolsStreamchattoolsreasoning+1
💬 LLMEn savoir plus →
nouveau
xAI's newest flagship. 500K context, accepts text and images, strongest reasoning + coding.
500K ctx8K sortieIn: $0.0035/1MOut: $0.0105/1M
ToolsStreamchattoolsreasoning+1
💬 LLMEn savoir plus →
Compact model tuned for code generation and structured output. 256K context.
256K ctx8K sortieIn: $0.0018/1MOut: $0.0035/1M
ToolsStreamchattoolsimage
💬 LLMEn savoir plus →
Fast text-to-image generation from xAI. Standard quality, lowest cost.
$0.0350/unit
🎨 ImageEn savoir plus →
nouveau
xAI's current image model. Higher fidelity than Grok Imagine, with stronger prompt adherence.
$0.1050/unit
🎨 ImageEn savoir plus →
Higher-fidelity Grok Imagine. Better prompt adherence and detail, 2.5x the cost.
$0.0875/unit
🎨 ImageEn savoir plus →
xAI Grok Imagine 1.5 — image-to-video: animates a starting frame from your prompt. Up to 1080p, 1-15s clips, async render.
image
🎬 VidéoEn savoir plus →
xAI's expressive text-to-speech — 26 multilingual voices with inline speech tags for tone, pauses, whispers and laughter. 20+ languages with auto-detection.
In: $0.0262/1M
🗣 VoixEn savoir plus →
Le modèle Haiku le plus rapide et intelligent de Claude
200K ctx64K sortieIn: $0.0018/1MOut: $0.0088/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Résolution supérieure (1080p), durée plus longue (10 s), meilleure adhérence au prompt
$0.4900/unit
image
🎬 VidéoEn savoir plus →
Avancées en mouvement corporel, expressions faciales et réalisme physique
$0.4900/unit
image
🎬 VidéoEn savoir plus →
Modèle image-vers-vidéo optimisé pour la rentabilité et l'efficacité (nécessite le téléchargement d'une image)
$0.3325/unit
image
🎬 VidéoEn savoir plus →
Arabic-first speech-to-text with dialect-aware recognition and broad multilingual coverage.
$0.000292/unit
audio
📝 TranscriptionEn savoir plus →
Arabic-first text-to-speech, low-latency tier, with 50 voices spanning Arabic dialects and 20+ languages.
In: $0.0700/1M
🗣 VoixEn savoir plus →
Alibaba HappyHorse image-to-video. Animates a still image into a coherent motion sequence guided by text.
$0.2450/unit
videoimage
🎬 VidéoEn savoir plus →
Alibaba HappyHorse reference-to-video. Generates video conditioned on a reference image plus text prompt.
$0.2450/unit
videoimage
🎬 VidéoEn savoir plus →
Alibaba HappyHorse text-to-video. Generates short cinematic clips from text prompts.
$0.2450/unit
video
🎬 VidéoEn savoir plus →
Alibaba HappyHorse 1.1 image-to-video. Animates a still image into coherent motion guided by text (native DashScope, US-Virginia).
videoimage
🎬 VidéoEn savoir plus →
Alibaba HappyHorse 1.1 reference-to-video. Generates video that preserves the subject and scene from one or more reference images (native DashScope, US-Virginia).
videoimage
🎬 VidéoEn savoir plus →
Alibaba HappyHorse 1.1 text-to-video. Generates short cinematic clips from text prompts (native DashScope, US-Virginia).
video
🎬 VidéoEn savoir plus →
Alibaba HappyHorse video editing. Edits a source video from natural-language instructions, optionally guided by reference images (native DashScope, US-Virginia).
videovideoimage
🎬 VidéoEn savoir plus →
Modèle de génération précédente. Toujours excellent pour le rendu de texte à moindre coût.
$0.1050/unit
🎨 ImageEn savoir plus →
Génération d'images à la pointe avec un rendu de texte exceptionnel. Meilleur équilibre qualité-vitesse.
$0.1225/unit
🎨 ImageEn savoir plus →
Ideogram 3.0 de la plus haute qualité. Détail et fidélité maximaux pour les rendus finaux.
$0.1750/unit
🎨 ImageEn savoir plus →
Variante turbo d'Ideogram 3.0. Génération rapide pour les flux de travail itératifs.
$0.0700/unit
🎨 ImageEn savoir plus →
Génération texte-vers-image de qualité cinématique avec haute fidélité au prompt
$0.0061/unit
🎨 ImageEn savoir plus →
Modèle CLIP de Jina AI — embeddings cross-modaux texte-image prenant en charge 89 langues avec représentations Matryoshka. 865M paramètres.
8K ctxIn: $0.000087/1M
image
🔍 EmbeddingEn savoir plus →
Modèle d'embedding spécialisé code de Jina AI — 1,5B paramètres optimisés pour la recherche et la récupération de code. Contexte 32K.
33K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
Modèle ColBERT à interaction tardive de Jina AI — embeddings multi-vecteurs pour une recherche fine, 89 langues, tailles d'embedding contrôlables par l'utilisateur.
8K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
Modèle d'embedding textuel multilingue 570M de Jina AI — champion du benchmark MTEB, contexte 8K, 89 langues.
8K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
Dernier modèle d'embedding multimodal de Jina AI — intègre texte et images dans un espace vectoriel partagé avec contexte 32K. Qualité de recherche à la pointe.
33K ctxIn: $0.000087/1M
image
🔍 EmbeddingEn savoir plus →
Reranker multimodal de Jina AI — reclasse les résultats contenant texte et images pour les pipelines de recherche cross-modale.
10K ctxIn: $0.000087/1M
image
↕️ RerankingEn savoir plus →
Dernier reranker de Jina AI — architecture listwise inédite, SOTA en recherche multilingue, fenêtre de contexte massive de 131K. 0,6B paramètres.
134K ctxIn: $0.000087/1M
↕️ RerankingEn savoir plus →
Latest Kimi K2 reasoning model. Replaces K2 thinking variants (k2-thinking and k2-thinking-turbo) being retired 2026-05-25.
262K ctx131K sortieIn: $0.0017/1MOut: $0.0070/1M
ToolsStreamchatreasoningfunction_calling+1
💬 LLMEn savoir plus →
Coding-specialized Kimi K2 model (k2.7). 256K context, agentic tool use and function calling, tuned for software engineering.
262K ctx131K sortieIn: $0.0017/1MOut: $0.0070/1M
ToolsStreamchatreasoningfunction_calling+1
💬 LLMEn savoir plus →
High-speed variant of Kimi K2.7 Code for low-latency agentic software engineering.
262K ctx131K sortieIn: $0.0017/1MOut: $0.0070/1M
ToolsStreamchatreasoningfunction_calling+1
💬 LLMEn savoir plus →
Moonshot's open-weight 2.8T-parameter multimodal reasoning model with a 1M-token context window.
1.048576M ctx131K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamchatreasoningfunction_calling+2
💬 LLMEn savoir plus →
Modèle haute vitesse orienté anime excelling dans une gamme de styles anime.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
Modèle principal Leonardo avec des rendus époustouflants et une large gamme de styles.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
Modèle orienté cinéma excelling dans les compositions et éclairages de type film.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
Modèle de génération d'images généraliste haute vitesse pour une itération rapide.
$0.0140/unit
generation
🎨 ImageEn savoir plus →
Modèle polyvalent excelling dans le réalisme et la photographie.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
Generate sound effects for longer videos (SFX 1.6), up to 60 seconds of audio from a video URL.
$0.1750/unit
video
🔊 Effets sonoresEn savoir plus →
Modèle Leonardo pour une imagerie vibrante et diversifiée en sortie HD.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
Modèle Leonardo haute vitesse conçu pour des rendus photoréalistes.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
Google DeepMind's latest music generation — 30-second compositions from text prompts with SynthID watermarking.
$0.0700/unit
🎵 MusiqueEn savoir plus →
Full-song generation from Google DeepMind's Lyria 3 — complete compositions from text prompts with SynthID watermarking.
$0.1400/unit
🎵 MusiqueEn savoir plus →
Capacités agentiques avec raisonnement avancé et visibilité du processus de réflexion
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
💬 LLMEn savoir plus →
Optimisé pour la haute concurrence et l'usage commercial avec raisonnement avancé
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
💬 LLMEn savoir plus →
Modèle de raisonnement de pointe avec code SOTA, utilisation agentique d'outils et performance sur des tâches complexes
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
💬 LLMEn savoir plus →
Variante rapide de M2.5 optimisée pour la vitesse à environ 100 tokens par seconde
In: $0.0010/1MOut: $0.0042/1M
ToolsStream
💬 LLMEn savoir plus →
Autonomous real-world productivity with agentic collaboration, live debugging, and professional document generation
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
💬 LLMEn savoir plus →
nouveau
Fast variant of M2.7 for latency-sensitive work. 200K context, text only.
200K ctx128K sortieIn: $0.0010/1MOut: $0.0042/1M
ToolsStreamtools
💬 LLMEn savoir plus →
Modèle de raisonnement efficace pour les tâches logiques quotidiennes.
131K ctx40K sortieIn: $0.000875/1MOut: $0.0026/1M
Streamchatreasoning
💬 LLMEn savoir plus →
Modèle d'embedding vidéo multimodal de Twelve Labs. Convertit vidéo, audio et texte en un espace vectoriel partagé pour la recherche sémantique dans 36 langues.
$0.000963/unit
embeddingsearchvideoaudioimage
🔍 EmbeddingEn savoir plus →
Transform images into detailed 3D models with textures and PBR maps
$1.05/unit
3d-generationimage
📦 3DEn savoir plus →
Generate detailed 3D models from text descriptions with PBR textures
$1.05/unit
3d-generation
📦 3DEn savoir plus →
nouveau
Transform images into detailed 3D models with the highest image alignment Meshy has shipped, textures and PBR maps
$1.05/unit
3d-generationimage
📦 3DEn savoir plus →
nouveau
Combine two to four views of the same subject into one aligned, textured 3D model with PBR maps
$1.05/unit
3d-generationimage
📦 3DEn savoir plus →
Modèle edge haute performance avec vision. Meilleur Ministral pour les tâches complexes.
131K ctx8K sortieIn: $0.000350/1MOut: $0.000350/1M
ToolsStreamchattoolsimage
💬 LLMEn savoir plus →
Modèle edge ultra-léger avec vision. 3B paramètres, fonctionne sur téléphones/ordinateurs portables.
131K ctx8K sortieIn: $0.000175/1MOut: $0.000175/1M
ToolsStreamchattoolsimage
💬 LLMEn savoir plus →
Modèle edge compact avec vision. 8B paramètres pour le déploiement local.
131K ctx8K sortieIn: $0.000262/1MOut: $0.000262/1M
ToolsStreamchattoolsimage
💬 LLMEn savoir plus →
Modèle d'embedding textuel de Mistral pour la recherche sémantique, la récupération et la classification.
In: $0.000175/1M
🔍 EmbeddingEn savoir plus →
Modèle phare à poids ouverts. MoE 675B (41B actifs), multimodal avec vision. Licence Apache 2.0.
131K ctx8K sortieIn: $0.000875/1MOut: $0.0026/1M
ToolsStreamchattoolsimage
💬 LLMEn savoir plus →
Modèle multimodal de première classe. Excellent équilibre entre Large et Small.
131K ctx8K sortieIn: $0.0026/1MOut: $0.0131/1M
ToolsStreamchattoolsreasoning
💬 LLMEn savoir plus →
Modèle de modération de contenu de Mistral pour détecter les contenus nuisibles, dangereux ou contraires aux politiques.
In: $0.000175/1M
⚡ CapacitéEn savoir plus →
Modèle IA documentaire pour l'OCR haute précision. Extrait le texte d'images, PDF, contenus manuscrits, formulaires et tableaux complexes.
In: $0.0018/1MOut: $0.0053/1M
image
Modèle rapide et efficace pour les tâches simples. Excellent rapport performance-coût.
131K ctx8K sortieIn: $0.000175/1MOut: $0.000525/1M
ToolsStreamchattools
💬 LLMEn savoir plus →
Modèle Mistral optimisé pour les flux de travail de code en ligne de commande et terminal.
128K ctx33K sortieIn: $0.000175/1MOut: $0.000525/1M
ToolsStreamtools
💬 LLMEn savoir plus →
Synthèse vocale la plus avancée avec conscience émotionnelle et expression riche dans 29 langues
In: $0.3850/1M
🗣 VoixEn savoir plus →
Gemini 2.5 Flash Image — optimisé pour la vitesse et l'efficacité, génération d'images haut volume à faible latence.
66K ctx33K sortie$0.0683/unit
🎨 ImageEn savoir plus →
High-efficiency image generation, optimized for speed and high-volume use.
66K ctx33K sortie$0.1172/unit
image
🎨 ImageEn savoir plus →
Efficiency specialist of the Nano Banana family — ultra-low-latency, cost-effective image generation and editing.
66K ctx33K sortie$0.0588/unit
image
🎨 ImageEn savoir plus →
Google's native image generation with text rendering and multimodal understanding.
66K ctx33K sortie$0.2345/unit
image
🎨 ImageEn savoir plus →
OpenAI o3 (chat completions endpoint).
200K ctx100K sortieIn: $0.0035/1MOut: $0.0140/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Première génération de synthèse vocale empathique avec expression émotionnelle naturelle
In: $0.2625/1M
🗣 VoixEn savoir plus →
Dernier modèle de synthèse vocale empathique prenant en charge 11 langues avec conscience émotionnelle
In: $0.1313/1M
🗣 VoixEn savoir plus →
Modèle premium combinant intelligence maximale et performance pratique
200K ctx64K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Modèle Claude le plus performant avec raisonnement et code améliorés
1M ctx64K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Highly capable Claude Opus for complex reasoning and coding (1M context)
1M ctx128K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Anthropic's most capable model for complex reasoning and agentic coding (1M context)
1M ctx128K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Anthropic's flagship Opus — deep reasoning, agentic coding and long-horizon work (1M context)
1M ctx128K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Large-context generalist with 128K window. Excellent for complex generation and analysis. Augure sovereign Canadian AI.
131K ctx33K sortieIn: $0.0013/1MOut: $0.0038/1M
ToolsStreamchattools
💬 LLMEn savoir plus →
Premium multimodal model with vision and tool use, strong bilingual EN/FR. Augure sovereign Canadian AI.
33K ctx33K sortieIn: $0.0032/1MOut: $0.0101/1M
ToolsStreamchattoolsvision+1
💬 LLMEn savoir plus →
Aperçu du modèle fondamental Leonardo avec adhérence extrême au prompt et polyvalence.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
Modèle phare fondamental de Leonardo avec une adhérence exceptionnelle au prompt et un rendu de texte de qualité.
$0.0280/unit
generation
🎨 ImageEn savoir plus →
PixVerse C1, cinematic-quality video generation tuned for action scenes and reference-based work, clips from 1 to 15 seconds with optional generated audio.
video
🎬 VidéoEn savoir plus →
PixVerse C1 image-to-video: cinematic animation of a source image into a 1–15 second clip with optional generated audio.
videoimage
🎬 VidéoEn savoir plus →
PixVerse C1 fusion: cinematic video from 1–3 reference images (subjects or scenes) guided by a prompt, with optional generated audio.
videoimage
🎬 VidéoEn savoir plus →
PixVerse V6, general-purpose video generation with clips from 1 to 15 seconds, optional generated audio, and multi-clip support.
video
🎬 VidéoEn savoir plus →
PixVerse V6 image-to-video: animate a source image into a 1–15 second clip with optional generated audio.
videoimage
🎬 VidéoEn savoir plus →
PixVerse V6 fusion: generate a video from 1–3 reference images (subjects or scenes) guided by a prompt, with optional generated audio.
videoimage
🎬 VidéoEn savoir plus →
Modèle d'embedding léger de Perplexity. Vecteurs INT8 1024D, contexte 32K, réduction dimensionnelle Matryoshka.
33K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
Modèle d'embedding le plus performant de Perplexity. Vecteurs INT8 2560D, contexte 32K, réduction dimensionnelle Matryoshka.
33K ctxIn: $0.000175/1M
🔍 EmbeddingEn savoir plus →
Pruna's optimized image editing: transform an input image with a prompt.
$0.0175/unit
image
🎨 ImageEn savoir plus →
Pruna's premium video generation: text-to-video and image-to-video, up to 1080p. Draft mode gives fast, cheap previews.
videoimage
🎬 VidéoEn savoir plus →
Modèle ultra-rapide avec contexte de 1M. Meilleure latence et rentabilité pour les tâches simples.
1M ctx8K sortieIn: $0.000039/1MOut: $0.000378/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Alibaba's flagship text-to-image model — successor to the whole Qwen-Image family, with strong prompt following and text rendering (native DashScope, Singapore).
$0.0612/unit
🎨 ImageEn savoir plus →
The higher-fidelity "pro" tier of Alibaba's Qwen Image 2.0 — stronger prompt following and text rendering (native DashScope, Singapore).
$0.1313/unit
🎨 ImageEn savoir plus →
Modèle phare équilibré avec contexte de 1M. Meilleur rapport performance-coût pour la plupart des tâches.
1M ctx8K sortieIn: $0.000700/1MOut: $0.0021/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Modèle de code économique optimisé pour la vitesse. Génération et complétion de code rapides à moindre coût.
131K ctx8K sortieIn: $0.000252/1MOut: $0.0010/1M
ToolsStreamtools
💬 LLMEn savoir plus →
Modèle avancé vision-langage avec contexte 262K. Excelle en codage visuel, perception spatiale et raisonnement multimodal.
262K ctx8K sortieIn: $0.000250/1MOut: $0.0025/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Flagship 1T+ parameter model. State-of-the-art reasoning, coding, and agent capabilities.
262K ctx33K sortieIn: $0.000051/1MOut: $0.000502/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Alibaba Qwen3.5 Omni Flash, fast multimodal (text & image input, text output). Singapore deployment; native voice/audio coming.
66K ctx8K sortieIn: $0.000700/1MOut: $0.0039/1M
Streamimage
💬 LLMEn savoir plus →
Alibaba Qwen3.5 Omni, multimodal (text & image input, text output). Singapore deployment; native voice/audio coming.
66K ctx8K sortieIn: $0.0024/1MOut: $0.0145/1M
Streamimage
💬 LLMEn savoir plus →
Modèle MoE 397B avec 17B paramètres actifs, contexte de 1M de tokens, multimodal (texte/image/vidéo)
1M ctx8K sortieIn: $0.000201/1MOut: $0.0012/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Flagship 1T+ parameter model. State-of-the-art reasoning, coding, and agent capabilities.
262K ctx33K sortieIn: $0.000289/1MOut: $0.0017/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Qwen3.6 Plus, next-gen frontier LLM (Agentic Coding, vision/OCR, fine-grained localization). Replaces Qwen3.5 Plus.
1M ctx8K sortieIn: $0.000483/1MOut: $0.0029/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
Alibaba's Agent Frontier flagship.
262K ctx33K sortieIn: $0.0029/1MOut: $0.0087/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Multimodal frontier (vision/video); cheaper than Max.
1M ctx8K sortieIn: $0.000483/1MOut: $0.0019/1M
ToolsStreamtoolsreasoningimage+1
💬 LLMEn savoir plus →
nouveau
Alibaba's 2.4T-parameter multimodal MoE flagship. 1M context, accepts text and images.
1M ctx33K sortieIn: $0.0035/1MOut: $0.0105/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Génération de pixel art classique avec 15 styles. Idéal pour les assets de jeux, personnages, textures et visuels rétro. 16-512 px.
$0.0350/unit
🎨 ImageEn savoir plus →
Pixel art avancé avec le modèle Flux. Mêmes 15 styles que Classic avec qualité et détail améliorés. 16-512 px.
$0.0350/unit
🎨 ImageEn savoir plus →
Recraft V3 (Red Panda) — texte-vers-image, image-vers-image, inpainting et remplacement d'arrière-plan. 1024×1024.
$0.0700/unit
image
🎨 ImageEn savoir plus →
Recraft V3 pour graphiques vectoriels — sortie SVG avec image-vers-image, inpainting et remplacement d'arrière-plan.
$0.1400/unit
image
🎨 ImageEn savoir plus →
Dernier modèle de génération d'images de Recraft — styles photoréalistes et illustration, rendu de texte, 1024×1024, ~10 s de génération.
$0.0700/unit
🎨 ImageEn savoir plus →
Modèle d'image de la plus haute qualité de Recraft — sortie 2048×2048, anatomie et détail supérieurs, idéal pour les assets prêts à imprimer. ~30 s de génération.
$0.4375/unit
🎨 ImageEn savoir plus →
Modèle vectoriel de la plus haute qualité de Recraft — sortie SVG haute résolution avec détails fins, idéal pour les logos et assets de marque.
$0.5250/unit
🎨 ImageEn savoir plus →
Recraft V4 pour graphiques vectoriels — génère des SVG de qualité production avec régions de couleur discrètes et géométrie nette.
$0.1400/unit
🎨 ImageEn savoir plus →
Remplacement de l'arrière-plan d'une image par une scène générée par IA
$0.0525/unit
image
🎨 ImageEn savoir plus →
Dernier modèle de reclassement de Voyage AI — réévalue les résultats de recherche pour une pertinence maximale. Meilleure qualité. 200M de tokens gratuits.
In: $0.000087/1M
↕️ RerankingEn savoir plus →
Modèle de reclassement rapide de Voyage AI — réévaluation économique pour les pipelines de recherche à haut volume. 200M de tokens gratuits.
In: $0.000035/1M
↕️ RerankingEn savoir plus →
Rime's flagship voice model, 269 voices across 9 languages with rich emotional range.
In: $0.0700/1M
tts
🗣 VoixEn savoir plus →
Stylized voices in 4 categories (Professional / Formal / Casual / Energetic). 184 voices, 8 languages.
In: $0.0525/1M
tts
🗣 VoixEn savoir plus →
Latest Mist generation, 83 voices, 4 languages. Improved expressiveness.
In: $0.0437/1M
tts
🗣 VoixEn savoir plus →
Premium model for complex, multi-step work. Augure sovereign Canadian AI.
33K ctx33K sortieIn: $0.0044/1MOut: $0.0139/1M
ToolsStreamchattools
💬 LLMEn savoir plus →
Sarvam's 24B multilingual LLM, fluent in all 22 official Indian languages + English. OpenAI-compatible API. Free tier with no per-token charges. Supports wiki grounding, reasoning effort control, and tool calls.
In: $0.000081/1MOut: $0.000325/1M
Toolstoolsreasoning
💬 LLMEn savoir plus →
Reconnaissance vocale par lots avec horodatage au mot et détection de langue dans 99 langues.
$0.000170/unit
audio
📝 TranscriptionEn savoir plus →
Reconnaissance vocale en temps réel à latence ultra-faible (<150 ms). 93,5 % de précision dans plus de 90 langues. Streaming WebSocket avec DAV.
$0.000170/unit
audio
📝 TranscriptionEn savoir plus →
Équilibre vitesse et qualité pour la création d'assets numériques à haut volume
$0.0525/unit
🎨 ImageEn savoir plus →
Génération d'images photoréalistes de la plus haute qualité, parfaite pour les médias imprimés professionnels
$0.1400/unit
🎨 ImageEn savoir plus →
Modèle MMDiT de 8B paramètres. Qualité supérieure, typographie et adhérence au prompt. Le plus puissant de la famille SD.
$0.1138/unit
🎨 ImageEn savoir plus →
SD3.5 Large distillé optimisé pour une inférence plus rapide avec moins d'étapes.
$0.0700/unit
🎨 ImageEn savoir plus →
Modèle SD3.5 équilibré. Bonne qualité avec moins de ressources que la version Large.
$0.0612/unit
🎨 ImageEn savoir plus →
⚡ CapacitéEn savoir plus →
Génération conjointe audio-vidéo. Vidéos cinématiques 1080p avec audio natif, narration multi-plans et personnages cohérents.
Out: $0.0021/1M
image
🎬 VidéoEn savoir plus →
ByteDance Seedance 2.0, text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0135/1M
image
🎬 VidéoEn savoir plus →
ByteDance Seedance 2.0 Fast — speed-optimized text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0098/1M
image
🎬 VidéoEn savoir plus →
ByteDance Seedance 2.0 Mini — cost-optimized text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0061/1M
image
🎬 VidéoEn savoir plus →
nouveau
ByteDance Seedance 2.5, text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0187/1M
image
🎬 VidéoEn savoir plus →
ByteDance Seedream 5.0 Lite, text-to-image (2K+), native via BytePlus (Ark).
$0.0612/unit
🎨 ImageEn savoir plus →
ByteDance Seedream 5.0 Pro, flagship text-to-image (2K+), highest quality + consistency. Native via BytePlus (Ark).
$0.1575/unit
🎨 ImageEn savoir plus →
Synthèse vocale naturelle prenant en charge plus de 60 langues avec des capacités multilingues complètes
In: $0.0175/1M
🗣 VoixEn savoir plus →
Synthèse vocale anglaise ultra-rapide optimisée pour la vitesse avec latence minimale
In: $0.0175/1M
🗣 VoixEn savoir plus →
Modèle léger d'Upstage pour une inférence rapide et économique.
33K ctx4K sortieIn: $0.000262/1MOut: $0.0010/1M
Streamchat
💬 LLMEn savoir plus →
Modèle pro de génération précédente d'Upstage avec contexte 64K.
66K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamchattools
💬 LLMEn savoir plus →
Version nightly d'Upstage Solar Pro 2 avec les dernières améliorations.
66K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamchattools
💬 LLMEn savoir plus →
Upstage flagship 100B MoE model with reasoning capabilities and strong multilingual performance.
131K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamchatreasoningtools
💬 LLMEn savoir plus →
Modèle léger de Perplexity avec recherche web — recherche en temps réel avec citations, réponses rapides, contexte 128K.
128K ctx16K sortieIn: $0.0018/1MOut: $0.0018/1M
Streamsearch
💬 LLMEn savoir plus →
Modèle de recherche le plus approfondi de Perplexity — investigation web multi-étapes avec citations complètes et raisonnement.
128K ctx33K sortieIn: $0.0035/1MOut: $0.0140/1M
Streamsearchreasoning
💬 LLMEn savoir plus →
Modèle de recherche avancé de Perplexity — recherche web approfondie, raisonnement multi-étapes avec citations, contexte 200K.
200K ctx16K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamtoolssearch
💬 LLMEn savoir plus →
Modèle de raisonnement de Perplexity — réflexion approfondie avec recherche web en temps réel, idéal pour la recherche et l'analyse complexes.
128K ctx16K sortieIn: $0.0035/1MOut: $0.0140/1M
ToolsStreamtoolssearchreasoning
💬 LLMEn savoir plus →
Synthèse vocale ultra-réaliste la plus rapide et la plus expressive au monde avec plus de 60 émotions et 42 langues
In: $0.0875/1M
🗣 VoixEn savoir plus →
Génération vocale à latence ultra-faible (40 ms) optimisée pour les applications en temps réel
In: $0.0875/1M
🗣 VoixEn savoir plus →
Le meilleur modèle Claude pour les agents complexes et le code
200K ctx64K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Claude Sonnet 4.6 — dernier modèle équilibré d'Anthropic avec raisonnement, code et suivi d'instructions améliorés.
1M ctx64K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
Anthropic's most capable Sonnet — closes the gap with Opus for complex agents and coding (1M context)
1M ctx64K sortieIn: $0.0035/1MOut: $0.0175/1M
ToolsStreamtoolsreasoningimage
💬 LLMEn savoir plus →
OpenAI Sora 2 video generation. Async jobs polled by app:openai:poll-videos.
$0.7000/unit
🎬 VidéoEn savoir plus →
OpenAI Sora 2 Pro, higher resolution (1080p cinematic 1792x1024 / 1024x1792) at same aspect ratios as Sora 2.
$3.50/unit
🎬 VidéoEn savoir plus →
Axé sur le rythme, la stabilité et la réplication vocale de haute qualité
In: $0.1750/1M
🗣 VoixEn savoir plus →
Dernière variante HD mettant l'accent sur la prosodie et la qualité du clonage vocal
In: $0.1750/1M
🗣 VoixEn savoir plus →
Performance turbo avec prise en charge de 40 langues et faible latence
In: $0.1050/1M
🗣 VoixEn savoir plus →
nouveau
Current HD voice model. Highest fidelity prosody and voice cloning.
In: $0.1750/1M
🗣 VoixEn savoir plus →
nouveau
Current Turbo voice model. Low latency, broad language coverage.
In: $0.1050/1M
🗣 VoixEn savoir plus →
Générez musique et effets sonores jusqu'à 3 minutes à partir de prompts textuels. Produit des compositions structurées avec intros, développements et outros en stéréo 44,1 kHz.
$0.3500/unit
🎵 MusiqueEn savoir plus →
Génération musicale et sonore de qualité entreprise. Compositions structurées avec intros, développements et outros en stéréo 44,1 kHz. Inférence en 8 étapes pour une génération rapide.
$0.3500/unit
🎵 MusiqueEn savoir plus →
Séparez l'audio en pistes individuelles (voix, batterie, basse, etc.). Modes 2 ou 6 pistes.
$0.0029/unit
audio
🎚 SéparationEn savoir plus →
Dernier modèle de raisonnement de StepFun — MoE 196B (11B actifs), contexte 256K, open source Apache 2.0. Intelligence agentique rapide avec code et maths solides.
256K ctx16K sortieIn: $0.000175/1MOut: $0.000525/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
StepFun's multimodal flagship reasoning model.
256K ctx16K sortieIn: $0.000350/1MOut: $0.0020/1M
ToolsStreamtoolsreasoning
💬 LLMEn savoir plus →
Meilleure organisation des chansons avec des structures couplet/refrain claires
$0.1050/unit
🎵 MusiqueEn savoir plus →
Qualité vocale améliorée et traitement audio affiné pour la génération musicale
$0.1050/unit
🎵 MusiqueEn savoir plus →
Excellente compréhension des prompts avec des vitesses de génération plus rapides, pistes jusqu'à 8 minutes
$0.1050/unit
🎵 MusiqueEn savoir plus →
Modèle avancé avec variation tonale améliorée et excellente compréhension des prompts
$0.1050/unit
🎵 MusiqueEn savoir plus →
Modèle de pointe avec qualité et capacités améliorées pour la génération musicale par IA
$0.1050/unit
🎵 MusiqueEn savoir plus →
Modèle avancé de raisonnement synthétique d'Upstage avec contexte 64K.
66K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
Streamchat
💬 LLMEn savoir plus →
Synchronisation labiale de qualité studio. Synchronise les mouvements des lèvres avec n'importe quel audio en préservant le style naturel du locuteur.
$0.0875/unit
videoaudio
🎬 VidéoEn savoir plus →
Synchronisation labiale premium avec préservation détaillée des barbes, dents et traits fins grâce à la super-résolution par diffusion.
$0.1452/unit
videoaudio
🎬 VidéoEn savoir plus →
Fast bilingual workhorse with 128K context for general inference, document processing, and EN/FR tasks. Augure sovereign Canadian AI.
131K ctx33K sortieIn: $0.000630/1MOut: $0.0019/1M
ToolsStreamchattools
💬 LLMEn savoir plus →
Tripo's P1 model for image-to-3D, converts a single image into a game-ready low-poly mesh (50 to 20k faces) with clean topology and PBR textures.
$0.8750/unit
image
📦 3DEn savoir plus →
Tripo's P1 model for multiview reconstruction, builds a game-ready low-poly mesh with clean topology from up to 4 view images (front required).
$0.8750/unit
image
📦 3DEn savoir plus →
Tripo's P1 model for text-to-3D, generates game-ready low-poly meshes (50 to 20k faces) with clean topology and PBR textures. Exports GLB, FBX, OBJ, USD, STL.
$0.7000/unit
📦 3DEn savoir plus →
Splits an existing 3D model into separately editable parts, textures and PBR materials preserved. A practical level of separation for most assets.
$0.7000/unit
3d
📦 3DEn savoir plus →
Splits an existing 3D model into many separately editable parts, textures and PBR materials preserved. Maximum component separation for deep editing and production.
$0.7000/unit
3d
📦 3DEn savoir plus →
Splits an existing 3D model into a few separately editable parts, textures and PBR materials preserved. Quick separation for review and lightweight prep.
$0.7000/unit
3d
📦 3DEn savoir plus →
Dernier modèle de Tripo pour convertir une image en maillage 3D — extrait géométrie, texture et matériaux à partir d'une photo ou illustration.
$0.5250/unit
image
📦 3DEn savoir plus →
Génération 3D la plus fidèle de Tripo — reconstruit des maillages détaillés à partir de multiples perspectives d'images pour une précision maximale.
$0.5250/unit
image
📦 3DEn savoir plus →
Dernier modèle de Tripo pour générer des maillages 3D à partir de texte — produit une géométrie détaillée avec matériaux PBR en secondes. Export GLB, FBX, OBJ, USD, STL.
$0.3500/unit
📦 3DEn savoir plus →
Tripo's stable v3.0 model for image-to-3D, reconstructs clean geometry, textures, and PBR materials from a single image, up to 2M polygons in Ultra mode.
$0.5250/unit
image
📦 3DEn savoir plus →
Tripo v3.0 multiview generation, reconstructs detailed meshes from up to 4 view images (front required) with stable, production-proven quality.
$0.5250/unit
image
📦 3DEn savoir plus →
Tripo's stable v3.0 model for text-to-3D, crisp edges and coherent structure with PBR materials, up to 2M polygons in Ultra mode. Exports GLB, FBX, OBJ, USD, STL.
$0.3500/unit
📦 3DEn savoir plus →
Tripo's flagship v3.1 model for image-to-3D, reconstructs high-fidelity geometry, textures, and PBR materials from a single image, up to 2M polygons in Ultra mode.
$0.5250/unit
image
📦 3DEn savoir plus →
Tripo's flagship v3.1 image-to-3D with 8K Ultra textures, reconstructs maximum-fidelity geometry and materials from a single image for hero assets.
$0.8750/unit
image
📦 3DEn savoir plus →
Tripo v3.1 image-to-3D in part-segmentation mode, converts a single image into an untextured mesh split into separately editable parts.
$0.7000/unit
image
📦 3DEn savoir plus →
Tripo's highest-fidelity 3D generation, v3.1 reconstructs detailed meshes from up to 4 view images (front required) for maximum accuracy.
$0.5250/unit
image
📦 3DEn savoir plus →
Tripo's highest-fidelity pipeline, v3.1 multiview reconstruction with 8K Ultra textures from up to 4 view images (front required).
$0.8750/unit
image
📦 3DEn savoir plus →
Tripo v3.1 multiview reconstruction in part-segmentation mode, builds an untextured segmented mesh from up to 4 view images (front required).
$0.7000/unit
image
📦 3DEn savoir plus →
Tripo's flagship v3.1 model for text-to-3D, sculpture-level geometry with crisp edges and PBR materials, up to 2M polygons in Ultra mode. Exports GLB, FBX, OBJ, USD, STL.
$0.3500/unit
📦 3DEn savoir plus →
Tripo's flagship v3.1 text-to-3D with 8K Ultra textures, maximum-fidelity materials and fine surface detail for hero assets and close-ups. Exports GLB, FBX, OBJ, USD, STL.
$0.7000/unit
📦 3DEn savoir plus →
Tripo v3.1 text-to-3D in part-segmentation mode, generates an untextured mesh split into separately editable parts for editing, rigging prep, and 3D printing. Exports GLB, FBX, OBJ, USD, STL.
$0.5250/unit
📦 3DEn savoir plus →
Turns a single image into a photorealistic 3D Gaussian Splat in under a minute. Ideal for AR/VR, web scenes and visualization — a view-ready format, not an editable or printable mesh. Exports SPLAT.
$0.5250/unit
image
📦 3DEn savoir plus →
Génération vocale à faible latence dans 32 langues, optimisée pour l'IA conversationnelle en temps réel
In: $0.1925/1M
🗣 VoixEn savoir plus →
The most creative, intelligent and personalizable image generation models built on a new groundbreaking architecture that delivers ultra high quality and 10x higher cost efficiency.
$0.0707/unit
🎨 ImageEn savoir plus →
The most creative, intelligent and personalizable image generation models built on a new groundbreaking architecture that delivers ultra high quality and 10x higher cost efficiency.
$0.1750/unit
🎨 ImageEn savoir plus →
Dernier Veo avec capacité d'extension vidéo. Créez et prolongez des vidéos générées par IA avec une cohérence améliorée.
$0.7000/unit
imagevideo
🎬 VidéoEn savoir plus →
Variante rapide de Veo 3.1. Génération et extension vidéo rapides avec bonne qualité.
$0.1750/unit
imagevideo
🎬 VidéoEn savoir plus →
Cost-efficient Veo 3.1 tier — video with audio at a fraction of the price (720p/1080p, no 4K).
$0.0875/unit
image
🎬 VidéoEn savoir plus →
Generate and edit sound effects from video (SFX 1.6). Provide a video URL and optional text prompt; adds seamless extension, looping ambiences, and AI inpainting to erase/replace moments.
$0.0875/unit
video
🔊 Effets sonoresEn savoir plus →
Reference-based video generation using multiple images for visual consistency. 4-second 720p output.
$0.7000/unit
image
🎬 VidéoEn savoir plus →
Start- and end-frame video generation. 5-second 720p output.
$0.3500/unit
image
🎬 VidéoEn savoir plus →
Créez un avatar parlant à partir d'une image ou vidéo avec voix générée par IA à partir de texte
$0.8750/unit
🎬 VidéoEn savoir plus →
Synchronisation labiale vidéo avec un fichier audio pour un doublage réaliste et le remplacement de voix
$0.7000/unit
🎬 VidéoEn savoir plus →
Texte-vers-vidéo haute qualité avec support du style anime. Sortie 1080p de 5 secondes.
$0.7000/unit
🎬 VidéoEn savoir plus →
Start- and end-frame video generation. 5-second 1080p output.
$0.7000/unit
image
🎬 VidéoEn savoir plus →
Générez des images à partir de 1 à 7 images de référence. Téléchargez des images de référence pour commencer.
$0.0700/unit
🎨 ImageEn savoir plus →
Générez des images à partir de texte ou d'images de référence. Prend en charge les résolutions 1080p, 2K et 4K.
$0.0525/unit
🎨 ImageEn savoir plus →
Ultra-fast video from text or image. Upload an image for image-to-video mode.
$0.3325/unit
🎬 VidéoEn savoir plus →
Synthèse vocale naturelle avec vitesse, volume et hauteur ajustables.
In: $0.0350/1M
🗣 VoixEn savoir plus →
Modèle d'embedding polyvalent et équilibré de Voyage AI — bonne qualité à coût modéré. 200M de tokens gratuits.
In: $0.000105/1M
🔍 EmbeddingEn savoir plus →
Modèle d'embedding polyvalent le plus performant de Voyage AI — meilleure qualité pour la recherche et la similarité sémantique. 200M de tokens gratuits.
In: $0.000210/1M
🔍 EmbeddingEn savoir plus →
Modèle d'embedding le plus rapide et économique de Voyage AI — idéal pour les cas à haut volume et faible latence. 200M de tokens gratuits.
In: $0.000035/1M
🔍 EmbeddingEn savoir plus →
Modèle d'embedding optimisé pour le code de Voyage AI — meilleur de sa catégorie pour la recherche et la similarité de code. 200M de tokens gratuits.
In: $0.000315/1M
🔍 EmbeddingEn savoir plus →
Modèle d'embedding long contexte de Voyage AI — optimisé pour les documents volumineux et le RAG avec fenêtres de contexte étendues. 200M de tokens gratuits.
In: $0.000315/1M
🔍 EmbeddingEn savoir plus →
Modèle d'embedding multimodal de Voyage AI — intègre texte et images dans un espace vectoriel partagé pour la recherche cross-modale.
In: $0.000210/1M
image
🔍 EmbeddingEn savoir plus →
Alibaba Wan 2.2 Animate Mix, composite a character into a reference video (native DashScope, Singapore).
videoimagevideo
🎬 VidéoEn savoir plus →
Alibaba Wan 2.2 Animate Move, animate a character image with a reference video's motion (native DashScope, Singapore).
videoimagevideo
🎬 VidéoEn savoir plus →
Alibaba Wan 2.6 image editing. Edits 1-4 input images from a natural-language instruction (native DashScope, US-Virginia).
$0.0525/unit
image
🎨 ImageEn savoir plus →
Alibaba Wan 2.6 image-to-video. Animates a still image into video while preserving subject, style and detail (native DashScope, US-Virginia).
videoimage
🎬 VidéoEn savoir plus →
Alibaba Wan 2.6 text-to-image. Photorealistic generation with accurate text rendering and flexible artistic styles (native DashScope, US-Virginia).
$0.0502/unit
🎨 ImageEn savoir plus →
Alibaba Wan 2.6 reference-to-video. Generates video preserving the look (and voice) of subjects from a reference video and/or reference images (native DashScope, US-Virginia).
videoimagevideo
🎬 VidéoEn savoir plus →
Alibaba Wan 2.6 text-to-video. Cinematic motion generation from text with strong instruction following (native DashScope, US-Virginia).
video
🎬 VidéoEn savoir plus →
Alibaba Wan 2.7 image-to-video. Animates a still image into video with first-frame fidelity, clips up to 15 seconds (native DashScope, US-Virginia).
videoimage
🎬 VidéoEn savoir plus →
nouveau
Alibaba Wan 2.7 text-to-image and editing. Served from Singapore — the US tenant returns AccessDenied.
$0.0481/unit
🎨 ImageEn savoir plus →
nouveau
Alibaba Wan 2.7 pro tier, up to 4K output for print and large-format work. Served from Singapore.
$0.1203/unit
🎨 ImageEn savoir plus →
Alibaba Wan 2.7 text-to-video. First and last frame control, clips up to 15 seconds, sharper motion and instruction following (native DashScope, US-Virginia).
video
🎬 VidéoEn savoir plus →