Aller au contenu principal
Affichage de 376 sur 376 modèles
Act-Two
Runway
Capture de performance par IA. Téléchargez une image de personnage + votre vidéo de performance pour transférer votre mouvement au personnage.
$0.0875/unit
videoimage
Aleph 2.0
Runway
nouveau
Runway's current video-to-video model. Edit existing footage with text prompts; accepts 2-30 second inputs.
$0.4900/unit
video
Async Flash
Async
Synthèse vocale ultra-rapide en temps réel optimisée pour les applications à faible latence
In: $0.0192/1M
AsyncFlow Multilingual
Async
Synthèse vocale multilingue prenant en charge 15 langues dont l'arabe, le japonais et le chinois
In: $0.0192/1M
AsyncFlow v2.0
Async
Synthèse vocale haute qualité avec prosodie naturelle et expression émotionnelle dans 15 langues
In: $0.0192/1M
Aura
Deepgram
Modèle de synthèse vocale original de Deepgram — 12 voix anglaises à moitié prix d'Aura 2. Rapide et fiable.
In: $0.0262/1M
Stream
Aura 2
Deepgram
Dernier modèle de synthèse vocale de Deepgram — plus de 90 voix naturelles dans 8 langues (EN, FR, DE, ES, IT, NL, JA), latence inférieure à 200 ms. Noms de voix inspirés de la mythologie grecque.
In: $0.0525/1M
Stream
Blur Background
Bria
Blur the background behind the subject
$0.0315/unit
image
Bulbul v2
Sarvam AI
Modèle de synthèse vocale stable de Sarvam pour les langues indiennes et l'anglais. Retourne de l'audio WAV encodé en base64. Qualité constante en production.
In: $0.000315/1M
Bulbul v3
Sarvam AI
Dernier modèle de synthèse vocale de Sarvam — plus de 30 voix dans les langues indiennes et l'anglais. Prosodie naturelle avec intonation culturelle. Actuellement en bêta.
In: $0.000630/1M
ByteDance Seed 1.8
BytePlus
ByteDance Seed 1.8, multimodal agent model (text, image & video in → text), strong tool use + reasoning, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000438/1MOut: $0.0035/1M
ToolsStreamtoolsreasoningimage+1
ByteDance Seed 2.0 Code
BytePlus
ByteDance Seed 2.0 Code (preview), coding-specialized agent (text & image in → text), strong tool use + reasoning. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000875/1MOut: $0.0053/1M
ToolsStreamtoolsreasoningimage
ByteDance Seed 2.0 Lite
BytePlus
ByteDance Seed 2.0 Lite, efficient multimodal agent (text, image & video in → text), tool use + reasoning, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000438/1MOut: $0.0035/1M
ToolsStreamtoolsreasoningimage+1
ByteDance Seed 2.0 Mini
BytePlus
ByteDance Seed 2.0 Mini, fast lightweight multimodal agent (text, image & video in → text), tool use. Native via BytePlus (Ark).
131K ctx33K sortieIn: $0.000175/1MOut: $0.000700/1M
ToolsStreamtoolsreasoningimage+1
ByteDance Seed 2.0 Pro
BytePlus
ByteDance Seed 2.0 Pro, flagship multimodal agent (text, image & video in → text), strong tool use + reasoning, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000875/1MOut: $0.0053/1M
ToolsStreamtoolsreasoningimage+1
ByteDance Seed 2.1 Turbo
BytePlus
ByteDance Seed 2.1 Turbo, fast multimodal reasoning agent (text & image in → text), strong tool use + thinking, 256K context. Native via BytePlus (Ark).
262K ctx66K sortieIn: $0.000875/1MOut: $0.0044/1M
ToolsStreamtoolsreasoningimage
Codestral
Mistral AI
Modèle spécialisé pour la génération, la complétion et la compréhension de code.
262K ctx8K sortieIn: $0.000525/1MOut: $0.0016/1M
Streamchat
CogVideoX-3
Z.ai
Génération vidéo 10 secondes, 4K, 60 ips avec physique réaliste.
$0.3500/unit
image
CogView-4
Z.ai
Modèle d'image open source SOTA. Support natif du texte chinois, 6B paramètres.
$0.0175/unit
Colorize
Bria
Bring black-and-white photos to natural color
$0.0525/unit
image
Crop to Subject
Bria
Remove the background and crop tightly around the subject
$0.0315/unit
image
DeepL
DeepL
Traduction automatique neuronale de haute qualité prenant en charge 33 langues
In: $0.0437/1M
🌐 TraductionEn savoir plus →
DeepSeek V4 Flash
DeepSeek
DeepSeek V4 Flash, fast, cost-effective daily driver. 1M context, thinking + non-thinking modes.
1M ctx66K sortieIn: $0.000385/1MOut: $0.0012/1M
ToolsStreamchatreasoningtools
DeepSeek V4 Pro
DeepSeek
DeepSeek flagship V4. 512K context, advanced reasoning + tool use.
524K ctx66K sortieIn: $0.0012/1MOut: $0.0035/1M
ToolsStreamchatreasoningtools
Eleven v3
ElevenLabs
Modèle TTS le plus expressif avec balises audio, mode dialogue, émulation d'accent et plus de 70 langues. Idéal pour le contenu long.
In: $0.3850/1M
Enhance
Bria
Amélioration de la qualité d'image par IA
$0.0350/unit
image
Erase Foreground
Bria
Remove the main subject and fill in the background
$0.0350/unit
image
Erase Object
Bria
Paint over an object to remove it from the image
$0.0350/unit
image
Expand Image
Bria
Extension de l'image au-delà de ses bords par outpainting IA
$0.0350/unit
image
Fable 5
Anthropic
Fable 5 by Anthropic.
1M ctx128K sortieIn: $0.0175/1MOut: $0.0875/1M
ToolsStreamtoolsreasoningimage
Flash v2.5
ElevenLabs
TTS à latence ultra-faible pour l'IA conversationnelle en temps réel. ~75 ms de latence.
In: $0.1925/1M
FLUX 1.1 [pro]
Black Forest Labs
Le meilleur de FLUX, offrant une génération d'images à la pointe de la technologie à une vitesse fulgurante
$0.0700/unit
FLUX 1.1 [pro/ultra]
Black Forest Labs
Modes Ultra / Raw. Ultra rapide, plus de pixels
$0.1050/unit
FLUX Kontext [max]
Black Forest Labs
Un modèle premium offrant des performances maximales sur tous les aspects — qualité, cohérence et vitesse grandement améliorées
$0.1400/unit
FLUX Kontext [pro]
Black Forest Labs
Un modèle unifié offrant édition locale, modifications génératives et génération texte-vers-image
$0.0700/unit
FLUX.1 [dev]
Black Forest Labs
Directement distillé de FLUX.1 [pro], un modèle à poids ouverts distillé par guidance pour un usage non commercial
$0.0437/unit
FLUX.1 [pro]
Black Forest Labs
Génération d'images à la pointe avec un suivi de prompt et une qualité visuelle de premier ordre
$0.0875/unit
FLUX.2 [flex]
Black Forest Labs
Spécialisé dans la typographie et le rendu de texte avec guidance et étapes de génération ajustables
$0.0875/unit
FLUX.2 [klein/4B]
Black Forest Labs
Modèle FLUX open source ultra-rapide optimisé pour la génération en temps réel au moindre coût. Licence Apache 2.0.
$0.0245/unit
FLUX.2 [klein/9B]
Black Forest Labs
Modèle FLUX le plus rapide avec inférence en moins d'une seconde. 9B paramètres avec encodeur de texte Qwen3 pour une compréhension supérieure des prompts.
$0.0262/unit
FLUX.2 [max]
Black Forest Labs
FLUX 2.0 de la plus haute qualité avec capacité de recherche ancrée pour des images photoréalistes jusqu'à 4 mégapixels
$0.1400/unit
FLUX.2 [pro]
Black Forest Labs
FLUX 2.0 de qualité production avec édition multi-référence et contrôle précis des couleurs, poses et composition
$0.0525/unit
Fugu Ultra
Sakana
Sakana's multi-agent conductor, orchestrates a pool of frontier models for complex reasoning. Billed per token, orchestration included.
272K ctx16K sortieIn: $0.0088/1MOut: $0.0525/1M
ToolsStreamtoolsreasoning
Gemini 2.5 Flash
Google
Modèle rapide et efficace avec réflexion adaptative pour les tâches complexes
1M ctx66K sortieIn: $0.000525/1MOut: $0.0044/1M
ToolsStreamtoolsreasoningimage+1
Gemini 2.5 Flash TTS
Google
Synthèse vocale à faible latence de Google avec prosodie naturelle et style contrôlable. Prend en charge 24 langues.
In: $0.0350/1M
Gemini 2.5 Flash-Lite
Google
Modèle haut débit économique pour les applications soucieuses du budget
1M ctx66K sortieIn: $0.000175/1MOut: $0.000700/1M
ToolsStreamtoolsreasoningimage+1
Gemini 2.5 Pro
Google
Réflexion et raisonnement améliorés pour les problèmes complexes
1M ctx66K sortieIn: $0.0022/1MOut: $0.0175/1M
ToolsStreamtoolsreasoningimage+1
Gemini 2.5 Pro TTS
Google
Synthèse vocale premium avec expressivité améliorée, tonalité plus riche et rythme précis. Idéal pour une sortie de haute qualité.
In: $0.0700/1M
Gemini 3 Flash
Google
Le modèle de pointe le plus rapide de Google. Surpasse le 2.5 Pro à 1/4 du coût avec un contexte de 1M
1M ctx66K sortieIn: $0.000875/1MOut: $0.0053/1M
ToolsStreamtoolsreasoningimage+1
Gemini 3.1 Flash TTS
Google
Latest price-performant, low-latency controllable speech generation. 30 voices, 24 languages.
In: $0.0700/1M
Gemini 3.1 Flash-Lite
Google
Cost-efficient high-throughput model for budget-conscious applications.
1M ctx66K sortieIn: $0.000438/1MOut: $0.0026/1M
ToolsStreamtoolsreasoningimage
Gemini 3.1 Pro
Google
Modèle agentique le plus performant de Google avec contexte de 1M de tokens, 77,1 % ARC-AGI-2 en raisonnement et utilisation native d'outils.
1M ctx66K sortieIn: $0.0035/1MOut: $0.0210/1M
ToolsStreamtoolsreasoningimage+2
Gemini 3.5 Flash
Google
Fast flagship with adaptive thinking for complex tasks.
1M ctx66K sortieIn: $0.0026/1MOut: $0.0158/1M
ToolsStreamtoolsreasoningimage+1
Gemini 3.5 Flash-Lite
Google
Cost-efficient GA Flash model for high-throughput multimodal tasks.
1M ctx66K sortieIn: $0.000525/1MOut: $0.0044/1M
ToolsStreamtoolsreasoningimage+1
Gemini 3.6 Flash
Google
Google's latest GA Flash model for fast multimodal reasoning and agentic workloads.
1M ctx66K sortieIn: $0.0026/1MOut: $0.0131/1M
ToolsStreamtoolsreasoningimage+1
Gemini 3.7 Flash
Google
nouveau
Google's most capable Flash model for agentic workflows and multimodal reasoning.
1.048576M ctx66K sortieIn: $0.0026/1MOut: $0.0131/1M
ToolsStreamtoolsreasoningimage+1
Gemini Embedding 001
Google
Cost-efficient text embeddings — 3072-dim vectors for search, clustering, and RAG.
In: $0.000262/1M
🔍 EmbeddingEn savoir plus →
Gemini Embedding 2
Google
Google's latest embedding model — 3072-dim vectors for retrieval and semantic search (multimodal upstream; text wired).
In: $0.000350/1M
🔍 EmbeddingEn savoir plus →
Gemma 4 26B MoE
Google
Google's open-weight mixture-of-experts model, 26B total, 4B active parameters for fast inference
262K ctx33K sortieIn: $0.000105/1MOut: $0.000577/1M
ToolsStreamtoolsreasoning
Gemma 4 31B
Google
Google's open-weight dense model with 262K context and strong multilingual reasoning
262K ctx33K sortieIn: $0.000245/1MOut: $0.000700/1M
ToolsStreamtoolsreasoning
Gen-4 Image
Runway
Transformez des images de référence avec des prompts textuels. Préserve l'identité tout en modifiant la pose, l'éclairage et l'arrière-plan.
$0.0875/unit
image
Gen-4 Image Turbo
Runway
Génération d'images rapide basée sur référence. 2,5 fois plus rapide, préserve l'identité et le style.
$0.0350/unit
image
Gen-4 Turbo
Runway
Modèle phare image-vers-vidéo de Runway. Fidélité, stabilité et contrôlabilité exceptionnelles. Nécessite une image en entrée.
$0.0875/unit
image
Gen-4.5
Runway
Modèle vidéo le plus performant de Runway. N°1 sur le benchmark texte-vers-vidéo d'Artificial Analysis. Texte-vers-vidéo ou image-vers-vidéo avec physique et mouvement humain exceptionnels.
$0.2100/unit
image
Generative Fill
Bria
Paint a mask and fill the area with AI-generated content
$0.0525/unit
image
GLM-4.5
Z.ai
Précédent modèle phare avec mode de réflexion. Architecture MoE, contexte 128K.
128K ctx8K sortieIn: $0.0010/1MOut: $0.0039/1M
Streamreasoning
GLM-4.5 Air
Z.ai
Modèle léger optimisé pour l'efficacité. Contexte 128K.
128K ctx8K sortieIn: $0.000350/1MOut: $0.0019/1M
ToolsStreamtoolsreasoning
GLM-4.5 Flash
Z.ai
Modèle de niveau gratuit. Idéal pour les tests et les charges de travail légères.
128K ctx4K sortie
ToolsStreamtoolsreasoning
GLM-4.5V
Z.ai
Vision-language model for image understanding and analysis.
66K ctx16K sortieIn: $0.0010/1MOut: $0.0032/1M
ToolsStreamtoolsreasoningimage
GLM-4.6
Z.ai
Modèle phare avec raisonnement, code et capacités agentiques. Contexte 128K.
128K ctx8K sortieIn: $0.0010/1MOut: $0.0039/1M
ToolsStreamtoolsreasoning
GLM-4.6V
Z.ai
Modèle avec vision pour la compréhension et l'analyse d'images.
128K ctx8K sortieIn: $0.000525/1MOut: $0.0016/1M
ToolsStreamtoolsreasoningimage
GLM-4.6V Flash
Z.ai
Modèle de vision gratuit. Idéal pour tester la compréhension d'images.
128K ctx4K sortie
Streamimage
GLM-4.6V FlashX
Z.ai
Modèle de vision léger. Rapide et économique pour les tâches d'image.
128K ctx4K sortieIn: $0.000070/1MOut: $0.000700/1M
ToolsStreamreasoningtoolsimage
GLM-4.7
Z.ai
Dernier modèle phare. 358B paramètres, contexte 204K, sortie 131K. N°1 sur LiveCodeBench.
205K ctx131K sortieIn: $0.0010/1MOut: $0.0039/1M
ToolsStreamtoolsreasoning
GLM-4.7 Flash
Z.ai
Lightweight, completely free GLM-4.7 variant with 200K context.
205K ctx131K sortie
ToolsStreamtoolsreasoning
GLM-4.7 FlashX
Z.ai
Lightweight, high-speed and affordable GLM-4.7 variant with 200K context.
205K ctx131K sortieIn: $0.000122/1MOut: $0.000700/1M
ToolsStreamtoolsreasoning
GLM-5
Z.ai
Modèle Zhipu le plus performant. 744B paramètres (40B actifs MoE), 28,5T tokens d'entraînement. Conçu pour l'ingénierie de systèmes complexes et les tâches agentiques.
205K ctx131K sortieIn: $0.0018/1MOut: $0.0056/1M
ToolsStreamtoolsreasoning
GLM-5 Turbo
Z.ai
Variante rapide de GLM-5 avec vitesse optimisée et qualité compétitive.
In: $0.0021/1MOut: $0.0070/1M
ToolsStreamtoolsreasoning
GLM-5.1
Z.ai
Z.ai's current flagship for agentic and coding tasks.
205K ctx131K sortieIn: $0.0024/1MOut: $0.0077/1M
ToolsStreamtoolsreasoning
GLM-5.2
Z.ai
Z.ai's latest flagship for agentic and coding tasks.
205K ctx131K sortieIn: $0.0024/1MOut: $0.0077/1M
ToolsStreamtoolsreasoning
GLM-5.3
Z.ai
nouveau
Z.ai's newest flagship for agentic and coding tasks. Always reasons; text-only input.
205K ctx131K sortieIn: $0.0024/1MOut: $0.0077/1M
ToolsStreamtoolsreasoning
GLM-5.3 Flash
Z.ai
nouveau
Z.ai's fast, low-cost GLM-5.3 variant: 1M context, tools, always reasons; text and image input.
1M ctx131K sortieIn: $0.000262/1MOut: $0.000875/1M
ToolsStreamtoolsreasoningvision+1
GLM-5V Turbo
Z.ai
Native multimodal coding model. 744B MoE (40B active), 203K context. Optimized for design-to-code, GUI automation, and vision-grounded agentic tasks.
205K ctx131K sortieIn: $0.0021/1MOut: $0.0070/1M
ToolsStreamtoolsreasoningimage+1
GLM-Image
Z.ai
Z.ai's image generation model with strong prompt adherence and text rendering.
$0.0262/unit
GLM-OCR
Z.ai
Specialized OCR model for extracting text from images and documents.
8K ctx8K sortieIn: $0.000053/1MOut: $0.000053/1M
Streamimage
GPT Image 2
OpenAI
OpenAI's latest image generation model (high-quality tier).
$0.3693/unit
imageimage_editimage
GPT-3.5 Turbo
OpenAI
OpenAI GPT-3.5 Turbo (chat completions endpoint).
In: $0.000875/1MOut: $0.0026/1M
tools
GPT-3.5 Turbo 16K
OpenAI
OpenAI GPT-3.5 Turbo 16K (chat completions endpoint).
In: $0.0053/1MOut: $0.0070/1M
tools
GPT-4
OpenAI
OpenAI GPT-4 (chat completions endpoint).
In: $0.0525/1MOut: $0.1050/1M
tools
GPT-4 Turbo
OpenAI
OpenAI GPT-4 Turbo (chat completions endpoint).
In: $0.0175/1MOut: $0.0525/1M
toolsvisionimage
GPT-4.1
OpenAI
OpenAI GPT-4.1 (chat completions endpoint).
1.047576M ctx33K sortieIn: $0.0035/1MOut: $0.0140/1M
ToolsStreamtoolsimage
GPT-4.1 Mini
OpenAI
OpenAI GPT-4.1 Mini (chat completions endpoint).
1.047576M ctx33K sortieIn: $0.000700/1MOut: $0.0028/1M
ToolsStreamtoolsimage
GPT-4o
OpenAI
OpenAI GPT-4o (chat completions endpoint).
128K ctx16K sortieIn: $0.0044/1MOut: $0.0175/1M
ToolsStreamtoolsimage
GPT-4o Mini
OpenAI
OpenAI GPT-4o Mini (chat completions endpoint).
128K ctx16K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamtoolsimage
GPT-5
OpenAI
OpenAI GPT-5 (chat completions endpoint).
272K ctx128K sortieIn: $0.0022/1MOut: $0.0175/1M
ToolsStreamtoolsimage
GPT-5 Mini
OpenAI
OpenAI GPT-5 Mini (chat completions endpoint).
272K ctx128K sortieIn: $0.000438/1MOut: $0.0035/1M
ToolsStreamtoolsimage
GPT-5 Nano
OpenAI
OpenAI GPT-5 Nano (chat completions endpoint).
272K ctx128K sortieIn: $0.000087/1MOut: $0.000700/1M
ToolsStreamtoolsimage
GPT-5 Pro
OpenAI
OpenAI GPT-5 Pro (chat completions endpoint).
272K ctx128K sortieIn: $0.0262/1MOut: $0.2100/1M
ToolsStreamtoolsreasoningimage
GPT-5 Search API
OpenAI
OpenAI GPT-5 Search API (chat completions endpoint).
272K ctx128K sortieIn: $0.0022/1MOut: $0.0175/1M
Streamweb_searchimage
GPT-5.1
OpenAI
OpenAI GPT-5.1 (chat completions endpoint).
272K ctx128K sortieIn: $0.0022/1MOut: $0.0175/1M
ToolsStreamtoolsimage
GPT-5.2
OpenAI
OpenAI GPT-5.2 (chat completions endpoint).
272K ctx128K sortieIn: $0.0031/1MOut: $0.0245/1M
ToolsStreamtoolsimage
GPT-5.2 Pro
OpenAI
OpenAI GPT-5.2 Pro (chat completions endpoint).
272K ctx128K sortieIn: $0.0367/1MOut: $0.2940/1M
ToolsStreamtoolsreasoningimage
GPT-5.3 Codex
OpenAI
OpenAI GPT-5.3 Codex (chat completions endpoint).
272K ctx128K sortieIn: $0.0031/1MOut: $0.0245/1M
ToolsStreamtoolsreasoningimage
GPT-5.4
OpenAI
OpenAI mid-tier flagship (March 2026).
272K ctx128K sortieIn: $0.0044/1MOut: $0.0262/1M
ToolsStreamtoolsimage
GPT-5.4 Mini
OpenAI
OpenAI fast/cheap chat model.
272K ctx128K sortieIn: $0.0013/1MOut: $0.0079/1M
ToolsStreamtoolsimage
GPT-5.4 Nano
OpenAI
OpenAI cheapest tier, very fast.
272K ctx128K sortieIn: $0.000350/1MOut: $0.0022/1M
ToolsStreamtoolsimage
GPT-5.4 Pro
OpenAI
OpenAI GPT-5.4 Pro (chat completions endpoint).
272K ctx128K sortieIn: $0.0525/1MOut: $0.3150/1M
ToolsStreamtoolsreasoningimage
GPT-5.5
OpenAI
OpenAI flagship chat model (April 2026 release).
272K ctx128K sortieIn: $0.0088/1MOut: $0.0525/1M
ToolsStreamtoolsimage
GPT-5.5 Pro
OpenAI
OpenAI premium tier with deep reasoning. April 2026.
272K ctx128K sortieIn: $0.0525/1MOut: $0.3150/1M
ToolsStreamtoolsreasoningimage
GPT-5.6 Luna
OpenAI
OpenAI GPT-5.6 Luna — high-volume streaming tasks, fast + economical 5.6 tier.
272K ctx128K sortieIn: $0.0018/1MOut: $0.0105/1M
ToolsStreamtoolsreasoningvision+1
GPT-5.6 Sol
OpenAI
OpenAI GPT-5.6 Sol — frontier logic + deep reasoning, the flagship 5.6 tier.
272K ctx128K sortieIn: $0.0088/1MOut: $0.0525/1M
ToolsStreamtoolsreasoningvision+1
GPT-5.6 Terra
OpenAI
OpenAI GPT-5.6 Terra — balanced business logic, mid 5.6 tier.
272K ctx128K sortieIn: $0.0044/1MOut: $0.0262/1M
ToolsStreamtoolsreasoningvision+1
Grok 4.20 Fast
xAI / Grok
Non-reasoning variant of Grok 4.20. Fastest 4.20 path for chat and high-throughput tasks.
1M ctx8K sortieIn: $0.0022/1MOut: $0.0044/1M
ToolsStreamchattoolsimage
Grok 4.20 Reasoning
xAI / Grok
Reasoning-mode variant of Grok 4.20. Slower but stronger on multi-step problems.
1M ctx8K sortieIn: $0.0022/1MOut: $0.0044/1M
ToolsStreamchatreasoningtools+1
Grok 4.3
xAI / Grok
xAI's flagship general-purpose model. 1M context, balanced reasoning and chat.
1M ctx8K sortieIn: $0.0022/1MOut: $0.0044/1M
ToolsStreamchattoolsreasoning+1
Grok 4.5
xAI / Grok
xAI's newest flagship, launched July 2026. 500K context, strongest reasoning + coding, trained alongside Cursor.
500K ctx8K sortieIn: $0.0035/1MOut: $0.0105/1M
ToolsStreamchattoolsreasoning+1
Grok 4.6
xAI / Grok
nouveau
xAI's newest flagship. 500K context, accepts text and images, strongest reasoning + coding.
500K ctx8K sortieIn: $0.0035/1MOut: $0.0105/1M
ToolsStreamchattoolsreasoning+1
Grok Build 0.1
xAI / Grok
Compact model tuned for code generation and structured output. 256K context.
256K ctx8K sortieIn: $0.0018/1MOut: $0.0035/1M
ToolsStreamchattoolsimage
Grok Imagine
xAI / Grok
Fast text-to-image generation from xAI. Standard quality, lowest cost.
$0.0350/unit
Grok Imagine 2.0
xAI / Grok
nouveau
xAI's current image model. Higher fidelity than Grok Imagine, with stronger prompt adherence.
$0.1050/unit
Grok Imagine HQ
xAI / Grok
Higher-fidelity Grok Imagine. Better prompt adherence and detail, 2.5x the cost.
$0.0875/unit
Grok Imagine Video
xAI / Grok
Text-to-video generation from xAI. ~8s clips, async render.
$0.0875/unit
Grok Imagine Video 1.5
xAI / Grok
xAI Grok Imagine 1.5 — image-to-video: animates a starting frame from your prompt. Up to 1080p, 1-15s clips, async render.
image
Grok TTS
xAI / Grok
xAI's expressive text-to-speech — 26 multilingual voices with inline speech tags for tone, pauses, whispers and laughter. 20+ languages with auto-detection.
In: $0.0262/1M
Haiku 4.5
Anthropic
Le modèle Haiku le plus rapide et intelligent de Claude
200K ctx64K sortieIn: $0.0018/1MOut: $0.0088/1M
ToolsStreamtoolsreasoningimage
Hailuo 02
MiniMax
Résolution supérieure (1080p), durée plus longue (10 s), meilleure adhérence au prompt
$0.4900/unit
image
Hailuo 2.3
MiniMax
Avancées en mouvement corporel, expressions faciales et réalisme physique
$0.4900/unit
image
Hailuo 2.3 Fast
MiniMax
Modèle image-vers-vidéo optimisé pour la rentabilité et l'efficacité (nécessite le téléchargement d'une image)
$0.3325/unit
image
Hakim Arabic v2
Hakim
Arabic-first speech-to-text with dialect-aware recognition and broad multilingual coverage.
$0.000292/unit
audio
📝 TranscriptionEn savoir plus →
Hakim Fast v1
Hakim
Arabic-first text-to-speech, low-latency tier, with 50 voices spanning Arabic dialects and 20+ languages.
In: $0.0700/1M
HappyHorse 1.0 I2V
Alibaba Cloud
Alibaba HappyHorse image-to-video. Animates a still image into a coherent motion sequence guided by text.
$0.2450/unit
videoimage
HappyHorse 1.0 R2V
Alibaba Cloud
Alibaba HappyHorse reference-to-video. Generates video conditioned on a reference image plus text prompt.
$0.2450/unit
videoimage
HappyHorse 1.0 T2V
Alibaba Cloud
Alibaba HappyHorse text-to-video. Generates short cinematic clips from text prompts.
$0.2450/unit
video
HappyHorse 1.1 I2V
Alibaba Cloud
Alibaba HappyHorse 1.1 image-to-video. Animates a still image into coherent motion guided by text (native DashScope, US-Virginia).
videoimage
HappyHorse 1.1 R2V
Alibaba Cloud
Alibaba HappyHorse 1.1 reference-to-video. Generates video that preserves the subject and scene from one or more reference images (native DashScope, US-Virginia).
videoimage
HappyHorse 1.1 T2V
Alibaba Cloud
Alibaba HappyHorse 1.1 text-to-video. Generates short cinematic clips from text prompts (native DashScope, US-Virginia).
video
HappyHorse Video Edit
Alibaba Cloud
Alibaba HappyHorse video editing. Edits a source video from natural-language instructions, optionally guided by reference images (native DashScope, US-Virginia).
videovideoimage
Ideogram 2.0
Ideogram
Modèle de génération précédente. Toujours excellent pour le rendu de texte à moindre coût.
$0.1050/unit
Ideogram 3.0
Ideogram
Génération d'images à la pointe avec un rendu de texte exceptionnel. Meilleur équilibre qualité-vitesse.
$0.1225/unit
Ideogram 3.0 Quality
Ideogram
Ideogram 3.0 de la plus haute qualité. Détail et fidélité maximaux pour les rendus finaux.
$0.1750/unit
Ideogram 3.0 Turbo
Ideogram
Variante turbo d'Ideogram 3.0. Génération rapide pour les flux de travail itératifs.
$0.0700/unit
Image-01
MiniMax
Génération texte-vers-image de qualité cinématique avec haute fidélité au prompt
$0.0061/unit
Jina CLIP v2
Jina AI
Modèle CLIP de Jina AI — embeddings cross-modaux texte-image prenant en charge 89 langues avec représentations Matryoshka. 865M paramètres.
8K ctxIn: $0.000087/1M
image
🔍 EmbeddingEn savoir plus →
Jina Code Embeddings 1.5B
Jina AI
Modèle d'embedding spécialisé code de Jina AI — 1,5B paramètres optimisés pour la recherche et la récupération de code. Contexte 32K.
33K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
Jina ColBERT v2
Jina AI
Modèle ColBERT à interaction tardive de Jina AI — embeddings multi-vecteurs pour une recherche fine, 89 langues, tailles d'embedding contrôlables par l'utilisateur.
8K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
Jina Embeddings v3
Jina AI
Modèle d'embedding textuel multilingue 570M de Jina AI — champion du benchmark MTEB, contexte 8K, 89 langues.
8K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
Jina Embeddings v4
Jina AI
Dernier modèle d'embedding multimodal de Jina AI — intègre texte et images dans un espace vectoriel partagé avec contexte 32K. Qualité de recherche à la pointe.
33K ctxIn: $0.000087/1M
image
🔍 EmbeddingEn savoir plus →
Jina Reranker M0
Jina AI
Reranker multimodal de Jina AI — reclasse les résultats contenant texte et images pour les pipelines de recherche cross-modale.
10K ctxIn: $0.000087/1M
image
↕️ RerankingEn savoir plus →
Jina Reranker v3
Jina AI
Dernier reranker de Jina AI — architecture listwise inédite, SOTA en recherche multilingue, fenêtre de contexte massive de 131K. 0,6B paramètres.
134K ctxIn: $0.000087/1M
↕️ RerankingEn savoir plus →
Kimi K2.6
Moonshot AI
Latest Kimi K2 reasoning model. Replaces K2 thinking variants (k2-thinking and k2-thinking-turbo) being retired 2026-05-25.
262K ctx131K sortieIn: $0.0017/1MOut: $0.0070/1M
ToolsStreamchatreasoningfunction_calling+1
Kimi K2.7 Code
Moonshot AI
Coding-specialized Kimi K2 model (k2.7). 256K context, agentic tool use and function calling, tuned for software engineering.
262K ctx131K sortieIn: $0.0017/1MOut: $0.0070/1M
ToolsStreamchatreasoningfunction_calling+1
Kimi K2.7 Code Highspeed
Moonshot AI
High-speed variant of Kimi K2.7 Code for low-latency agentic software engineering.
262K ctx131K sortieIn: $0.0017/1MOut: $0.0070/1M
ToolsStreamchatreasoningfunction_calling+1
Kimi K3
Moonshot AI
Moonshot's open-weight 2.8T-parameter multimodal reasoning model with a 1M-token context window.
1.048576M ctx131K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamchatreasoningfunction_calling+2
Leonardo Anime XL
Leonardo.ai
Modèle haute vitesse orienté anime excelling dans une gamme de styles anime.
$0.0280/unit
generation
Leonardo Diffusion XL
Leonardo.ai
Modèle principal Leonardo avec des rendus époustouflants et une large gamme de styles.
$0.0280/unit
generation
Leonardo Kino XL
Leonardo.ai
Modèle orienté cinéma excelling dans les compositions et éclairages de type film.
$0.0280/unit
generation
Leonardo Lightning XL
Leonardo.ai
Modèle de génération d'images généraliste haute vitesse pour une itération rapide.
$0.0140/unit
generation
Leonardo Vision XL
Leonardo.ai
Modèle polyvalent excelling dans le réalisme et la photographie.
$0.0280/unit
generation
Long Video to SFX 1.6
Mirelo
Generate sound effects for longer videos (SFX 1.6), up to 60 seconds of audio from a video URL.
$0.1750/unit
video
🔊 Effets sonoresEn savoir plus →
Lucid Origin
Leonardo.ai
Modèle Leonardo pour une imagerie vibrante et diversifiée en sortie HD.
$0.0280/unit
generation
Lucid Realism
Leonardo.ai
Modèle Leonardo haute vitesse conçu pour des rendus photoréalistes.
$0.0280/unit
generation
Lyria 3 Clip
Google
Google DeepMind's latest music generation — 30-second compositions from text prompts with SynthID watermarking.
$0.0700/unit
🎵 MusiqueEn savoir plus →
Lyria 3 Pro
Google
Full-song generation from Google DeepMind's Lyria 3 — complete compositions from text prompts with SynthID watermarking.
$0.1400/unit
🎵 MusiqueEn savoir plus →
M2
MiniMax
Capacités agentiques avec raisonnement avancé et visibilité du processus de réflexion
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
M2 Stable
MiniMax
Optimisé pour la haute concurrence et l'usage commercial avec raisonnement avancé
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
M2.5
MiniMax
Modèle de raisonnement de pointe avec code SOTA, utilisation agentique d'outils et performance sur des tâches complexes
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
M2.5 Highspeed
MiniMax
Variante rapide de M2.5 optimisée pour la vitesse à environ 100 tokens par seconde
In: $0.0010/1MOut: $0.0042/1M
ToolsStream
M2.7
MiniMax
Autonomous real-world productivity with agentic collaboration, live debugging, and professional document generation
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
M2.7 Highspeed
MiniMax
nouveau
Fast variant of M2.7 for latency-sensitive work. 200K context, text only.
200K ctx128K sortieIn: $0.0010/1MOut: $0.0042/1M
ToolsStreamtools
M3
MiniMax
MiniMax flagship LLM, 1M context.
In: $0.000525/1MOut: $0.0021/1M
ToolsStream
Magistral Small
Mistral AI
Modèle de raisonnement efficace pour les tâches logiques quotidiennes.
131K ctx40K sortieIn: $0.000875/1MOut: $0.0026/1M
Streamchatreasoning
Marengo 3.0
Twelve Labs
Modèle d'embedding vidéo multimodal de Twelve Labs. Convertit vidéo, audio et texte en un espace vectoriel partagé pour la recherche sémantique dans 36 langues.
$0.000963/unit
embeddingsearchvideoaudioimage
🔍 EmbeddingEn savoir plus →
Meshy 6 Image-to-3D
Meshy
Transform images into detailed 3D models with textures and PBR maps
$1.05/unit
3d-generationimage
Meshy 6 Text-to-3D
Meshy
Generate detailed 3D models from text descriptions with PBR textures
$1.05/unit
3d-generation
Meshy 7 Image-to-3D
Meshy
nouveau
Transform images into detailed 3D models with the highest image alignment Meshy has shipped, textures and PBR maps
$1.05/unit
3d-generationimage
Meshy 7 Multi-Image-to-3D
Meshy
nouveau
Combine two to four views of the same subject into one aligned, textured 3D model with PBR maps
$1.05/unit
3d-generationimage
Ministral 3 14B
Mistral AI
Modèle edge haute performance avec vision. Meilleur Ministral pour les tâches complexes.
131K ctx8K sortieIn: $0.000350/1MOut: $0.000350/1M
ToolsStreamchattoolsimage
Ministral 3 3B
Mistral AI
Modèle edge ultra-léger avec vision. 3B paramètres, fonctionne sur téléphones/ordinateurs portables.
131K ctx8K sortieIn: $0.000175/1MOut: $0.000175/1M
ToolsStreamchattoolsimage
Ministral 3 8B
Mistral AI
Modèle edge compact avec vision. 8B paramètres pour le déploiement local.
131K ctx8K sortieIn: $0.000262/1MOut: $0.000262/1M
ToolsStreamchattoolsimage
Mistral Embed
Mistral AI
Modèle d'embedding textuel de Mistral pour la recherche sémantique, la récupération et la classification.
In: $0.000175/1M
🔍 EmbeddingEn savoir plus →
Mistral Large 3
Mistral AI
Modèle phare à poids ouverts. MoE 675B (41B actifs), multimodal avec vision. Licence Apache 2.0.
131K ctx8K sortieIn: $0.000875/1MOut: $0.0026/1M
ToolsStreamchattoolsimage
Mistral Medium
Mistral AI
Modèle multimodal de première classe. Excellent équilibre entre Large et Small.
131K ctx8K sortieIn: $0.0026/1MOut: $0.0131/1M
ToolsStreamchattoolsreasoning
Mistral Moderation
Mistral AI
Modèle de modération de contenu de Mistral pour détecter les contenus nuisibles, dangereux ou contraires aux politiques.
In: $0.000175/1M
⚡ CapacitéEn savoir plus →
Mistral OCR 3
Mistral AI
Modèle IA documentaire pour l'OCR haute précision. Extrait le texte d'images, PDF, contenus manuscrits, formulaires et tableaux complexes.
In: $0.0018/1MOut: $0.0053/1M
image
Mistral Small
Mistral AI
Modèle rapide et efficace pour les tâches simples. Excellent rapport performance-coût.
131K ctx8K sortieIn: $0.000175/1MOut: $0.000525/1M
ToolsStreamchattools
Mistral Vibe CLI
Mistral AI
Modèle Mistral optimisé pour les flux de travail de code en ligne de commande et terminal.
128K ctx33K sortieIn: $0.000175/1MOut: $0.000525/1M
ToolsStreamtools
Multilingual v2
ElevenLabs
Synthèse vocale la plus avancée avec conscience émotionnelle et expression riche dans 29 langues
In: $0.3850/1M
Murf Gen2
Murf
$0.000053/unit
Nano Banana
Google
Gemini 2.5 Flash Image — optimisé pour la vitesse et l'efficacité, génération d'images haut volume à faible latence.
66K ctx33K sortie$0.0683/unit
Nano Banana 2
Google
High-efficiency image generation, optimized for speed and high-volume use.
66K ctx33K sortie$0.1172/unit
image
Nano Banana 2 Lite
Google
Efficiency specialist of the Nano Banana family — ultra-low-latency, cost-effective image generation and editing.
66K ctx33K sortie$0.0588/unit
image
Nano Banana Pro
Google
Google's native image generation with text rendering and multimodal understanding.
66K ctx33K sortie$0.2345/unit
image
o3
OpenAI
OpenAI o3 (chat completions endpoint).
200K ctx100K sortieIn: $0.0035/1MOut: $0.0140/1M
ToolsStreamtoolsreasoningimage
Octave 1
Hume
Première génération de synthèse vocale empathique avec expression émotionnelle naturelle
In: $0.2625/1M
Octave 2
Hume
Dernier modèle de synthèse vocale empathique prenant en charge 11 langues avec conscience émotionnelle
In: $0.1313/1M
Opus 4.5
Anthropic
Modèle premium combinant intelligence maximale et performance pratique
200K ctx64K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
Opus 4.6
Anthropic
Modèle Claude le plus performant avec raisonnement et code améliorés
1M ctx64K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
Opus 4.7
Anthropic
Highly capable Claude Opus for complex reasoning and coding (1M context)
1M ctx128K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
Opus 4.8
Anthropic
Anthropic's most capable model for complex reasoning and agentic coding (1M context)
1M ctx128K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
Opus 5
Anthropic
Anthropic's flagship Opus — deep reasoning, agentic coding and long-horizon work (1M context)
1M ctx128K sortieIn: $0.0088/1MOut: $0.0437/1M
ToolsStreamtoolsreasoningimage
Ossington 3
Augure
Large-context generalist with 128K window. Excellent for complex generation and analysis. Augure sovereign Canadian AI.
131K ctx33K sortieIn: $0.0013/1MOut: $0.0038/1M
ToolsStreamchattools
Ossington 4.1
Augure
Premium multimodal model with vision and tool use, strong bilingual EN/FR. Augure sovereign Canadian AI.
33K ctx33K sortieIn: $0.0032/1MOut: $0.0101/1M
ToolsStreamchattoolsvision+1
Phoenix 0.9
Leonardo.ai
Aperçu du modèle fondamental Leonardo avec adhérence extrême au prompt et polyvalence.
$0.0280/unit
generation
Phoenix 1.0
Leonardo.ai
Modèle phare fondamental de Leonardo avec une adhérence exceptionnelle au prompt et un rendu de texte de qualité.
$0.0280/unit
generation
PixVerse C1
PixVerse
PixVerse C1, cinematic-quality video generation tuned for action scenes and reference-based work, clips from 1 to 15 seconds with optional generated audio.
video
PixVerse C1 Image-to-Video
PixVerse
PixVerse C1 image-to-video: cinematic animation of a source image into a 1–15 second clip with optional generated audio.
videoimage
PixVerse C1 Reference-to-Video
PixVerse
PixVerse C1 fusion: cinematic video from 1–3 reference images (subjects or scenes) guided by a prompt, with optional generated audio.
videoimage
PixVerse V6
PixVerse
PixVerse V6, general-purpose video generation with clips from 1 to 15 seconds, optional generated audio, and multi-clip support.
video
PixVerse V6 Image-to-Video
PixVerse
PixVerse V6 image-to-video: animate a source image into a 1–15 second clip with optional generated audio.
videoimage
PixVerse V6 Reference-to-Video
PixVerse
PixVerse V6 fusion: generate a video from 1–3 reference images (subjects or scenes) guided by a prompt, with optional generated audio.
videoimage
pplx-embed v1 0.6B
Perplexity
Modèle d'embedding léger de Perplexity. Vecteurs INT8 1024D, contexte 32K, réduction dimensionnelle Matryoshka.
33K ctxIn: $0.000087/1M
🔍 EmbeddingEn savoir plus →
pplx-embed v1 4B
Perplexity
Modèle d'embedding le plus performant de Perplexity. Vecteurs INT8 2560D, contexte 32K, réduction dimensionnelle Matryoshka.
33K ctxIn: $0.000175/1M
🔍 EmbeddingEn savoir plus →
Pruna Image
Pruna
Pruna's optimized text-to-image: fast, high-quality generation.
$0.0088/unit
Pruna Image Edit
Pruna
Pruna's optimized image editing: transform an input image with a prompt.
$0.0175/unit
image
Pruna Video
Pruna
Pruna's premium video generation: text-to-video and image-to-video, up to 1080p. Draft mode gives fast, cheap previews.
videoimage
Qwen Flash
Alibaba Cloud
Modèle ultra-rapide avec contexte de 1M. Meilleure latence et rentabilité pour les tâches simples.
1M ctx8K sortieIn: $0.000039/1MOut: $0.000378/1M
ToolsStreamtoolsreasoning
Qwen Image 2.0
Alibaba Cloud
Alibaba's flagship text-to-image model — successor to the whole Qwen-Image family, with strong prompt following and text rendering (native DashScope, Singapore).
$0.0612/unit
Qwen Image 2.0 Pro
Alibaba Cloud
The higher-fidelity "pro" tier of Alibaba's Qwen Image 2.0 — stronger prompt following and text rendering (native DashScope, Singapore).
$0.1313/unit
Qwen Plus
Alibaba Cloud
Modèle phare équilibré avec contexte de 1M. Meilleur rapport performance-coût pour la plupart des tâches.
1M ctx8K sortieIn: $0.000700/1MOut: $0.0021/1M
ToolsStreamtoolsreasoning
Qwen3 Coder Flash
Alibaba Cloud
Modèle de code économique optimisé pour la vitesse. Génération et complétion de code rapides à moindre coût.
131K ctx8K sortieIn: $0.000252/1MOut: $0.0010/1M
ToolsStreamtools
Qwen3 VL Plus
Alibaba Cloud
Modèle avancé vision-langage avec contexte 262K. Excelle en codage visuel, perception spatiale et raisonnement multimodal.
262K ctx8K sortieIn: $0.000250/1MOut: $0.0025/1M
ToolsStreamtoolsreasoningimage
Qwen3.5 Flash
Alibaba Cloud
Flagship 1T+ parameter model. State-of-the-art reasoning, coding, and agent capabilities.
262K ctx33K sortieIn: $0.000051/1MOut: $0.000502/1M
ToolsStreamtoolsreasoning
Qwen3.5 Omni Flash
Alibaba Cloud
Alibaba Qwen3.5 Omni Flash, fast multimodal (text & image input, text output). Singapore deployment; native voice/audio coming.
66K ctx8K sortieIn: $0.000700/1MOut: $0.0039/1M
Streamimage
Qwen3.5 Omni Plus
Alibaba Cloud
Alibaba Qwen3.5 Omni, multimodal (text & image input, text output). Singapore deployment; native voice/audio coming.
66K ctx8K sortieIn: $0.0024/1MOut: $0.0145/1M
Streamimage
Qwen3.5 Plus
Alibaba Cloud
Modèle MoE 397B avec 17B paramètres actifs, contexte de 1M de tokens, multimodal (texte/image/vidéo)
1M ctx8K sortieIn: $0.000201/1MOut: $0.0012/1M
ToolsStreamtoolsreasoningimage+1
Qwen3.6 Flash
Alibaba Cloud
Flagship 1T+ parameter model. State-of-the-art reasoning, coding, and agent capabilities.
262K ctx33K sortieIn: $0.000289/1MOut: $0.0017/1M
ToolsStreamtoolsreasoning
Qwen3.6 Plus
Alibaba Cloud
Qwen3.6 Plus, next-gen frontier LLM (Agentic Coding, vision/OCR, fine-grained localization). Replaces Qwen3.5 Plus.
1M ctx8K sortieIn: $0.000483/1MOut: $0.0029/1M
ToolsStreamtoolsreasoningimage+1
Qwen3.7 Max
Alibaba Cloud
Alibaba's Agent Frontier flagship.
262K ctx33K sortieIn: $0.0029/1MOut: $0.0087/1M
ToolsStreamtoolsreasoning
Qwen3.7 Plus
Alibaba Cloud
Multimodal frontier (vision/video); cheaper than Max.
1M ctx8K sortieIn: $0.000483/1MOut: $0.0019/1M
ToolsStreamtoolsreasoningimage+1
Qwen3.8 Max
Alibaba Cloud
nouveau
Alibaba's 2.4T-parameter multimodal MoE flagship. 1M context, accepts text and images.
1M ctx33K sortieIn: $0.0035/1MOut: $0.0105/1M
ToolsStreamtoolsreasoningimage
Ray 3.2 (1080p, 10s)
Luma AI
Advanced AI video generation model by Luma AI
$6.30/unit
Ray 3.2 (1080p)
Luma AI
Advanced AI video generation model by Luma AI
$2.10/unit
Ray 3.2 (540p, 10s)
Luma AI
Advanced AI video generation model by Luma AI
$0.7875/unit
Ray 3.2 (540p)
Luma AI
Advanced AI video generation model by Luma AI
$0.2625/unit
Ray 3.2 (720p, 10s)
Luma AI
Advanced AI video generation model by Luma AI
$1.57/unit
Ray 3.2 (720p)
Luma AI
Advanced AI video generation model by Luma AI
$0.5250/unit
RD Classic
Retro Diffusion
Génération de pixel art classique avec 15 styles. Idéal pour les assets de jeux, personnages, textures et visuels rétro. 16-512 px.
$0.0350/unit
RD Flux
Retro Diffusion
Pixel art avancé avec le modèle Flux. Mêmes 15 styles que Classic avec qualité et détail améliorés. 16-512 px.
$0.0350/unit
Recraft V3
Recraft
Recraft V3 (Red Panda) — texte-vers-image, image-vers-image, inpainting et remplacement d'arrière-plan. 1024×1024.
$0.0700/unit
image
Recraft V3 Vector
Recraft
Recraft V3 pour graphiques vectoriels — sortie SVG avec image-vers-image, inpainting et remplacement d'arrière-plan.
$0.1400/unit
image
Recraft V4
Recraft
Dernier modèle de génération d'images de Recraft — styles photoréalistes et illustration, rendu de texte, 1024×1024, ~10 s de génération.
$0.0700/unit
Recraft V4 Pro
Recraft
Modèle d'image de la plus haute qualité de Recraft — sortie 2048×2048, anatomie et détail supérieurs, idéal pour les assets prêts à imprimer. ~30 s de génération.
$0.4375/unit
Recraft V4 Pro Vector
Recraft
Modèle vectoriel de la plus haute qualité de Recraft — sortie SVG haute résolution avec détails fins, idéal pour les logos et assets de marque.
$0.5250/unit
Recraft V4 Vector
Recraft
Recraft V4 pour graphiques vectoriels — génère des SVG de qualité production avec régions de couleur discrètes et géométrie nette.
$0.1400/unit
Remove Background
Bria
Suppression de l'arrière-plan d'une image avec transparence
$0.0315/unit
image
Replace Background
Bria
Remplacement de l'arrière-plan d'une image par une scène générée par IA
$0.0525/unit
image
Rerank 2.5
Voyage AI
Dernier modèle de reclassement de Voyage AI — réévalue les résultats de recherche pour une pertinence maximale. Meilleure qualité. 200M de tokens gratuits.
In: $0.000087/1M
↕️ RerankingEn savoir plus →
Rerank 2.5 Lite
Voyage AI
Modèle de reclassement rapide de Voyage AI — réévaluation économique pour les pipelines de recherche à haut volume. 200M de tokens gratuits.
In: $0.000035/1M
↕️ RerankingEn savoir plus →
Restore Old Photo
Bria
Repair and revive old or damaged photos
$0.0525/unit
image
Rime Arcana
Rime
Rime's flagship voice model, 269 voices across 9 languages with rich emotional range.
In: $0.0700/1M
tts
Rime Coda
Rime
Stylized voices in 4 categories (Professional / Formal / Casual / Energetic). 184 voices, 8 languages.
In: $0.0525/1M
tts
Rime Mist
Rime
Original Mist model, 117 English voices, fast.
In: $0.0437/1M
tts
Rime Mist v2
Rime
Mist generation 2, 141 voices across 4 languages.
In: $0.0437/1M
tts
Rime Mist v3
Rime
Latest Mist generation, 83 voices, 4 languages. Improved expressiveness.
In: $0.0437/1M
tts
Rosedale One
Augure
Premium model for complex, multi-step work. Augure sovereign Canadian AI.
33K ctx33K sortieIn: $0.0044/1MOut: $0.0139/1M
ToolsStreamchattools
Sarvam 105B
Sarvam AI
Sarvam's 24B multilingual LLM, fluent in all 22 official Indian languages + English. OpenAI-compatible API. Free tier with no per-token charges. Supports wiki grounding, reasoning effort control, and tool calls.
In: $0.000081/1MOut: $0.000325/1M
Toolstoolsreasoning
Scribe v1
ElevenLabs
Reconnaissance vocale par lots avec horodatage au mot et détection de langue dans 99 langues.
$0.000170/unit
audio
📝 TranscriptionEn savoir plus →
Scribe v2 Realtime
ElevenLabs
Reconnaissance vocale en temps réel à latence ultra-faible (<150 ms). 93,5 % de précision dans plus de 90 langues. Streaming WebSocket avec DAV.
$0.000170/unit
audio
📝 TranscriptionEn savoir plus →
SD Core
StabilityAI
Équilibre vitesse et qualité pour la création d'assets numériques à haut volume
$0.0525/unit
SD Ultra
StabilityAI
Génération d'images photoréalistes de la plus haute qualité, parfaite pour les médias imprimés professionnels
$0.1400/unit
SD3.5 Large
StabilityAI
Modèle MMDiT de 8B paramètres. Qualité supérieure, typographie et adhérence au prompt. Le plus puissant de la famille SD.
$0.1138/unit
SD3.5 Large Turbo
StabilityAI
SD3.5 Large distillé optimisé pour une inférence plus rapide avec moins d'étapes.
$0.0700/unit
SD3.5 Medium
StabilityAI
Modèle SD3.5 équilibré. Bonne qualité avec moins de ressources que la version Large.
$0.0612/unit
SDXL 1.0
StabilityAI
SDXL 1.0 pour la génération d'images haute résolution 1024×1024
$0.0035/unit
Search API
Capabilities
⚡ CapacitéEn savoir plus →
Seedance 1.5 Pro
BytePlus
Génération conjointe audio-vidéo. Vidéos cinématiques 1080p avec audio natif, narration multi-plans et personnages cohérents.
Out: $0.0021/1M
image
Seedance 2.0
BytePlus
ByteDance Seedance 2.0, text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0135/1M
image
Seedance 2.0 Fast
BytePlus
ByteDance Seedance 2.0 Fast — speed-optimized text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0098/1M
image
Seedance 2.0 Mini
BytePlus
ByteDance Seedance 2.0 Mini — cost-optimized text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0061/1M
image
Seedance 2.5
BytePlus
nouveau
ByteDance Seedance 2.5, text & image to video, native via BytePlus (Ark). Billed per output token.
Out: $0.0187/1M
image
Seedream 5.0 Lite
BytePlus
ByteDance Seedream 5.0 Lite, text-to-image (2K+), native via BytePlus (Ark).
$0.0612/unit
Seedream 5.0 Pro
BytePlus
ByteDance Seedream 5.0 Pro, flagship text-to-image (2K+), highest quality + consistency. Native via BytePlus (Ark).
$0.1575/unit
Simba English
Speechify
Synthèse vocale anglaise de haute qualité avec un rendu naturel
In: $0.0175/1M
Simba Multilingual
Speechify
Synthèse vocale naturelle prenant en charge plus de 60 langues avec des capacités multilingues complètes
In: $0.0175/1M
Simba Turbo
Speechify
Synthèse vocale anglaise ultra-rapide optimisée pour la vitesse avec latence minimale
In: $0.0175/1M
Solar Mini
Upstage
Modèle léger d'Upstage pour une inférence rapide et économique.
33K ctx4K sortieIn: $0.000262/1MOut: $0.0010/1M
Streamchat
Solar Pro 2
Upstage
Modèle pro de génération précédente d'Upstage avec contexte 64K.
66K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamchattools
Solar Pro 2 Nightly
Upstage
Version nightly d'Upstage Solar Pro 2 avec les dernières améliorations.
66K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamchattools
Solar Pro 3
Upstage
Upstage flagship 100B MoE model with reasoning capabilities and strong multilingual performance.
131K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
ToolsStreamchatreasoningtools
Sonar
Perplexity
Modèle léger de Perplexity avec recherche web — recherche en temps réel avec citations, réponses rapides, contexte 128K.
128K ctx16K sortieIn: $0.0018/1MOut: $0.0018/1M
Streamsearch
Sonar Deep Research
Perplexity
Modèle de recherche le plus approfondi de Perplexity — investigation web multi-étapes avec citations complètes et raisonnement.
128K ctx33K sortieIn: $0.0035/1MOut: $0.0140/1M
Streamsearchreasoning
Sonar Pro
Perplexity
Modèle de recherche avancé de Perplexity — recherche web approfondie, raisonnement multi-étapes avec citations, contexte 200K.
200K ctx16K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamtoolssearch
Sonar Reasoning Pro
Perplexity
Modèle de raisonnement de Perplexity — réflexion approfondie avec recherche web en temps réel, idéal pour la recherche et l'analyse complexes.
128K ctx16K sortieIn: $0.0035/1MOut: $0.0140/1M
ToolsStreamtoolssearchreasoning
Sonic 3
Cartesia
Synthèse vocale ultra-réaliste la plus rapide et la plus expressive au monde avec plus de 60 émotions et 42 langues
In: $0.0875/1M
Sonic Turbo
Cartesia
Génération vocale à latence ultra-faible (40 ms) optimisée pour les applications en temps réel
In: $0.0875/1M
Sonnet 4.5
Anthropic
Le meilleur modèle Claude pour les agents complexes et le code
200K ctx64K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamtoolsreasoningimage
Sonnet 4.6
Anthropic
Claude Sonnet 4.6 — dernier modèle équilibré d'Anthropic avec raisonnement, code et suivi d'instructions améliorés.
1M ctx64K sortieIn: $0.0053/1MOut: $0.0262/1M
ToolsStreamtoolsreasoningimage
Sonnet 5
Anthropic
Anthropic's most capable Sonnet — closes the gap with Opus for complex agents and coding (1M context)
1M ctx64K sortieIn: $0.0035/1MOut: $0.0175/1M
ToolsStreamtoolsreasoningimage
Sora 2
OpenAI
OpenAI Sora 2 video generation. Async jobs polled by app:openai:poll-videos.
$0.7000/unit
Sora 2 Pro
OpenAI
OpenAI Sora 2 Pro, higher resolution (1080p cinematic 1792x1024 / 1024x1792) at same aspect ratios as Sora 2.
$3.50/unit
Speech 02 HD
MiniMax
Axé sur le rythme, la stabilité et la réplication vocale de haute qualité
In: $0.1750/1M
Speech 02 Turbo
MiniMax
Capacités multilingues améliorées à vitesse turbo
In: $0.1050/1M
Speech 2.6 HD
MiniMax
Dernière variante HD mettant l'accent sur la prosodie et la qualité du clonage vocal
In: $0.1750/1M
Speech 2.6 Turbo
MiniMax
Performance turbo avec prise en charge de 40 langues et faible latence
In: $0.1050/1M
Speech 2.8 HD
MiniMax
nouveau
Current HD voice model. Highest fidelity prosody and voice cloning.
In: $0.1750/1M
Speech 2.8 Turbo
MiniMax
nouveau
Current Turbo voice model. Low latency, broad language coverage.
In: $0.1050/1M
Speechmatics Enhanced
Speechmatics
$0.000364/unit
📝 TranscriptionEn savoir plus →
Speechmatics Melia
Speechmatics
$0.000117/unit
📝 TranscriptionEn savoir plus →
Speechmatics Standard
Speechmatics
$0.000219/unit
📝 TranscriptionEn savoir plus →
Stable Audio 2
StabilityAI
Générez musique et effets sonores jusqu'à 3 minutes à partir de prompts textuels. Produit des compositions structurées avec intros, développements et outros en stéréo 44,1 kHz.
$0.3500/unit
🎵 MusiqueEn savoir plus →
Stable Audio 2.5
StabilityAI
Génération musicale et sonore de qualité entreprise. Compositions structurées avec intros, développements et outros en stéréo 44,1 kHz. Inférence en 8 étapes pour une génération rapide.
$0.3500/unit
🎵 MusiqueEn savoir plus →
Stem Separation
ElevenLabs
Séparez l'audio en pistes individuelles (voix, batterie, basse, etc.). Modes 2 ou 6 pistes.
$0.0029/unit
audio
🎚 SéparationEn savoir plus →
Step 3.5 Flash
StepFun
Dernier modèle de raisonnement de StepFun — MoE 196B (11B actifs), contexte 256K, open source Apache 2.0. Intelligence agentique rapide avec code et maths solides.
256K ctx16K sortieIn: $0.000175/1MOut: $0.000525/1M
ToolsStreamtoolsreasoning
Step 3.7 Flash
StepFun
StepFun's multimodal flagship reasoning model.
256K ctx16K sortieIn: $0.000350/1MOut: $0.0020/1M
ToolsStreamtoolsreasoning
Suno V3.5
Suno
Meilleure organisation des chansons avec des structures couplet/refrain claires
$0.1050/unit
🎵 MusiqueEn savoir plus →
Suno V4
Suno
Qualité vocale améliorée et traitement audio affiné pour la génération musicale
$0.1050/unit
🎵 MusiqueEn savoir plus →
Suno V4.5
Suno
Excellente compréhension des prompts avec des vitesses de génération plus rapides, pistes jusqu'à 8 minutes
$0.1050/unit
🎵 MusiqueEn savoir plus →
Suno V4.5 Plus
Suno
Modèle avancé avec variation tonale améliorée et excellente compréhension des prompts
$0.1050/unit
🎵 MusiqueEn savoir plus →
Suno V5
Suno
Modèle de pointe avec qualité et capacités améliorées pour la génération musicale par IA
$0.1050/unit
🎵 MusiqueEn savoir plus →
Syn Pro
Upstage
Modèle avancé de raisonnement synthétique d'Upstage avec contexte 64K.
66K ctx8K sortieIn: $0.000262/1MOut: $0.0010/1M
Streamchat
Sync Lipsync 2
Sync
Synchronisation labiale de qualité studio. Synchronise les mouvements des lèvres avec n'importe quel audio en préservant le style naturel du locuteur.
$0.0875/unit
videoaudio
Sync Lipsync 2 Pro
Sync
Synchronisation labiale premium avec préservation détaillée des barbes, dents et traits fins grâce à la super-résolution par diffusion.
$0.1452/unit
videoaudio
Tofino 2.5
Augure
Fast bilingual workhorse with 128K context for general inference, document processing, and EN/FR tasks. Augure sovereign Canadian AI.
131K ctx33K sortieIn: $0.000630/1MOut: $0.0019/1M
ToolsStreamchattools
Tripo P1 Image-to-3D (Low-Poly)
Tripo
Tripo's P1 model for image-to-3D, converts a single image into a game-ready low-poly mesh (50 to 20k faces) with clean topology and PBR textures.
$0.8750/unit
image
Tripo P1 Multiview-to-3D (Low-Poly)
Tripo
Tripo's P1 model for multiview reconstruction, builds a game-ready low-poly mesh with clean topology from up to 4 view images (front required).
$0.8750/unit
image
Tripo P1 Text-to-3D (Low-Poly)
Tripo
Tripo's P1 model for text-to-3D, generates game-ready low-poly meshes (50 to 20k faces) with clean topology and PBR textures. Exports GLB, FBX, OBJ, USD, STL.
$0.7000/unit
Tripo Smart Segmentation (Balanced)
Tripo
Splits an existing 3D model into separately editable parts, textures and PBR materials preserved. A practical level of separation for most assets.
$0.7000/unit
3d
Tripo Smart Segmentation (Detailed)
Tripo
Splits an existing 3D model into many separately editable parts, textures and PBR materials preserved. Maximum component separation for deep editing and production.
$0.7000/unit
3d
Tripo Smart Segmentation (Simple)
Tripo
Splits an existing 3D model into a few separately editable parts, textures and PBR materials preserved. Quick separation for review and lightweight prep.
$0.7000/unit
3d
Tripo V2.5 Image-to-3D
Tripo
Dernier modèle de Tripo pour convertir une image en maillage 3D — extrait géométrie, texture et matériaux à partir d'une photo ou illustration.
$0.5250/unit
image
Tripo V2.5 Multiview-to-3D
Tripo
Génération 3D la plus fidèle de Tripo — reconstruit des maillages détaillés à partir de multiples perspectives d'images pour une précision maximale.
$0.5250/unit
image
Tripo V2.5 Text-to-3D
Tripo
Dernier modèle de Tripo pour générer des maillages 3D à partir de texte — produit une géométrie détaillée avec matériaux PBR en secondes. Export GLB, FBX, OBJ, USD, STL.
$0.3500/unit
Tripo V3.0 Image-to-3D
Tripo
Tripo's stable v3.0 model for image-to-3D, reconstructs clean geometry, textures, and PBR materials from a single image, up to 2M polygons in Ultra mode.
$0.5250/unit
image
Tripo V3.0 Multiview-to-3D
Tripo
Tripo v3.0 multiview generation, reconstructs detailed meshes from up to 4 view images (front required) with stable, production-proven quality.
$0.5250/unit
image
Tripo V3.0 Text-to-3D
Tripo
Tripo's stable v3.0 model for text-to-3D, crisp edges and coherent structure with PBR materials, up to 2M polygons in Ultra mode. Exports GLB, FBX, OBJ, USD, STL.
$0.3500/unit
Tripo V3.1 Image-to-3D
Tripo
Tripo's flagship v3.1 model for image-to-3D, reconstructs high-fidelity geometry, textures, and PBR materials from a single image, up to 2M polygons in Ultra mode.
$0.5250/unit
image
Tripo V3.1 Image-to-3D (8K)
Tripo
Tripo's flagship v3.1 image-to-3D with 8K Ultra textures, reconstructs maximum-fidelity geometry and materials from a single image for hero assets.
$0.8750/unit
image
Tripo V3.1 Image-to-3D (Parts)
Tripo
Tripo v3.1 image-to-3D in part-segmentation mode, converts a single image into an untextured mesh split into separately editable parts.
$0.7000/unit
image
Tripo V3.1 Multiview-to-3D
Tripo
Tripo's highest-fidelity 3D generation, v3.1 reconstructs detailed meshes from up to 4 view images (front required) for maximum accuracy.
$0.5250/unit
image
Tripo V3.1 Multiview-to-3D (8K)
Tripo
Tripo's highest-fidelity pipeline, v3.1 multiview reconstruction with 8K Ultra textures from up to 4 view images (front required).
$0.8750/unit
image
Tripo V3.1 Multiview-to-3D (Parts)
Tripo
Tripo v3.1 multiview reconstruction in part-segmentation mode, builds an untextured segmented mesh from up to 4 view images (front required).
$0.7000/unit
image
Tripo V3.1 Text-to-3D
Tripo
Tripo's flagship v3.1 model for text-to-3D, sculpture-level geometry with crisp edges and PBR materials, up to 2M polygons in Ultra mode. Exports GLB, FBX, OBJ, USD, STL.
$0.3500/unit
Tripo V3.1 Text-to-3D (8K)
Tripo
Tripo's flagship v3.1 text-to-3D with 8K Ultra textures, maximum-fidelity materials and fine surface detail for hero assets and close-ups. Exports GLB, FBX, OBJ, USD, STL.
$0.7000/unit
Tripo V3.1 Text-to-3D (Parts)
Tripo
Tripo v3.1 text-to-3D in part-segmentation mode, generates an untextured mesh split into separately editable parts for editing, rigging prep, and 3D printing. Exports GLB, FBX, OBJ, USD, STL.
$0.5250/unit
TripoSplat Image-to-3D (Gaussian Splat)
Tripo
Turns a single image into a photorealistic 3D Gaussian Splat in under a minute. Ideal for AR/VR, web scenes and visualization — a view-ready format, not an editable or printable mesh. Exports SPLAT.
$0.5250/unit
image
Turbo v2.5
ElevenLabs
Génération vocale à faible latence dans 32 langues, optimisée pour l'IA conversationnelle en temps réel
In: $0.1925/1M
Uni 1
Luma AI
The most creative, intelligent and personalizable image generation models built on a new groundbreaking architecture that delivers ultra high quality and 10x higher cost efficiency.
$0.0707/unit
Uni 1 Max
Luma AI
The most creative, intelligent and personalizable image generation models built on a new groundbreaking architecture that delivers ultra high quality and 10x higher cost efficiency.
$0.1750/unit
Upscale 2x
Bria
Doublement de la résolution de l'image
$0.0350/unit
image
Upscale 4x
Bria
Quadruplement de la résolution de l'image
$0.0350/unit
image
Veo 3.1
Google
Dernier Veo avec capacité d'extension vidéo. Créez et prolongez des vidéos générées par IA avec une cohérence améliorée.
$0.7000/unit
imagevideo
Veo 3.1 Fast
Google
Variante rapide de Veo 3.1. Génération et extension vidéo rapides avec bonne qualité.
$0.1750/unit
imagevideo
Veo 3.1 Lite
Google
Cost-efficient Veo 3.1 tier — video with audio at a fraction of the price (720p/1080p, no 4K).
$0.0875/unit
image
Video to SFX 1.6
Mirelo
Generate and edit sound effects from video (SFX 1.6). Provide a video URL and optional text prompt; adds seamless extension, looping ambiences, and AI inpainting to erase/replace moments.
$0.0875/unit
video
🔊 Effets sonoresEn savoir plus →
Vidu 2 (Image to Video)
Z.ai
Image-to-video generation. 4-second 720p output.
$0.3500/unit
image
Vidu 2 (Reference to Video)
Z.ai
Reference-based video generation using multiple images for visual consistency. 4-second 720p output.
$0.7000/unit
image
Vidu 2 (Start-End Frame)
Z.ai
Start- and end-frame video generation. 5-second 720p output.
$0.3500/unit
image
Vidu Digital Human
Vidu
Créez un avatar parlant à partir d'une image ou vidéo avec voix générée par IA à partir de texte
$0.8750/unit
Vidu Lip Sync
Vidu
Synchronisation labiale vidéo avec un fichier audio pour un doublage réaliste et le remplacement de voix
$0.7000/unit
Vidu Q1
Z.ai
Texte-vers-vidéo haute qualité avec support du style anime. Sortie 1080p de 5 secondes.
$0.7000/unit
Vidu Q1 (Image to Video)
Z.ai
Image-to-video generation. 5-second 1080p output.
$0.7000/unit
image
Vidu Q1 (Start-End Frame)
Z.ai
Start- and end-frame video generation. 5-second 1080p output.
$0.7000/unit
image
Vidu Q1 Image (Reference)
Vidu
Générez des images à partir de 1 à 7 images de référence. Téléchargez des images de référence pour commencer.
$0.0700/unit
Vidu Q2 Image
Vidu
Générez des images à partir de texte ou d'images de référence. Prend en charge les résolutions 1080p, 2K et 4K.
$0.0525/unit
Vidu Q3 Pro
Vidu
$0.4025/unit
Vidu Q3 Turbo
Vidu
Ultra-fast video from text or image. Upload an image for image-to-video mode.
$0.3325/unit
Vidu Text to Speech
Vidu
Synthèse vocale naturelle avec vitesse, volume et hauteur ajustables.
In: $0.0350/1M
Voyage 4
Voyage AI
Modèle d'embedding polyvalent et équilibré de Voyage AI — bonne qualité à coût modéré. 200M de tokens gratuits.
In: $0.000105/1M
🔍 EmbeddingEn savoir plus →
Voyage 4 Large
Voyage AI
Modèle d'embedding polyvalent le plus performant de Voyage AI — meilleure qualité pour la recherche et la similarité sémantique. 200M de tokens gratuits.
In: $0.000210/1M
🔍 EmbeddingEn savoir plus →
Voyage 4 Lite
Voyage AI
Modèle d'embedding le plus rapide et économique de Voyage AI — idéal pour les cas à haut volume et faible latence. 200M de tokens gratuits.
In: $0.000035/1M
🔍 EmbeddingEn savoir plus →
Voyage Code 3
Voyage AI
Modèle d'embedding optimisé pour le code de Voyage AI — meilleur de sa catégorie pour la recherche et la similarité de code. 200M de tokens gratuits.
In: $0.000315/1M
🔍 EmbeddingEn savoir plus →
Voyage Context 3
Voyage AI
Modèle d'embedding long contexte de Voyage AI — optimisé pour les documents volumineux et le RAG avec fenêtres de contexte étendues. 200M de tokens gratuits.
In: $0.000315/1M
🔍 EmbeddingEn savoir plus →
Voyage Multimodal 3.5
Voyage AI
Modèle d'embedding multimodal de Voyage AI — intègre texte et images dans un espace vectoriel partagé pour la recherche cross-modale.
In: $0.000210/1M
image
🔍 EmbeddingEn savoir plus →
Wan 2.1 T2V 14B
Wan-AI
$0.1400/unit
Wan 2.2 Animate Mix
Alibaba Cloud
Alibaba Wan 2.2 Animate Mix, composite a character into a reference video (native DashScope, Singapore).
videoimagevideo
Wan 2.2 Animate Move
Alibaba Cloud
Alibaba Wan 2.2 Animate Move, animate a character image with a reference video's motion (native DashScope, Singapore).
videoimagevideo
Wan 2.2 T2V A14B
Wan-AI
$0.1400/unit
Wan 2.6 Edit
Alibaba Cloud
Alibaba Wan 2.6 image editing. Edits 1-4 input images from a natural-language instruction (native DashScope, US-Virginia).
$0.0525/unit
image
Wan 2.6 I2V
Alibaba Cloud
Alibaba Wan 2.6 image-to-video. Animates a still image into video while preserving subject, style and detail (native DashScope, US-Virginia).
videoimage
Wan 2.6 Image
Alibaba Cloud
Alibaba Wan 2.6 text-to-image. Photorealistic generation with accurate text rendering and flexible artistic styles (native DashScope, US-Virginia).
$0.0502/unit
Wan 2.6 R2V
Alibaba Cloud
Alibaba Wan 2.6 reference-to-video. Generates video preserving the look (and voice) of subjects from a reference video and/or reference images (native DashScope, US-Virginia).
videoimagevideo
Wan 2.6 T2V
Alibaba Cloud
Alibaba Wan 2.6 text-to-video. Cinematic motion generation from text with strong instruction following (native DashScope, US-Virginia).
video
Wan 2.7 I2V
Alibaba Cloud
Alibaba Wan 2.7 image-to-video. Animates a still image into video with first-frame fidelity, clips up to 15 seconds (native DashScope, US-Virginia).
videoimage
Wan 2.7 Image
Alibaba Cloud
nouveau
Alibaba Wan 2.7 text-to-image and editing. Served from Singapore — the US tenant returns AccessDenied.
$0.0481/unit
Wan 2.7 Image Pro
Alibaba Cloud
nouveau
Alibaba Wan 2.7 pro tier, up to 4K output for print and large-format work. Served from Singapore.
$0.1203/unit
Wan 2.7 T2V
Alibaba Cloud
Alibaba Wan 2.7 text-to-video. First and last frame control, clips up to 15 seconds, sharper motion and instruction following (native DashScope, US-Virginia).
video
ESC