Qwen3 VL Plus

Alibaba Cloud ๐Ÿง  Language Model

Advanced vision-language model with 262K context. Excels at visual coding, spatial perception, and multimodal reasoning.

Specifications

ModalitiesInput: text, image  ยท  Output: text
Context window262K tokens
Max output8K tokens
Speedโ—โ—โ—โ—‹โ—‹ Average
FeaturesTools: Yes Streaming: Yes Vision: Yes
Capabilitiestools, reasoning

Pricing

$0.2502 / 1M input tokens  ยท  $2.51 / 1M output tokens

Platform credit pricing โ€” live rates on the Models page.

Use Qwen3 VL Plus on Zubnet →