Skip to main content
Alibaba/ Qwen

Qwen3 VL 32B Instruct

alibaba/qwen/qwen3-vl-32b-instruct

Qwen3-VL-32B-Instruct is a large-scale multimodal vision-language model designed for high-precision understanding and reasoning across text, images, and video. With 32 billion parameters, it combines deep visual perception with advanced text...

Released
2025-10-23
Context window
131K
Max output
33K
Weights
Open weight

Modalities

Input
TextImage
Output
Text

Identity

Version
qwen3-vl-32b-instruct

Resources

Providers

ProviderProvider model IDProtocolContextMax outputInputOutputCapabilitiesNotesPricingStreaming
OpenRouterqwen/qwen3-vl-32b-instructopenai_chat131K33K
TextImage
Text
Tool callStructuredTemperatureOpen weight
Hugging Face: Qwen/Qwen3-VL-32B-Instruct
input $0.104/M
output $0.416/M
Yes
Kilo Gatewayqwen/qwen3-vl-32b-instructopenai_chat131K33K
TextImage
Text
Tool callStructuredTemperatureOpen weight
-
input $0.104/M
output $0.416/M
Yes

Capabilities

Tool callStructuredTemperatureOpen weight

FAQ