Skip to main content
Back to models

Model comparison

Compare model identity and capabilities.

Selected

Qwen3 VL 32B Instruct

alibaba/qwen3-vl-32b-instruct

Alibaba / Qwen

View model

Qwen3-VL-32B-Instruct is a large-scale multimodal vision-language model designed for high-precision understanding and reasoning across text, images, and video. With 32 billion parameters, it combines deep visual perception with advanced text...

Released
2025-10-23
Context window
131K
Max output
33K
Weights
Open weight
Modalities
TextInputImageInputTextOutput
Capabilities
Tool callStructuredTemperatureOpen weight

Select at least two models to compare.

Compare models
1 models selected
Compare