Skip to main content
Alibaba/ Qwen

Qwen3 VL 8B Instruct

alibaba/qwen/qwen3-vl-8b-instruct

Qwen3-VL-8B-Instruct is a multimodal vision-language model from the Qwen3-VL series, built for high-fidelity understanding and reasoning across text, images, and video. It features improved multimodal fusion with Interleaved-MRoPE for long-horizon...

Released
2025-10-14
Context window
262K
Max output
33K
Weights
Open weight

Modalities

Input
ImageText
Output
Text

Identity

Version
qwen3-vl-8b-instruct

Resources

Providers

ProviderProvider model IDProtocolContextMax outputInputOutputCapabilitiesNotesPricingStreaming
OpenRouterqwen/qwen3-vl-8b-instructopenai_chat262K33K
ImageText
Text
Tool callStructuredTemperatureOpen weight
Hugging Face: Qwen/Qwen3-VL-8B-Instruct
input $0.117/M
output $0.455/M
Yes
Kilo Gatewayqwen/qwen3-vl-8b-instructopenai_chat262K33K
ImageText
Text
Tool callStructuredTemperatureOpen weight
-
input $0.117/M
output $0.455/M
Yes
NovitaAIqwen/qwen3-vl-8b-instructopenai_chat262K33K
ImageText
Text
Tool callStructuredTemperatureOpen weight
-
input $0.08/M
output $0.5/M
Yes

Capabilities

Tool callStructuredTemperatureOpen weight

FAQ