Skip to main content
ALAlibaba/ Qwen

Qwen3 VL 8B Instruct

alibaba/qwen3-vl-8b-instruct

Qwen3-VL-8B-Instruct is a multimodal vision-language model from the Qwen3-VL series, built for high-fidelity understanding and reasoning across text, images, and video. It features improved multimodal fusion with Interleaved-MRoPE for long-horizon...

Model information

Released
2025-10-14
Context window
262K
Max output
33K
Model parameters
8.8B
Weights
Open

Modalities

Input
ImageText
Output
Text

Identity

Version
qwen3-vl-8b-instruct
License
Apache-2.0

Resources

Capabilities

Open weightStructuredTemperatureTool call

Providers

ProviderProvider model IDProtocolContextMax outputInputOutputCapabilitiesNotesPricingStreaming
OpenRouterqwen/qwen3-vl-8b-instructopenai_chat262K33K
AttachmentsTool callStructuredTemperature
Hugging Face: Qwen/Qwen3-VL-8B-Instruct
input $0.117/M · output $0.455/M
Yes
Kilo Gatewayqwen/qwen3-vl-8b-instructopenai_chat262K33K
AttachmentsTool callStructuredTemperature
-
input $0.117/M · output $0.455/M
Yes
NovitaAIqwen/qwen3-vl-8b-instructopenai_chat262K33K
AttachmentsTool callStructuredTemperature
-
input $0.08/M · output $0.5/M
Yes
Alibabaqwen3-vl-8b-instructcustom262K33K
---Yes

FAQ