Skip to main content
ALAlibaba/ Qwen

Qwen Flash

alibaba/qwen-flash

Efficient Qwen model for fast chat, extraction, and high-volume workloads

Model information

Released
2025-07-28
Context window
1M
Max output
33K
Weights
Closed

Modalities

Input
Text
Output
Text

Identity

Version
qwen-flash
Knowledge cutoff
2024-04
Aliases
Qwen Flash

Capabilities

ReasoningTemperatureTool call

Official price

input $0.05/M · output $0.4/M

Providers

ProviderProvider model IDProtocolContextMax outputInputOutputCapabilitiesNotesPricingStreaming
LLM Gatewayqwen-flashopenai_chat1M33K
ReasoningTool callTemperature
-
input $0.05/M · output $0.4/M
cache read $0.01/M · cache write $0.063/M
Yes
302.AIqwen-flashopenai_chat1M33K
Tool callTemperature
-
input $0.022/M · output $0.22/M
Yes
Alibabaqwen-flashcustom1M33K
ReasoningTool callTemperature
-
input $0.05/M · output $0.4/M
Yes
Alibaba (China)qwen-flashcustom1M33K
ReasoningTool callTemperature
-
input $0.022/M · output $0.216/M
Yes

FAQ