发布日期
2026-04-24
上下文窗口
1M
最大输出
384K
权重
开放权重
模态
输入
文本
输出
文本
模型身份
- 版本
- deepseek-v4-flash
- 知识截止
- 2025-05
- 别名
- DeepSeek V4 Flash
资源
提供商
| 提供商 | 提供商模型 ID | 协议 | 上下文 | 最大输出 | 输入 | 输出 | 能力 | 备注 | 价格 | 流式输出 |
|---|---|---|---|---|---|---|---|---|---|---|
| AnyAPI | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | - | 是 |
| CrossModel | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.16/M · 缓存读取 $0.004/M 输出 $0.32/M · 缓存写入 $0.16/M | 是 |
| OpenCode Go | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.0028/M 输出 $0.28/M | 是 |
| NanoGPT | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.07/M · 缓存读取 $0.014/M 输出 $0.14/M | 是 |
| CrofAI | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.12/M · 缓存读取 $0.003/M 输出 $0.21/M | 是 |
| LLM Gateway | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.076/M · 缓存读取 $0.014/M 输出 $0.153/M | 是 |
| Kenari | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0/M 输出 $0/M | 是 |
| Kenari | deepseek-v4-flash:free | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0/M 输出 $0/M | 是 |
| OpenCode Zen | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.028/M 输出 $0.28/M | 是 |
| Ambient | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.14/M · 缓存读取 $0.028/M 输出 $0.28/M · 缓存写入 $0/M | 是 |
| UnoRouter | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.0625/M 输出 $0.125/M | 是 |
| UnoRouter | deepseek-v4-flash:free | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0/M 输出 $0/M | 是 |
| ZenMux | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.0028/M 输出 $0.28/M | 是 |
| EmpirioLabs AI | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.14/M · 缓存读取 $0.14/M 输出 $0.28/M | 是 |
| Alibaba Token Plan | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0/M · 缓存读取 $0/M 输出 $0/M · 缓存写入 $0/M | 是 |
| Venice AI | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.138/M · 缓存读取 $0.028/M 输出 $0.275/M | 是 |
| Auriko | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.0028/M 输出 $0.28/M | 是 |
| Azure | deepseek-v4-flash | openai_responses | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.19/M 输出 $0.51/M | 是 |
| Neuralwatt | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.104/M · 缓存读取 $0.026/M 输出 $0.207/M | 是 |
| OrcaRouter | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.19/M · 缓存读取 $0.0028/M 输出 $0.37/M | 是 |
| routing.run | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.112/M 输出 $0.224/M | 是 |
| DeepSeek | deepseek-v4-flash | custom | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.0028/M 输出 $0.28/M | 是 |
| TensorX | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.15/M · 缓存读取 $0.0375/M 输出 $0.3/M · 缓存写入 $0.1875/M | 是 |
| Kilo Gateway | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.14/M · 缓存读取 $0.028/M 输出 $0.28/M | 是 |
| Merge Gateway | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.0028/M 输出 $0.28/M | 是 |
| Modelis | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.0983/M 输出 $0.1966/M | 是 |
| Charm Hyper | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.2/M · 缓存读取 $0.04/M 输出 $0.4/M | 是 |
| Vercel AI Gateway | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | 输入 $0.2/M · 缓存读取 $0.04/M 输出 $0.4/M | 是 |
| Alibaba (China) | deepseek-v4-flash | custom | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.0028/M 输出 $0.28/M | 是 |
| NovitaAI | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.028/M 输出 $0.28/M | 是 |
| OpenRouter | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出, 默认推理强度: high, Hugging Face: deepseek-ai/DeepSeek-V4-Flash | 输入 $0.14/M · 缓存读取 $0.028/M 输出 $0.28/M | 是 |
| Alibaba Token Plan (China) | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0/M · 缓存读取 $0/M 输出 $0/M · 缓存写入 $0/M | 是 |
| Ollama Cloud | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | - | - | 是 |
| Cortecs | deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.133/M · 缓存读取 $0.0028/M 输出 $0.266/M | 是 |
| HPC-AI | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.14/M · 缓存读取 $0.028/M 输出 $0.28/M | 是 |
| EBCloud | DeepSeek-V4-Flash | openai_chat | 1M | 384K | 文本 | 文本 | 推理工具调用结构化输出温度参数开放权重 | 交错输出 | 输入 $0.143/M 输出 $0.2857/M | 是 |
能力
推理工具调用结构化输出温度参数开放权重
官方价格
输入 $0.14/M · 缓存读取 $0.0028/M
输出 $0.28/M