模型信息
发布日期
2026-04-24
上下文窗口
1M
最大输出
384K
模型参数量
291B
权重
开放
模态
输入
文本
输出
文本
模型身份
- 版本
- deepseek-v4-flash
- 知识截止
- 2025-05
- 许可证
- MIT
- 别名
- DeepSeek V4 Flash
提供商
| 提供商 | 提供商模型 ID | 协议 | 上下文 | 最大输出 | 输入 | 输出 | 能力 | 备注 | 价格 | 流式输出 |
|---|---|---|---|---|---|---|---|---|---|---|
| AnyAPI | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | - | 是 | ||
| CrossModel | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.16/M · 输出 $0.32/M 缓存读取 $0.004/M · 缓存写入 $0.16/M | 是 | ||
| OpenCode Go | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.003/M | 是 | ||
| NanoGPT | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.07/M · 输出 $0.14/M 缓存读取 $0.014/M | 是 | ||
| CrofAI | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.12/M · 输出 $0.21/M 缓存读取 $0.003/M | 是 | ||
| LLM Gateway | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.076/M · 输出 $0.153/M 缓存读取 $0.014/M | 是 | ||
| Kenari | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0/M · 输出 $0/M | 是 | ||
| Kenari | deepseek-v4-flash:free | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0/M · 输出 $0/M | 是 | ||
| OpenCode Zen | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.028/M | 是 | ||
| Ambient | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.028/M · 缓存写入 $0/M | 是 | ||
| UnoRouter | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.063/M · 输出 $0.125/M | 是 | ||
| UnoRouter | deepseek-v4-flash:free | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0/M · 输出 $0/M | 是 | ||
| ZenMux | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.003/M | 是 | ||
| EmpirioLabs AI | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.14/M | 是 | ||
| Alibaba Token Plan | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0/M · 输出 $0/M 缓存读取 $0/M · 缓存写入 $0/M | 是 | ||
| Venice AI | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.138/M · 输出 $0.275/M 缓存读取 $0.028/M | 是 | ||
| Auriko | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.003/M | 是 | ||
| Azure | deepseek-v4-flash | openai_responses | 1M | 384K | 推理结构化输出温度参数 | - | 输入 $0.19/M · 输出 $0.51/M | 是 | ||
| Neuralwatt | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.104/M · 输出 $0.207/M 缓存读取 $0.026/M | 是 | ||
| OrcaRouter | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.19/M · 输出 $0.37/M 缓存读取 $0.003/M | 是 | ||
| routing.run | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.112/M · 输出 $0.224/M | 是 | ||
| DeepSeek | deepseek-v4-flash | custom | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.003/M | 是 | ||
| TensorX | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.15/M · 输出 $0.3/M 缓存读取 $0.038/M · 缓存写入 $0.188/M | 是 | ||
| Kilo Gateway | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.028/M | 是 | ||
| Merge Gateway | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.003/M | 是 | ||
| Modelis | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.098/M · 输出 $0.197/M | 是 | ||
| Charm Hyper | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.2/M · 输出 $0.4/M 缓存读取 $0.04/M | 是 | ||
| Vercel AI Gateway | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.2/M · 输出 $0.4/M 缓存读取 $0.04/M | 是 | ||
| Alibaba (China) | deepseek-v4-flash | custom | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.003/M | 是 | ||
| NovitaAI | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.028/M | 是 | ||
| OpenRouter | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | 可选思考强度: xhigh, high, 默认推理强度: high, Hugging Face: deepseek-ai/DeepSeek-V4-Flash | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.028/M | 是 | ||
| Alibaba Token Plan (China) | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0/M · 输出 $0/M 缓存读取 $0/M · 缓存写入 $0/M | 是 | ||
| Ollama Cloud | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用 | - | - | 是 | ||
| Cortecs | deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用温度参数 | - | 输入 $0.133/M · 输出 $0.266/M 缓存读取 $0.003/M | 是 | ||
| HPC-AI | deepseek/deepseek-v4-flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.14/M · 输出 $0.28/M 缓存读取 $0.028/M | 是 | ||
| EBCloud | DeepSeek-V4-Flash | openai_chat | 1M | 384K | 推理工具调用结构化输出温度参数 | - | 输入 $0.143/M · 输出 $0.286/M | 是 |