DeepSeek V4 Flash
Fast DeepSeek V4 lane for economical reasoning, coding, and long-context work
Cheapest input
$0.0625
$/MTok · models.dev
Cheapest output
$0.125
$/MTok
Context
1.1M
tokens
Offers
17
2 sources
Offers
Same model, different listings. First-party, router, and aggregator rows stay separate so you can see the spread instead of a single blended number. Free/$0 listings are hidden by default (3 omitted). Show free/$0 offers.
| Source | Provider | Input | Output | Cache read | Context |
|---|---|---|---|---|---|
| models.devcheapestdeepseek-v4-flash | UnoRouter | $0.0625 | $0.125 | $0 | 1M |
| models.devdeepseek-v4-flash | LLM Gateway | $0.076 | $0.153 | $0.014 | 1.1M |
| models.devdeepseek-v4-flash | Modelis | $0.0983 | $0.1966 | $0 | 1M |
| models.devdeepseek-v4-flash | Neuralwatt | $0.104 | $0.207 | $0.026 | 1.0M |
| models.devdeepseek-v4-flash | Routing.Run | $0.112 | $0.224 | $0 | 1M |
| models.devdeepseek-v4-flash | CrofAI | $0.12 | $0.21 | $0.003 | 1M |
| models.devdeepseek-v4-flash | Cortecs | $0.133 | $0.266 | $0.0028 | 1.0M |
| models.devdeepseek-v4-flash | Venice AI | $0.138 | $0.275 | $0.028 | 1M |
| models.devdeepseek-v4-flash | Alibaba / Qwen | $0.14 | $0.28 | $0.0028 | 1M |
| models.devdeepseek-v4-flash | Auriko | $0.14 | $0.28 | $0.0028 | 1M |
| models.devdeepseek-v4-flash | EmpirioLabs AI | $0.14 | $0.28 | $0.14 | 1M |
| models.devdeepseek-v4-flash | OpenCode Go | $0.14 | $0.28 | $0.0028 | 1M |
| models.devdeepseek-v4-flash | OpenCode Zen | $0.14 | $0.28 | $0.028 | 1M |
| LiteLLMDeepSeek-V4-Flash | — | $0.14 | $0.28 | $0.0028 | — |
| models.devDeepSeek-V4-Flash | EBCloud | $0.143 | $0.2857 | $0 | 1M |
| models.devdeepseek-v4-flash | Azure | $0.19 | $0.51 | $0 | 1M |
| models.devdeepseek-v4-flash | Charm Hyper | $0.2 | $0.4 | $0.04 | 1M |
Capabilities
- Reasoning
- Tool calling
- Structured output
- Open weights
- In: text
- Out: text
Knowledge cutoff: 2025-05Released: 2026-04-24Family: deepseek-flash