| deepseek-v4-pro | deepseek-v4.1-flash | |
|---|---|---|
| Providers | DeepSeek | DeepSeek |
| Input $/M | $0.68 | $0.15 |
| Output $/M | $2.05 | $0.61 |
| Output multiplier | ×3.00 | ×4.00 |
| Context window | 1M tokens | — |
| Intelligence index | 42.1 | — |
| Coding index | 68.8 | — |
deepseek-v4.1-flash is roughly 4.5× cheaper on input than deepseek-v4-pro. If your workload passes the quality bar on the cheaper model, that gap compounds across every request; route to deepseek-v4-pro deliberately rather than by default.
Tags: deepseek-v4-pro — Chat, Reasoning, Coding · deepseek-v4.1-flash — Chat, Reasoning, Coding, Vision
from openai import OpenAI
client = OpenAI(base_url="https://starseaapi.com/v1", api_key="sk-...")
# deepseek-v4-pro
client.chat.completions.create(model="deepseek-v4-pro", messages=[{"role":"user","content":"Hi"}])
# deepseek-v4.1-flash
client.chat.completions.create(model="deepseek-v4.1-flash", messages=[{"role": "user", "content": "Hi"}])