DeepSeek V4.1 Flash (batch)
deepseek ↗ · 1049K ctx · 29 fournisseurs · mis à jour 2026-09-24 12:16 UTC
Le classement affiche l'offre mesurée la moins chère de ce modèle ($0.081/1M) ; le chiffre plus petit en dessous est la moyenne des 35 offres listées ci-dessous ($0.407/1M). Additionnez et divisez — cela correspond. Le volume de tokens 24h (2.8T) provient d'OpenRouter, aujourd'hui la seule source publique de volumes absolus par modèle (Vercel AI Gateway publie des parts de trafic en %). Recoupement — Vercel AI Gateway : 64.61% du volume de tokens du gateway, 6.35% des dépenses (2026-09-24 ; part de trafic, quotidien, données CC BY 4.0).
| Fournisseur | Router / Source | $ in /1M | $ out /1M | TTFT | TPS | Disponibilité | Preuve |
|---|---|---|---|---|---|---|---|
| Morph | OpenRouter ↗ | $0.046 | $0.186 | 1005ms | 2 | 100% | Mesuré via API |
| openrouter | Pricebook (LiteLLM) ↗ | $0.112 | $0.336 | — | — | — | Liste officielle |
| Relace | OpenRouter ↗ | $0.090 | $0.450 | 1455ms | 43 | 100.0% | Mesuré via API |
| OpenInference (fp4) | OpenRouter ↗ | $0.100 | $0.500 | 1505ms | 16 | 99.8% | Mesuré via API |
| DeepInfra (fp8) | OpenRouter ↗ | $0.140 | $0.420 | 1347ms | 4 | 100.0% | Mesuré via API |
| requesty | Requesty ↗ | $0.160 | $0.480 | — | — | — | Mesuré via API |
| DeepSeek | OpenRouter ↗ | $0.150 | $0.600 | 828ms | 80 | 100% | Mesuré via API |
| DekaLLM | OpenRouter ↗ | $0.040 | $1.00 | 1626ms | 20 | 99.0% | Mesuré via API |
| Sail Research (fp4) | OpenRouter ↗ | $0.130 | $0.750 | 3690ms | 26 | 99.7% | Mesuré via API |
| StreamLake (fp8) | OpenRouter ↗ | $0.165 | $0.660 | 1624ms | 84 | 99.8% | Mesuré via API |
| Wafer | OpenRouter ↗ | $0.200 | $0.600 | 988ms | 80 | 100.0% | Mesuré via API |
| deepinfra | HuggingFace Router ↗ | $0.200 | $0.600 | 205ms | 49 | — | Mesuré via API |
| wandb | Pricebook (LiteLLM) ↗ | $0.200 | $0.650 | — | — | — | Liste officielle |
| CoreWeave (fp8) | OpenRouter ↗ | $0.200 | $0.650 | 560ms | 128 | 99.8% | Mesuré via API |
| Fireworks | OpenRouter ↗ | $0.220 | $0.660 | 1165ms | 84 | 99.6% | Mesuré via API |
| Krea (fp8) | OpenRouter ↗ | $0.225 | $0.900 | 1069ms | 117 | 91.3% | Mesuré via API |
| GMICloud (fp8) | OpenRouter ↗ | $0.225 | $0.900 | 2340ms | 105 | 99.8% | Mesuré via API |
| Phala | OpenRouter ↗ | $0.276 | $1.10 | 1455ms | 66 | 99.7% | Mesuré via API |
| Novita (fp8) | OpenRouter ↗ | $0.285 | $1.14 | 1481ms | 105 | 100.0% | Mesuré via API |
| together_ai | Pricebook (LiteLLM) ↗ | $0.300 | $1.20 | — | — | — | Liste officielle |
| baseten | Pricebook (LiteLLM) ↗ | $0.300 | $1.20 | — | — | — | Liste officielle |
| novita | HuggingFace Router ↗ | $0.300 | $1.20 | 1365ms | 109 | — | Mesuré via API |
| baseten | HuggingFace Router ↗ | $0.300 | $1.20 | 4509ms | 56 | — | Mesuré via API |
| novita-ai | Novita AI ↗ | $0.300 | $1.20 | — | — | — | Mesuré via API |
| AtlasCloud (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 993ms | 120 | 99.7% | Mesuré via API |
| BaseTen (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 824ms | 50 | 99.8% | Mesuré via API |
| Makora (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 410ms | 111 | 99.9% | Mesuré via API |
| DigitalOcean | OpenRouter ↗ | $0.300 | $1.20 | 790ms | 50 | 99.4% | Mesuré via API |
| Alibaba | OpenRouter ↗ | $0.300 | $1.20 | 1107ms | 93 | 100.0% | Mesuré via API |
| Together | OpenRouter ↗ | $0.300 | $1.20 | 447ms | 161 | 99.9% | Mesuré via API |
| SiliconFlow (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 2105ms | 76 | 99.9% | Mesuré via API |
| Modal | OpenRouter ↗ | $0.300 | $1.20 | 889ms | 132 | 100.0% | Mesuré via API |
| Parasail (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 1902ms | 85 | 96.8% | Mesuré via API |
| Venice (fp8) | OpenRouter ↗ | $0.375 | $1.50 | 1418ms | 98 | 99.7% | Mesuré via API |
| 0g-teetls | 0G Router ↗ | $0.417 | $1.67 | — | — | — | Mesuré via API |
Tendance du volume
14 derniers jours : 679B → 2.8T (+314%) ; plage 679B–3.1T tokens/jour. Source : OpenRouter ; horaire.
Données et méthode
Le moins cher est classé selon le prix mixte = (3×in + out) ÷ 4 ; les colonnes de performance ne s'affichent que lorsqu'une source les fournit, jamais estimées. “Liste officielle” = grille tarifaire ouverte LiteLLM (MIT) ; “Mesuré via API” = API publiques des fournisseurs/agrégateurs. Données exploitables par machine : /api/v1/models/deepseek-v4.1-flash.json. Réutilisation gratuite sous réserve d'attribution à tkx.org.
FAQ
Combien coûte DeepSeek V4.1 Flash (batch) ?
Offre mesurée la moins chère : $0.0465/1M en entrée, $0.186/1M en sortie via Morph — parmi 29 fournisseurs suivis, rafraîchi chaque heure.
Qui sert DeepSeek V4.1 Flash (batch) ?
29 fournisseurs le servent actuellement. Le tableau ci-dessus liste prix, TTFT, TPS, disponibilité et niveau de preuve de chacun.
À quel point DeepSeek V4.1 Flash (batch) est-il utilisé ?
DeepSeek V4.1 Flash (batch) a routé 2.8T tokens ces dernières 24h. Les barres quotidiennes montrent le volume récent. Source : classements publics OpenRouter, l'un des rares routeurs publiant l'usage par modèle ; TKX s'actualise chaque heure.