DeepSeek V4.1 Flash (batch)
deepseek ↗ · 1049K ctx · 29 proveedores · actualizado 2026-09-24 12:16 UTC
El tablero muestra la oferta medida más barata de este modelo ($0.081/1M); la cifra menor debajo es la media de las 35 ofertas listadas abajo ($0.407/1M). Súmalas y divide — coincide. El volumen de tokens 24h (2.8T) proviene de OpenRouter, hoy la única fuente pública de recuentos absolutos por modelo (Vercel AI Gateway publica porcentajes de cuota). Verificación cruzada — Vercel AI Gateway: 64.61% del volumen de tokens del gateway, 6.35% del gasto (2026-09-24; cuota de tráfico, diaria, datos CC BY 4.0).
| Proveedor | Router / Fuente | $ in /1M | $ out /1M | TTFT | TPS | Disponibilidad | Evidencia |
|---|---|---|---|---|---|---|---|
| Morph | OpenRouter ↗ | $0.046 | $0.186 | 1005ms | 2 | 100% | Medido por API |
| openrouter | Pricebook (LiteLLM) ↗ | $0.112 | $0.336 | — | — | — | Lista oficial |
| Relace | OpenRouter ↗ | $0.090 | $0.450 | 1455ms | 43 | 100.0% | Medido por API |
| OpenInference (fp4) | OpenRouter ↗ | $0.100 | $0.500 | 1505ms | 16 | 99.8% | Medido por API |
| DeepInfra (fp8) | OpenRouter ↗ | $0.140 | $0.420 | 1347ms | 4 | 100.0% | Medido por API |
| requesty | Requesty ↗ | $0.160 | $0.480 | — | — | — | Medido por API |
| DeepSeek | OpenRouter ↗ | $0.150 | $0.600 | 828ms | 80 | 100% | Medido por API |
| DekaLLM | OpenRouter ↗ | $0.040 | $1.00 | 1626ms | 20 | 99.0% | Medido por API |
| Sail Research (fp4) | OpenRouter ↗ | $0.130 | $0.750 | 3690ms | 26 | 99.7% | Medido por API |
| StreamLake (fp8) | OpenRouter ↗ | $0.165 | $0.660 | 1624ms | 84 | 99.8% | Medido por API |
| Wafer | OpenRouter ↗ | $0.200 | $0.600 | 988ms | 80 | 100.0% | Medido por API |
| deepinfra | HuggingFace Router ↗ | $0.200 | $0.600 | 205ms | 49 | — | Medido por API |
| wandb | Pricebook (LiteLLM) ↗ | $0.200 | $0.650 | — | — | — | Lista oficial |
| CoreWeave (fp8) | OpenRouter ↗ | $0.200 | $0.650 | 560ms | 128 | 99.8% | Medido por API |
| Fireworks | OpenRouter ↗ | $0.220 | $0.660 | 1165ms | 84 | 99.6% | Medido por API |
| Krea (fp8) | OpenRouter ↗ | $0.225 | $0.900 | 1069ms | 117 | 91.3% | Medido por API |
| GMICloud (fp8) | OpenRouter ↗ | $0.225 | $0.900 | 2340ms | 105 | 99.8% | Medido por API |
| Phala | OpenRouter ↗ | $0.276 | $1.10 | 1455ms | 66 | 99.7% | Medido por API |
| Novita (fp8) | OpenRouter ↗ | $0.285 | $1.14 | 1481ms | 105 | 100.0% | Medido por API |
| together_ai | Pricebook (LiteLLM) ↗ | $0.300 | $1.20 | — | — | — | Lista oficial |
| baseten | Pricebook (LiteLLM) ↗ | $0.300 | $1.20 | — | — | — | Lista oficial |
| novita | HuggingFace Router ↗ | $0.300 | $1.20 | 1365ms | 109 | — | Medido por API |
| baseten | HuggingFace Router ↗ | $0.300 | $1.20 | 4509ms | 56 | — | Medido por API |
| novita-ai | Novita AI ↗ | $0.300 | $1.20 | — | — | — | Medido por API |
| AtlasCloud (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 993ms | 120 | 99.7% | Medido por API |
| BaseTen (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 824ms | 50 | 99.8% | Medido por API |
| Makora (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 410ms | 111 | 99.9% | Medido por API |
| DigitalOcean | OpenRouter ↗ | $0.300 | $1.20 | 790ms | 50 | 99.4% | Medido por API |
| Alibaba | OpenRouter ↗ | $0.300 | $1.20 | 1107ms | 93 | 100.0% | Medido por API |
| Together | OpenRouter ↗ | $0.300 | $1.20 | 447ms | 161 | 99.9% | Medido por API |
| SiliconFlow (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 2105ms | 76 | 99.9% | Medido por API |
| Modal | OpenRouter ↗ | $0.300 | $1.20 | 889ms | 132 | 100.0% | Medido por API |
| Parasail (fp8) | OpenRouter ↗ | $0.300 | $1.20 | 1902ms | 85 | 96.8% | Medido por API |
| Venice (fp8) | OpenRouter ↗ | $0.375 | $1.50 | 1418ms | 98 | 99.7% | Medido por API |
| 0g-teetls | 0G Router ↗ | $0.417 | $1.67 | — | — | — | Medido por API |
Tendencia de volumen
Últimos 14 días: 679B → 2.8T (+314%); rango 679B–3.1T tokens/día. Fuente: OpenRouter; actualización horaria.
Datos y método
El más barato se clasifica por precio combinado = (3×in + out) ÷ 4; las columnas de rendimiento solo se muestran cuando una fuente las proporciona, nunca se estiman. “Lista oficial” = catálogo de precios abierto de LiteLLM (MIT); “Medido por API” = APIs públicas de proveedores/agregadores. Datos legibles por máquina: /api/v1/models/deepseek-v4.1-flash.json. La reutilización gratuita requiere atribución a tkx.org.
Preguntas frecuentes
¿Cuánto cuesta DeepSeek V4.1 Flash (batch)?
Oferta medida mas barata ahora: $0.0465/1M de entrada, $0.186/1M de salida via Morph — entre 29 proveedores, actualizado cada hora.
¿Quién sirve DeepSeek V4.1 Flash (batch)?
Actualmente lo sirven 29 proveedores. La tabla superior lista precio, TTFT, TPS, disponibilidad y nivel de evidencia de cada uno.
¿Cuánto se usa DeepSeek V4.1 Flash (batch)?
DeepSeek V4.1 Flash (batch) enrutó 2.8T tokens en las últimas 24h. Las barras diarias muestran el volumen reciente. Fuente: rankings públicos de OpenRouter, uno de los pocos routers que publica uso por modelo; TKX se actualiza cada hora.