Le classement affiche l'offre mesurée la moins chère de ce modèle ($0.152/1M) ; le chiffre plus petit en dessous est la moyenne des 26 offres listées ci-dessous ($0.322/1M). Additionnez et divisez — cela correspond. Le volume de tokens 24h (56B) provient d'OpenRouter, aujourd'hui la seule source publique de volumes absolus par modèle (Vercel AI Gateway publie des parts de trafic en %).
| Fournisseur | Router / Source | $ in /1M | $ out /1M | TTFT | TPS | Disponibilité | Preuve |
|---|---|---|---|---|---|---|---|
| DeepInfra (turbo) | OpenRouter | $0.090 | $0.340 | 763ms | 20 | 100.0% | Mesuré via API |
| CoreWeave (bf16) | OpenRouter | $0.100 | $0.340 | 1120ms | 34 | 96.3% | Mesuré via API |
| OpenInference (bf16) | OpenRouter | $0.100 | $0.350 | 913ms | 42 | 99.7% | Mesuré via API |
| Venice (bf16) | OpenRouter | $0.120 | $0.360 | 903ms | 45 | 99.6% | Mesuré via API |
| Chutes (fp4) | OpenRouter | $0.120 | $0.370 | 2010ms | 17 | 98.4% | Mesuré via API |
| deepinfra | HuggingFace Router | $0.130 | $0.380 | 420ms | 70 | — | Mesuré via API |
| requesty | Requesty | $0.130 | $0.380 | — | — | — | Mesuré via API |
| DeepInfra (fp8) | OpenRouter | $0.130 | $0.380 | 711ms | 35 | 95.8% | Mesuré via API |
| SiliconFlow (fp8) | OpenRouter | $0.130 | $0.400 | 1696ms | 31 | 99.7% | Mesuré via API |
| novita | HuggingFace Router | $0.140 | $0.400 | 900ms | 42 | — | Mesuré via API |
| novita-ai | Novita AI | $0.140 | $0.400 | — | — | — | Mesuré via API |
| Novita (bf16) | OpenRouter | $0.140 | $0.400 | 1068ms | 21 | 99.0% | Mesuré via API |
| Friendli | OpenRouter | $0.140 | $0.400 | 1402ms | 102 | 99.8% | Mesuré via API |
| Morph (fp4) | OpenRouter | $0.140 | $0.400 | 1279ms | 16 | 99.3% | Mesuré via API |
| Crusoe | OpenRouter | $0.140 | $0.400 | 577ms | 32 | 99.6% | Mesuré via API |
| libertai | Pricebook (LiteLLM) | $0.150 | $0.400 | — | — | — | Liste officielle |
| Parasail (fp8) | OpenRouter | $0.150 | $0.400 | 996ms | 34 | 99.4% | Mesuré via API |
| Phala | OpenRouter | $0.150 | $0.460 | 1156ms | 16 | 99.8% | Mesuré via API |
| tensormesh | Pricebook (LiteLLM) | $0.140 | $0.560 | — | — | — | Liste officielle |
| ModelRun (fp4) | OpenRouter | $0.220 | $0.550 | 107ms | 61 | 100.0% | Mesuré via API |
| Together | OpenRouter | $0.280 | $0.860 | 295ms | 42 | 97.4% | Mesuré via API |
| together | HuggingFace Router | $0.390 | $0.970 | 234ms | 57 | — | Mesuré via API |
| sambanova | Pricebook (LiteLLM) | $0.380 | $1.15 | — | — | — | Liste officielle |
| SambaNova | OpenRouter | $0.380 | $1.15 | 2867ms | 114 | 99.7% | Mesuré via API |
| cerebras | HuggingFace Router | $0.990 | $1.49 | 194ms | 668 | — | Mesuré via API |
| Cerebras (fp16) | OpenRouter | $0.990 | $1.49 | 457ms | 184 | 100% | Mesuré via API |
Tendance du volume
30 derniers jours : 53B → 56B (+7%) ; plage 41B–68B tokens/jour. Source : OpenRouter ; horaire.
Données et méthode
Le moins cher est classé selon le prix mixte = (3×in + out) ÷ 4 ; les colonnes de performance ne s'affichent que lorsqu'une source les fournit, jamais estimées. “Liste officielle” = grille tarifaire ouverte LiteLLM (MIT) ; “Mesuré via API” = API publiques des fournisseurs/agrégateurs. Données exploitables par machine : /api/v1/models/gemma-4-31b-it.json. Réutilisation gratuite sous réserve d'attribution à tkx.org.
À propos
Gemma 4 31B is an AI model served by multiple inference providers on AI model marketplaces, known for its language understanding capabilities.
Résumé généré par IA à partir d'informations publiques — c'est le vôtre ?
FAQ
Combien coûte Gemma 4 31B (free) ?
Offre mesurée la moins chère : $0.09/1M en entrée, $0.34/1M en sortie via DeepInfra (turbo) — parmi 19 fournisseurs suivis, rafraîchi chaque heure.
Qui sert Gemma 4 31B (free) ?
19 fournisseurs le servent actuellement. Le tableau ci-dessus liste prix, TTFT, TPS, disponibilité et niveau de preuve de chacun.
À quel point Gemma 4 31B (free) est-il utilisé ?
Gemma 4 31B (free) a routé 56B tokens ces dernières 24h. Les barres quotidiennes montrent le volume récent. Source : classements publics OpenRouter, l'un des rares routeurs publiant l'usage par modèle ; TKX s'actualise chaque heure.