Le classement affiche l'offre mesurée la moins chère de ce modèle ($0.065/1M) ; le chiffre plus petit en dessous est la moyenne des 48 offres listées ci-dessous ($0.253/1M). Additionnez et divisez — cela correspond. Le volume de tokens 24h (81B) provient d'OpenRouter, aujourd'hui la seule source publique de volumes absolus par modèle (Vercel AI Gateway publie des parts de trafic en %).
| Fournisseur | Router / Source | $ in /1M | $ out /1M | TTFT | TPS | Disponibilité | Preuve |
|---|---|---|---|---|---|---|---|
| CoreWeave (fp4) | OpenRouter | $0.030 | $0.170 | 407ms | 36 | 99.7% | Mesuré via API |
| deepinfra | HuggingFace Router | $0.037 | $0.170 | 1784ms | 40 | — | Mesuré via API |
| DeepInfra (bf16) | OpenRouter | $0.037 | $0.170 | 519ms | 38 | 99.8% | Mesuré via API |
| novita | Pricebook (LiteLLM) | $0.050 | $0.250 | — | — | — | Liste officielle |
| novita | HuggingFace Router | $0.050 | $0.250 | 458ms | 66 | — | Mesuré via API |
| novita-ai | Novita AI | $0.050 | $0.250 | — | — | — | Mesuré via API |
| Novita (fp4) | OpenRouter | $0.050 | $0.250 | 500ms | 88 | 100% | Mesuré via API |
| deepinfra | Pricebook (LiteLLM) | $0.050 | $0.450 | — | — | — | Liste officielle |
| SiliconFlow (fp8) | OpenRouter | $0.050 | $0.450 | 1243ms | 19 | 100% | Mesuré via API |
| Google (global) | OpenRouter | $0.090 | $0.360 | 310ms | 173 | 99.9% | Mesuré via API |
| ovhcloud | Pricebook (LiteLLM) | $0.080 | $0.400 | — | — | — | Liste officielle |
| DigitalOcean | OpenRouter | $0.070 | $0.490 | 502ms | 38 | 100% | Mesuré via API |
| nscale | HuggingFace Router | $0.100 | $0.400 | 462ms | 107 | — | Mesuré via API |
| ovhcloud | HuggingFace Router | $0.090 | $0.470 | 502ms | 147 | — | Mesuré via API |
| baseten | Pricebook (LiteLLM) | $0.100 | $0.500 | — | — | — | Liste officielle |
| baseten | HuggingFace Router | $0.100 | $0.500 | 262ms | 95 | — | Mesuré via API |
| BaseTen (fp4) | OpenRouter | $0.100 | $0.500 | 320ms | 151 | 100% | Mesuré via API |
| Mancer 2 (fp8) | OpenRouter | $0.100 | $0.500 | 925ms | 58 | 99.6% | Mesuré via API |
| azure_ai | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Liste officielle |
| fireworks_ai | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Liste officielle |
| groq | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Liste officielle |
| together_ai | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Liste officielle |
| watsonx | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Liste officielle |
| scaleway | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Liste officielle |
| tensormesh | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Liste officielle |
| together | HuggingFace Router | $0.150 | $0.600 | 251ms | 111 | — | Mesuré via API |
| fireworks-ai | HuggingFace Router | $0.150 | $0.600 | 1652ms | 72 | — | Mesuré via API |
| requesty | Requesty | $0.150 | $0.600 | — | — | — | Mesuré via API |
| Amazon Bedrock | OpenRouter | $0.150 | $0.600 | 495ms | 147 | 99.9% | Mesuré via API |
| DeepInfra (turbo) | OpenRouter | $0.150 | $0.600 | 507ms | 127 | 100% | Mesuré via API |
| Together | OpenRouter | $0.150 | $0.600 | 320ms | 64 | 100% | Mesuré via API |
| Nebius (fp4) | OpenRouter | $0.150 | $0.600 | 325ms | 149 | 98.6% | Mesuré via API |
| Amazon Bedrock (eu-west-1) | OpenRouter | $0.150 | $0.600 | — | — | — | Mesuré via API |
| Phala | OpenRouter | $0.150 | $0.600 | 582ms | 92 | 100% | Mesuré via API |
| Groq | OpenRouter | $0.150 | $0.600 | 227ms | 318 | 100.0% | Mesuré via API |
| Parasail (fp4) | OpenRouter | $0.100 | $0.750 | 370ms | 98 | 89.5% | Mesuré via API |
| groq | HuggingFace Router | $0.150 | $0.750 | 270ms | 423 | — | Mesuré via API |
| Mara | OpenRouter | $0.150 | $0.750 | — | — | 96.3% | Mesuré via API |
| sambanova | Pricebook (LiteLLM) | $0.220 | $0.590 | — | — | — | Liste officielle |
| replicate | Pricebook (LiteLLM) | $0.180 | $0.720 | — | — | — | Liste officielle |
Qui consomme ce modèle
Applications ayant le plus routé de trafic vers ce modèle sur les 30 derniers jours, d'après les statistiques publiques d'OpenRouter. Seules les apps ayant activé le suivi apparaissent, et seules les premières sont publiées — ce n'est pas la demande complète. Fenêtre de 30 jours, NON comparable aux totaux cumulés du classement Apps.
| App | Tokens (30j) | Requêtes |
|---|---|---|
| Mira is the leading AI agent inside Telegram | 110B | 15M |
| cvi-magic-tasks-ai-tagging | 25B | 6M |
| Craft | 22B | 6M |
| OpenClaw | 20B | 760K |
| Hermes Agent | 11B | 395K |
Tendance du volume
30 derniers jours : 66B → 81B (+24%) ; plage 57B–94B tokens/jour. Source : OpenRouter ; horaire.
Données et méthode
Le moins cher est classé selon le prix mixte = (3×in + out) ÷ 4 ; les colonnes de performance ne s'affichent que lorsqu'une source les fournit, jamais estimées. “Liste officielle” = grille tarifaire ouverte LiteLLM (MIT) ; “Mesuré via API” = API publiques des fournisseurs/agrégateurs. Données exploitables par machine : /api/v1/models/gpt-oss-120b.json. Réutilisation gratuite sous réserve d'attribution à tkx.org.
À propos
GPT-OSS-120b is a large language model served by multiple inference providers on AI model marketplaces, known for its capabilities in natural language processing tasks.
Résumé généré par IA à partir d'informations publiques — c'est le vôtre ?
FAQ
Combien coûte gpt-oss-120b ?
Offre mesurée la moins chère : $0.03/1M en entrée, $0.17/1M en sortie via CoreWeave (fp4) — parmi 30 fournisseurs suivis, rafraîchi chaque heure.
Qui sert gpt-oss-120b ?
30 fournisseurs le servent actuellement. Le tableau ci-dessus liste prix, TTFT, TPS, disponibilité et niveau de preuve de chacun.
À quel point gpt-oss-120b est-il utilisé ?
gpt-oss-120b a routé 81B tokens ces dernières 24h. Les barres quotidiennes montrent le volume récent. Source : classements publics OpenRouter, l'un des rares routeurs publiant l'usage par modèle ; TKX s'actualise chaque heure.