Qwen3-32B:flex
deepinfra · 131K ctx · 11 fournisseurs · mis à jour 2026-09-19 02:15 UTC
Le classement affiche l'offre mesurée la moins chère de ce modèle ($0.104/1M) ; le chiffre plus petit en dessous est la moyenne des 12 offres listées ci-dessous ($0.252/1M). Additionnez et divisez — cela correspond. 1 offre(s) au-dessus de 10x la médiane sont exclues de la moyenne et marquées ⚠ ci-dessous ; elles restent listées et concourent toujours au prix le plus bas.
| Fournisseur | Router / Source | $ in /1M | $ out /1M | TTFT | TPS | Disponibilité | Preuve |
|---|---|---|---|---|---|---|---|
| requesty | Requesty ↗ | $0.064 | $0.224 | — | — | — | Mesuré via API |
| ovhcloud | Pricebook (LiteLLM) ↗ | $0.080 | $0.230 | — | — | — | Liste officielle |
| nscale | HuggingFace Router ↗ | $0.080 | $0.250 | 763ms | 38 | — | Mesuré via API |
| deepinfra | Pricebook (LiteLLM) ↗ | $0.080 | $0.280 | — | — | — | Liste officielle |
| openrouter | Pricebook (LiteLLM) ↗ | $0.080 | $0.280 | — | — | — | Liste officielle |
| deepinfra | HuggingFace Router ↗ | $0.080 | $0.280 | 565ms | 25 | — | Mesuré via API |
| DeepInfra (fp8) | OpenRouter ↗ | $0.080 | $0.280 | 328ms | 30 | 100.0% | Mesuré via API |
| nebius | Pricebook (LiteLLM) ↗ | $0.100 | $0.300 | — | — | — | Liste officielle |
| SiliconFlow (fp8) | OpenRouter ↗ | $0.140 | $0.570 | 846ms | 25 | 99.5% | Mesuré via API |
| groq | Pricebook (LiteLLM) ↗ | $0.290 | $0.590 | — | — | — | Liste officielle |
| sambanova | Pricebook (LiteLLM) ↗ | $0.400 | $0.800 | — | — | — | Liste officielle |
| fireworks_ai | Pricebook (LiteLLM) ↗ | $0.900 | $0.900 | — | — | — | Liste officielle |
| burncloud ⚠ aberrant | burncloud ↗ | $2.00 | $20.00 | — | — | — | Mesuré via API |
Tendance des prix
Prix mixte le moins cher, 31 derniers jours (USD/1M) : $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104
Données et méthode
Le moins cher est classé selon le prix mixte = (3×in + out) ÷ 4 ; les colonnes de performance ne s'affichent que lorsqu'une source les fournit, jamais estimées. “Liste officielle” = grille tarifaire ouverte LiteLLM (MIT) ; “Mesuré via API” = API publiques des fournisseurs/agrégateurs. Données exploitables par machine : /api/v1/models/qwen3-32b.json. Réutilisation gratuite sous réserve d'attribution à tkx.org.
À propos
Qwen3-32B is a language model AI, designed for natural language processing tasks. It is served by multiple inference providers on AI model marketplaces and is listed under the "ovhcloud" serving-platform tag.
Résumé généré par IA à partir d'informations publiques — c'est le vôtre ?
FAQ
Combien coûte Qwen3-32B:flex ?
Offre mesurée la moins chère : $0.064/1M en entrée, $0.224/1M en sortie via requesty — parmi 11 fournisseurs suivis, rafraîchi chaque heure.
Qui sert Qwen3-32B:flex ?
11 fournisseurs le servent actuellement. Le tableau ci-dessus liste prix, TTFT, TPS, disponibilité et niveau de preuve de chacun.
Le prix de Qwen3-32B:flex monte ou baisse ?
Les bougies quotidiennes suivent le prix combiné le plus bas ($/1M, 3:1). TKX capture chaque heure : baisses et hausses apparaissent le jour même.