Le classement affiche l'offre mesurée la moins chère de ce modèle ($0.825/1M) ; le chiffre plus petit en dessous est la moyenne des 44 offres listées ci-dessous ($1.99/1M). Additionnez et divisez — cela correspond. Le volume de tokens 24h (408B) provient d'OpenRouter, aujourd'hui la seule source publique de volumes absolus par modèle (Vercel AI Gateway publie des parts de trafic en %). Recoupement — Vercel AI Gateway : 6.25% du volume de tokens du gateway, 3.86% des dépenses (2026-08-04 ; part de trafic, quotidien, données CC BY 4.0).
| Fournisseur | Router / Source | $ in /1M | $ out /1M | TTFT | TPS | Disponibilité | Preuve |
|---|---|---|---|---|---|---|---|
| Decart (fp4) | OpenRouter | $0.600 | $1.50 | 1035ms | 76 | 99.6% | Mesuré via API |
| StreamLake (fp8) | OpenRouter | $0.693 | $2.18 | 2745ms | 31 | 99.1% | Mesuré via API |
| Novita (fp8) | OpenRouter | $0.700 | $2.20 | 2824ms | 30 | 97.9% | Mesuré via API |
| deepinfra | HuggingFace Router | $0.750 | $2.40 | 652ms | 38 | — | Mesuré via API |
| DeepInfra (fp4) | OpenRouter | $0.750 | $2.40 | 1615ms | 37 | 99.5% | Mesuré via API |
| CoreWeave (fp4) | OpenRouter | $0.760 | $2.42 | 809ms | 77 | 99.9% | Mesuré via API |
| AkashML (fp8) | OpenRouter | $0.770 | $2.42 | 1039ms | 80 | 100% | Mesuré via API |
| GMICloud (fp8) | OpenRouter | $0.924 | $2.90 | 2899ms | 28 | 100.0% | Mesuré via API |
| 0g-teeml | 0G Router | $0.900 | $3.00 | — | — | — | Mesuré via API |
| Inceptron (fp4) | OpenRouter | $0.940 | $2.90 | 823ms | 33 | 100.0% | Mesuré via API |
| Alibaba (fp8) | OpenRouter | $0.966 | $3.04 | 1492ms | 44 | 100.0% | Mesuré via API |
| requesty | Requesty | $1.05 | $3.30 | — | — | — | Mesuré via API |
| Sail Research (fp8) | OpenRouter | $1.00 | $3.50 | 1718ms | 24 | 100% | Mesuré via API |
| Baidu (fp8) | OpenRouter | $1.18 | $3.70 | 1272ms | 58 | 100.0% | Mesuré via API |
| SiliconFlow (fp8) | OpenRouter | $1.19 | $3.74 | 1684ms | 53 | 100% | Mesuré via API |
| Morph | OpenRouter | $1.10 | $4.10 | 1741ms | 53 | 100% | Mesuré via API |
| DigitalOcean | OpenRouter | $1.05 | $4.40 | 1268ms | 36 | 98.3% | Mesuré via API |
| Ambient (fp8) | OpenRouter | $1.05 | $4.40 | 1952ms | 24 | 100% | Mesuré via API |
| burncloud | burncloud | $1.18 | $4.14 | — | — | — | Mesuré via API |
| Chutes (fp4) | OpenRouter | $1.25 | $3.95 | 1931ms | 18 | 94.6% | Mesuré via API |
| Wafer | OpenRouter | $1.26 | $3.96 | 1414ms | 95 | 98.5% | Mesuré via API |
| AtlasCloud (fp8) | OpenRouter | $1.26 | $3.96 | 1678ms | 36 | 100% | Mesuré via API |
| Phala | OpenRouter | $1.26 | $3.96 | 1396ms | 37 | 96.5% | Mesuré via API |
| cloudflare | Pricebook (LiteLLM) | $1.40 | $4.40 | — | — | — | Liste officielle |
| novita | HuggingFace Router | $1.40 | $4.40 | 1878ms | 38 | — | Mesuré via API |
| together | HuggingFace Router | $1.40 | $4.40 | 447ms | 144 | — | Mesuré via API |
| fireworks-ai | HuggingFace Router | $1.40 | $4.40 | 1139ms | 32 | — | Mesuré via API |
| baseten | HuggingFace Router | $1.40 | $4.40 | 1796ms | 45 | — | Mesuré via API |
| novita-ai | Novita AI | $1.40 | $4.40 | — | — | — | Mesuré via API |
| Z.AI (fp8) | OpenRouter | $1.40 | $4.40 | 3137ms | 36 | 99.9% | Mesuré via API |
| Fireworks | OpenRouter | $1.40 | $4.40 | 1110ms | 52 | 99.8% | Mesuré via API |
| Cloudflare | OpenRouter | $1.40 | $4.40 | 1119ms | 77 | 100% | Mesuré via API |
| Friendli | OpenRouter | $1.40 | $4.40 | 1155ms | 83 | 99.6% | Mesuré via API |
| Parasail (fp4) | OpenRouter | $1.40 | $4.40 | 1151ms | 60 | 97.8% | Mesuré via API |
| Venice (fp8) | OpenRouter | $1.40 | $4.40 | 1588ms | 39 | 99.7% | Mesuré via API |
| Together | OpenRouter | $1.40 | $4.40 | 896ms | 48 | 97.7% | Mesuré via API |
| Crusoe (fp8) | OpenRouter | $1.40 | $4.40 | 1559ms | 56 | 97.5% | Mesuré via API |
| BaseTen (fp8) | OpenRouter | $1.40 | $4.40 | 1194ms | 61 | 100% | Mesuré via API |
| scaleway | HuggingFace Router | $2.05 | $6.27 | 599ms | 65 | — | Mesuré via API |
| Wafer (fast) | OpenRouter | $2.10 | $6.60 | 5091ms | 84 | 98.7% | Mesuré via API |
Tendance du volume
30 derniers jours : 364B → 408B (+12%) ; plage 230B–659B tokens/jour. Source : OpenRouter ; horaire.
Données et méthode
Le moins cher est classé selon le prix mixte = (3×in + out) ÷ 4 ; les colonnes de performance ne s'affichent que lorsqu'une source les fournit, jamais estimées. “Liste officielle” = grille tarifaire ouverte LiteLLM (MIT) ; “Mesuré via API” = API publiques des fournisseurs/agrégateurs. Données exploitables par machine : /api/v1/models/glm-5.2.json. Réutilisation gratuite sous réserve d'attribution à tkx.org.
À propos
GLM 5.2 is a large language model AI system designed for natural language processing tasks. It is served by multiple inference providers on AI model marketplaces and is listed under the organization tag "z-ai".
Résumé généré par IA à partir d'informations publiques — c'est le vôtre ?
FAQ
Combien coûte GLM 5.2 ?
Offre mesurée la moins chère : $0.6/1M en entrée, $1.5/1M en sortie via Decart (fp4) — parmi 32 fournisseurs suivis, rafraîchi chaque heure.
Qui sert GLM 5.2 ?
32 fournisseurs le servent actuellement. Le tableau ci-dessus liste prix, TTFT, TPS, disponibilité et niveau de preuve de chacun.
À quel point GLM 5.2 est-il utilisé ?
GLM 5.2 a routé 408B tokens ces dernières 24h. Les barres quotidiennes montrent le volume récent. Source : classements publics OpenRouter, l'un des rares routeurs publiant l'usage par modèle ; TKX s'actualise chaque heure.