O quadro mostra a oferta medida mais barata deste modelo ($0.825/1M); o número menor abaixo é a média das 44 ofertas listadas abaixo ($1.99/1M). Some e divida — confere. O volume de tokens 24h (408B) vem dos rankings públicos da OpenRouter, hoje a única fonte pública de contagens absolutas por modelo (o Vercel AI Gateway publica percentuais de participação). Verificação cruzada — Vercel AI Gateway: 6.25% do volume de tokens do gateway, 3.86% do gasto (2026-08-04; participação de tráfego, diária, dados CC BY 4.0).
| Provedor | Router / Fonte | $ in /1M | $ out /1M | TTFT | TPS | Disponibilidade | Evidência |
|---|---|---|---|---|---|---|---|
| Decart (fp4) | OpenRouter | $0.600 | $1.50 | 1035ms | 76 | 99.6% | Medido por API |
| StreamLake (fp8) | OpenRouter | $0.693 | $2.18 | 2745ms | 31 | 99.1% | Medido por API |
| Novita (fp8) | OpenRouter | $0.700 | $2.20 | 2824ms | 30 | 97.9% | Medido por API |
| deepinfra | HuggingFace Router | $0.750 | $2.40 | 652ms | 38 | — | Medido por API |
| DeepInfra (fp4) | OpenRouter | $0.750 | $2.40 | 1615ms | 37 | 99.5% | Medido por API |
| CoreWeave (fp4) | OpenRouter | $0.760 | $2.42 | 809ms | 77 | 99.9% | Medido por API |
| AkashML (fp8) | OpenRouter | $0.770 | $2.42 | 1039ms | 80 | 100% | Medido por API |
| GMICloud (fp8) | OpenRouter | $0.924 | $2.90 | 2899ms | 28 | 100.0% | Medido por API |
| 0g-teeml | 0G Router | $0.900 | $3.00 | — | — | — | Medido por API |
| Inceptron (fp4) | OpenRouter | $0.940 | $2.90 | 823ms | 33 | 100.0% | Medido por API |
| Alibaba (fp8) | OpenRouter | $0.966 | $3.04 | 1492ms | 44 | 100.0% | Medido por API |
| requesty | Requesty | $1.05 | $3.30 | — | — | — | Medido por API |
| Sail Research (fp8) | OpenRouter | $1.00 | $3.50 | 1718ms | 24 | 100% | Medido por API |
| Baidu (fp8) | OpenRouter | $1.18 | $3.70 | 1272ms | 58 | 100.0% | Medido por API |
| SiliconFlow (fp8) | OpenRouter | $1.19 | $3.74 | 1684ms | 53 | 100% | Medido por API |
| Morph | OpenRouter | $1.10 | $4.10 | 1741ms | 53 | 100% | Medido por API |
| DigitalOcean | OpenRouter | $1.05 | $4.40 | 1268ms | 36 | 98.3% | Medido por API |
| Ambient (fp8) | OpenRouter | $1.05 | $4.40 | 1952ms | 24 | 100% | Medido por API |
| burncloud | burncloud | $1.18 | $4.14 | — | — | — | Medido por API |
| Chutes (fp4) | OpenRouter | $1.25 | $3.95 | 1931ms | 18 | 94.6% | Medido por API |
| Wafer | OpenRouter | $1.26 | $3.96 | 1414ms | 95 | 98.5% | Medido por API |
| AtlasCloud (fp8) | OpenRouter | $1.26 | $3.96 | 1678ms | 36 | 100% | Medido por API |
| Phala | OpenRouter | $1.26 | $3.96 | 1396ms | 37 | 96.5% | Medido por API |
| cloudflare | Pricebook (LiteLLM) | $1.40 | $4.40 | — | — | — | Tabela oficial |
| novita | HuggingFace Router | $1.40 | $4.40 | 1878ms | 38 | — | Medido por API |
| together | HuggingFace Router | $1.40 | $4.40 | 447ms | 144 | — | Medido por API |
| fireworks-ai | HuggingFace Router | $1.40 | $4.40 | 1139ms | 32 | — | Medido por API |
| baseten | HuggingFace Router | $1.40 | $4.40 | 1796ms | 45 | — | Medido por API |
| novita-ai | Novita AI | $1.40 | $4.40 | — | — | — | Medido por API |
| Z.AI (fp8) | OpenRouter | $1.40 | $4.40 | 3137ms | 36 | 99.9% | Medido por API |
| Fireworks | OpenRouter | $1.40 | $4.40 | 1110ms | 52 | 99.8% | Medido por API |
| Cloudflare | OpenRouter | $1.40 | $4.40 | 1119ms | 77 | 100% | Medido por API |
| Friendli | OpenRouter | $1.40 | $4.40 | 1155ms | 83 | 99.6% | Medido por API |
| Parasail (fp4) | OpenRouter | $1.40 | $4.40 | 1151ms | 60 | 97.8% | Medido por API |
| Venice (fp8) | OpenRouter | $1.40 | $4.40 | 1588ms | 39 | 99.7% | Medido por API |
| Together | OpenRouter | $1.40 | $4.40 | 896ms | 48 | 97.7% | Medido por API |
| Crusoe (fp8) | OpenRouter | $1.40 | $4.40 | 1559ms | 56 | 97.5% | Medido por API |
| BaseTen (fp8) | OpenRouter | $1.40 | $4.40 | 1194ms | 61 | 100% | Medido por API |
| scaleway | HuggingFace Router | $2.05 | $6.27 | 599ms | 65 | — | Medido por API |
| Wafer (fast) | OpenRouter | $2.10 | $6.60 | 5091ms | 84 | 98.7% | Medido por API |
Tendência de volume
Últimos 30 dias: 364B → 408B (+12%); faixa 230B–659B tokens/dia. Fonte: OpenRouter; horária.
Dados e método
Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/glm-5.2.json. A reutilização gratuita requer atribuição a tkx.org.
Sobre
GLM 5.2 is a large language model AI system designed for natural language processing tasks. It is served by multiple inference providers on AI model marketplaces and is listed under the organization tag "z-ai".
Resumo gerado por IA a partir de informações públicas — é seu?
Perguntas frequentes
Quanto custa GLM 5.2?
Oferta medida mais barata agora: $0.6/1M de entrada, $1.5/1M de saída via Decart (fp4) — entre 32 fornecedores, atualizado de hora em hora.
Quem serve GLM 5.2?
32 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.
Quanto o GLM 5.2 é usado?
O GLM 5.2 roteou 408B tokens nas últimas 24h. As barras diárias mostram o volume recente. Fonte: rankings públicos da OpenRouter, um dos poucos routers que publica uso por modelo; o TKX atualiza a cada hora.