Qwen3-32B:flex
deepinfra · 131K ctx · 11 provedores · atualizado 2026-09-19 02:15 UTC
O quadro mostra a oferta medida mais barata deste modelo ($0.104/1M); o número menor abaixo é a média das 12 ofertas listadas abaixo ($0.252/1M). Some e divida — confere. 1 oferta(s) acima de 10x a mediana ficaram fora da média e estão marcadas ⚠ abaixo; continuam listadas e ainda competem pelo preço mais baixo.
| Provedor | Router / Fonte | $ in /1M | $ out /1M | TTFT | TPS | Disponibilidade | Evidência |
|---|---|---|---|---|---|---|---|
| requesty | Requesty ↗ | $0.064 | $0.224 | — | — | — | Medido por API |
| ovhcloud | Pricebook (LiteLLM) ↗ | $0.080 | $0.230 | — | — | — | Tabela oficial |
| nscale | HuggingFace Router ↗ | $0.080 | $0.250 | 763ms | 38 | — | Medido por API |
| deepinfra | Pricebook (LiteLLM) ↗ | $0.080 | $0.280 | — | — | — | Tabela oficial |
| openrouter | Pricebook (LiteLLM) ↗ | $0.080 | $0.280 | — | — | — | Tabela oficial |
| deepinfra | HuggingFace Router ↗ | $0.080 | $0.280 | 565ms | 25 | — | Medido por API |
| DeepInfra (fp8) | OpenRouter ↗ | $0.080 | $0.280 | 328ms | 30 | 100.0% | Medido por API |
| nebius | Pricebook (LiteLLM) ↗ | $0.100 | $0.300 | — | — | — | Tabela oficial |
| SiliconFlow (fp8) | OpenRouter ↗ | $0.140 | $0.570 | 846ms | 25 | 99.5% | Medido por API |
| groq | Pricebook (LiteLLM) ↗ | $0.290 | $0.590 | — | — | — | Tabela oficial |
| sambanova | Pricebook (LiteLLM) ↗ | $0.400 | $0.800 | — | — | — | Tabela oficial |
| fireworks_ai | Pricebook (LiteLLM) ↗ | $0.900 | $0.900 | — | — | — | Tabela oficial |
| burncloud ⚠ atípico | burncloud ↗ | $2.00 | $20.00 | — | — | — | Medido por API |
Tendência de preço
Menor preço combinado, últimos 31 dias (USD/1M): $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.0936 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104 → $0.104
Dados e método
Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/qwen3-32b.json. A reutilização gratuita requer atribuição a tkx.org.
Sobre
Qwen3-32B is a language model AI, designed for natural language processing tasks. It is served by multiple inference providers on AI model marketplaces and is listed under the "ovhcloud" serving-platform tag.
Resumo gerado por IA a partir de informações públicas — é seu?
Perguntas frequentes
Quanto custa Qwen3-32B:flex?
Oferta medida mais barata agora: $0.064/1M de entrada, $0.224/1M de saída via requesty — entre 11 fornecedores, atualizado de hora em hora.
Quem serve Qwen3-32B:flex?
11 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.
O preço de Qwen3-32B:flex está subindo ou caindo?
As velas diárias acompanham o menor preço combinado ($/1M, 3:1). A TKX captura a cada hora: quedas e altas aparecem no mesmo dia.