O quadro mostra a oferta medida mais barata deste modelo ($0.311/1M); o número menor abaixo é a média das 12 ofertas listadas abaixo ($0.436/1M). Some e divida — confere. O volume de tokens 24h (34B) vem dos rankings públicos da OpenRouter, hoje a única fonte pública de contagens absolutas por modelo (o Vercel AI Gateway publica percentuais de participação).
| Provedor | Router / Fonte | $ in /1M | $ out /1M | TTFT | TPS | Disponibilidade | Evidência |
|---|---|---|---|---|---|---|---|
| Venice (fp8) | OpenRouter | $0.098 | $0.950 | 696ms | 213 | 99.9% | Medido por API |
| deepinfra | HuggingFace Router | $0.100 | $0.950 | 288ms | 93 | — | Medido por API |
| DeepInfra (fp8) | OpenRouter | $0.100 | $0.950 | 500ms | 50 | 99.9% | Medido por API |
| AkashML (fp8) | OpenRouter | $0.140 | $1.00 | 783ms | 103 | 99.4% | Medido por API |
| Parasail (fp8) | OpenRouter | $0.150 | $1.00 | 845ms | 46 | 99.9% | Medido por API |
| AtlasCloud (fp8) | OpenRouter | $0.186 | $1.11 | 854ms | 93 | 99.3% | Medido por API |
| Io Net (fp8) | OpenRouter | $0.190 | $1.19 | 873ms | 119 | 99.7% | Medido por API |
| Phala | OpenRouter | $0.200 | $1.27 | 1895ms | 106 | 99.8% | Medido por API |
| CoreWeave (fp8) | OpenRouter | $0.250 | $1.25 | 792ms | 145 | 99.9% | Medido por API |
| SiliconFlow (fp8) | OpenRouter | $0.200 | $1.60 | 3425ms | 41 | 99.5% | Medido por API |
| novita-ai | Novita AI | $0.248 | $1.49 | — | — | — | Medido por API |
| scaleway | HuggingFace Router | $0.285 | $1.71 | 386ms | 122 | — | Medido por API |
Tendência de volume
Últimos 30 dias: 17B → 34B (+99%); faixa 0–35B tokens/dia. Fonte: OpenRouter; horária.
Dados e método
Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/qwen3.6-35b-a3b.json. A reutilização gratuita requer atribuição a tkx.org.
Sobre
"qwen3.6-35b-a3b" is a large language model served by multiple inference providers on AI model marketplaces, listed under the "pinstripes" serving-platform tag. It is designed for natural language processing tasks, such as text generation and understanding.
Resumo gerado por IA a partir de informações públicas — é seu?
Perguntas frequentes
Quanto custa Qwen3.6 35B A3B?
Oferta medida mais barata agora: $0.098/1M de entrada, $0.95/1M de saída via Venice (fp8) — entre 11 fornecedores, atualizado de hora em hora.
Quem serve Qwen3.6 35B A3B?
11 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.
Quanto o Qwen3.6 35B A3B é usado?
O Qwen3.6 35B A3B roteou 34B tokens nas últimas 24h. As barras diárias mostram o volume recente. Fonte: rankings públicos da OpenRouter, um dos poucos routers que publica uso por modelo; o TKX atualiza a cada hora.