O quadro mostra a oferta medida mais barata deste modelo ($4.19/1M); o número menor abaixo é a média das 34 ofertas listadas abaixo ($5.86/1M). Some e divida — confere. O volume de tokens 24h (230B) vem dos rankings públicos da OpenRouter, hoje a única fonte pública de contagens absolutas por modelo (o Vercel AI Gateway publica percentuais de participação). Verificação cruzada — Vercel AI Gateway: 4.72% do volume de tokens do gateway, 16.99% do gasto (2026-09-19; participação de tráfego, diária, dados CC BY 4.0).
| Provedor | Router / Fonte | $ in /1M | $ out /1M | TTFT | TPS | Disponibilidade | Evidência |
|---|---|---|---|---|---|---|---|
| Morph (fp8) | OpenRouter ↗ | $1.95 | $10.92 | 4168ms | 8 | 99.9% | Medido por API |
| Sail Research (fp4) | OpenRouter ↗ | $2.14 | $10.76 | 1739ms | 57 | 99.7% | Medido por API |
| openrouter | Pricebook (LiteLLM) ↗ | $2.10 | $10.95 | — | — | — | Tabela oficial |
| InferenceNet (fp4) | OpenRouter ↗ | $2.10 | $10.95 | 8546ms | 6 | 73.6% | Medido por API |
| Relace (fp4) | OpenRouter ↗ | $2.10 | $10.95 | 2803ms | 19 | 99.7% | Medido por API |
| Wafer | OpenRouter ↗ | $2.50 | $10.95 | 357ms | 23 | 100% | Medido por API |
| Phala | OpenRouter ↗ | $2.40 | $12.00 | 4293ms | 21 | 100.0% | Medido por API |
| Makora | OpenRouter ↗ | $2.55 | $12.75 | 1124ms | 30 | 97.1% | Medido por API |
| DigitalOcean | OpenRouter ↗ | $2.55 | $12.95 | 3659ms | 24 | 99.9% | Medido por API |
| deepinfra | Pricebook (LiteLLM) ↗ | $2.85 | $14.25 | — | — | — | Tabela oficial |
| DeepInfra (bf16) | OpenRouter ↗ | $2.85 | $14.25 | 3026ms | 17 | 98.0% | Medido por API |
| moonshot | Pricebook (LiteLLM) ↗ | $3.00 | $15.00 | — | — | — | Tabela oficial |
| nebius | Pricebook (LiteLLM) ↗ | $3.00 | $15.00 | — | — | — | Tabela oficial |
| together_ai | Pricebook (LiteLLM) ↗ | $3.00 | $15.00 | — | — | — | Tabela oficial |
| fireworks_ai | Pricebook (LiteLLM) ↗ | $3.00 | $15.00 | — | — | — | Tabela oficial |
| novita | Pricebook (LiteLLM) ↗ | $3.00 | $15.00 | — | — | — | Tabela oficial |
| aihubmix | Pricebook (LiteLLM) ↗ | $3.00 | $15.00 | — | — | — | Tabela oficial |
| together | HuggingFace Router ↗ | $3.00 | $15.00 | 706ms | 91 | — | Medido por API |
| fireworks-ai | HuggingFace Router ↗ | $3.00 | $15.00 | 890ms | 40 | — | Medido por API |
| baseten | HuggingFace Router ↗ | $3.00 | $15.00 | 537ms | 73 | — | Medido por API |
| 0g-teetls | 0G Router ↗ | $3.00 | $15.00 | — | — | — | Medido por API |
| novita-ai | Novita AI ↗ | $3.00 | $15.00 | — | — | — | Medido por API |
| requesty | Requesty ↗ | $3.00 | $15.00 | — | — | — | Medido por API |
| Chutes (mxfp4) | OpenRouter ↗ | $3.00 | $15.00 | 2791ms | 27 | 100% | Medido por API |
| Parasail (fp4) | OpenRouter ↗ | $3.00 | $15.00 | 1194ms | 72 | 98.9% | Medido por API |
| Modal (mxfp4) | OpenRouter ↗ | $3.00 | $15.00 | 1678ms | 50 | 99.9% | Medido por API |
| Together | OpenRouter ↗ | $3.00 | $15.00 | 1145ms | 66 | 100.0% | Medido por API |
| Fireworks | OpenRouter ↗ | $3.00 | $15.00 | 1628ms | 38 | 99.9% | Medido por API |
| BaseTen (fp8) | OpenRouter ↗ | $3.00 | $15.00 | 2536ms | 63 | 99.6% | Medido por API |
| Moonshot AI (mxfp4) | OpenRouter ↗ | $3.00 | $15.00 | 4500ms | 29 | 99.5% | Medido por API |
| Fireworks (us) | OpenRouter ↗ | $3.30 | $16.50 | 1574ms | 50 | 98.0% | Medido por API |
| Alibaba | OpenRouter ↗ | $3.45 | $17.25 | 3784ms | 25 | 97.6% | Medido por API |
| Fireworks (fast) | OpenRouter ↗ | $4.50 | $22.50 | 373ms | 29 | 99.9% | Medido por API |
| Morph (fast) | OpenRouter ↗ | $6.00 | $22.50 | 3992ms | 9 | 100% | Medido por API |
Tendência de volume
Últimos 30 dias: 210B → 230B (+10%); faixa 160B–341B tokens/dia. Fonte: OpenRouter; horária.
Dados e método
Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/kimi-k3.json. A reutilização gratuita requer atribuição a tkx.org.
Sobre
Kimi K3 is a machine-learning system that serves as a large language model, designed to process and generate human-like text based on input data. It is listed under the organization tag "moonshotai" and is available on AI model marketplaces for various inference providers to utilize.
Resumo gerado por IA a partir de informações públicas — é seu?
Perguntas frequentes
Quanto custa Kimi K3 (batch)?
Oferta medida mais barata agora: $1.95/1M de entrada, $10.92/1M de saída via Morph (fp8) — entre 23 fornecedores, atualizado de hora em hora.
Quem serve Kimi K3 (batch)?
23 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.
Quanto o Kimi K3 (batch) é usado?
O Kimi K3 (batch) roteou 230B tokens nas últimas 24h. As barras diárias mostram o volume recente. Fonte: rankings públicos da OpenRouter, um dos poucos routers que publica uso por modelo; o TKX atualiza a cada hora.