O quadro mostra a oferta medida mais barata deste modelo ($0.065/1M); o número menor abaixo é a média das 48 ofertas listadas abaixo ($0.253/1M). Some e divida — confere. O volume de tokens 24h (81B) vem dos rankings públicos da OpenRouter, hoje a única fonte pública de contagens absolutas por modelo (o Vercel AI Gateway publica percentuais de participação).
| Provedor | Router / Fonte | $ in /1M | $ out /1M | TTFT | TPS | Disponibilidade | Evidência |
|---|---|---|---|---|---|---|---|
| CoreWeave (fp4) | OpenRouter | $0.030 | $0.170 | 407ms | 36 | 99.7% | Medido por API |
| deepinfra | HuggingFace Router | $0.037 | $0.170 | 1784ms | 40 | — | Medido por API |
| DeepInfra (bf16) | OpenRouter | $0.037 | $0.170 | 519ms | 38 | 99.8% | Medido por API |
| novita | Pricebook (LiteLLM) | $0.050 | $0.250 | — | — | — | Tabela oficial |
| novita | HuggingFace Router | $0.050 | $0.250 | 458ms | 66 | — | Medido por API |
| novita-ai | Novita AI | $0.050 | $0.250 | — | — | — | Medido por API |
| Novita (fp4) | OpenRouter | $0.050 | $0.250 | 500ms | 88 | 100% | Medido por API |
| deepinfra | Pricebook (LiteLLM) | $0.050 | $0.450 | — | — | — | Tabela oficial |
| SiliconFlow (fp8) | OpenRouter | $0.050 | $0.450 | 1243ms | 19 | 100% | Medido por API |
| Google (global) | OpenRouter | $0.090 | $0.360 | 310ms | 173 | 99.9% | Medido por API |
| ovhcloud | Pricebook (LiteLLM) | $0.080 | $0.400 | — | — | — | Tabela oficial |
| DigitalOcean | OpenRouter | $0.070 | $0.490 | 502ms | 38 | 100% | Medido por API |
| nscale | HuggingFace Router | $0.100 | $0.400 | 462ms | 107 | — | Medido por API |
| ovhcloud | HuggingFace Router | $0.090 | $0.470 | 502ms | 147 | — | Medido por API |
| baseten | Pricebook (LiteLLM) | $0.100 | $0.500 | — | — | — | Tabela oficial |
| baseten | HuggingFace Router | $0.100 | $0.500 | 262ms | 95 | — | Medido por API |
| BaseTen (fp4) | OpenRouter | $0.100 | $0.500 | 320ms | 151 | 100% | Medido por API |
| Mancer 2 (fp8) | OpenRouter | $0.100 | $0.500 | 925ms | 58 | 99.6% | Medido por API |
| azure_ai | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Tabela oficial |
| fireworks_ai | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Tabela oficial |
| groq | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Tabela oficial |
| together_ai | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Tabela oficial |
| watsonx | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Tabela oficial |
| scaleway | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Tabela oficial |
| tensormesh | Pricebook (LiteLLM) | $0.150 | $0.600 | — | — | — | Tabela oficial |
| together | HuggingFace Router | $0.150 | $0.600 | 251ms | 111 | — | Medido por API |
| fireworks-ai | HuggingFace Router | $0.150 | $0.600 | 1652ms | 72 | — | Medido por API |
| requesty | Requesty | $0.150 | $0.600 | — | — | — | Medido por API |
| Amazon Bedrock | OpenRouter | $0.150 | $0.600 | 495ms | 147 | 99.9% | Medido por API |
| DeepInfra (turbo) | OpenRouter | $0.150 | $0.600 | 507ms | 127 | 100% | Medido por API |
| Together | OpenRouter | $0.150 | $0.600 | 320ms | 64 | 100% | Medido por API |
| Nebius (fp4) | OpenRouter | $0.150 | $0.600 | 325ms | 149 | 98.6% | Medido por API |
| Amazon Bedrock (eu-west-1) | OpenRouter | $0.150 | $0.600 | — | — | — | Medido por API |
| Phala | OpenRouter | $0.150 | $0.600 | 582ms | 92 | 100% | Medido por API |
| Groq | OpenRouter | $0.150 | $0.600 | 227ms | 318 | 100.0% | Medido por API |
| Parasail (fp4) | OpenRouter | $0.100 | $0.750 | 370ms | 98 | 89.5% | Medido por API |
| groq | HuggingFace Router | $0.150 | $0.750 | 270ms | 423 | — | Medido por API |
| Mara | OpenRouter | $0.150 | $0.750 | — | — | 96.3% | Medido por API |
| sambanova | Pricebook (LiteLLM) | $0.220 | $0.590 | — | — | — | Tabela oficial |
| replicate | Pricebook (LiteLLM) | $0.180 | $0.720 | — | — | — | Tabela oficial |
Quem consome este modelo
Apps que mais rotearam tráfego para este modelo nos últimos 30 dias, via estatísticas públicas da OpenRouter. Só aparecem apps que optaram pelo rastreamento e apenas os primeiros são publicados — não é o quadro completo da demanda. Janela de 30 dias, NÃO comparável aos totais acumulados do quadro de Apps.
| App | Tokens (30d) | Requisições |
|---|---|---|
| Mira is the leading AI agent inside Telegram | 110B | 15M |
| cvi-magic-tasks-ai-tagging | 25B | 6M |
| Craft | 22B | 6M |
| OpenClaw | 20B | 760K |
| Hermes Agent | 11B | 395K |
Tendência de volume
Últimos 30 dias: 66B → 81B (+24%); faixa 57B–94B tokens/dia. Fonte: OpenRouter; horária.
Dados e método
Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/gpt-oss-120b.json. A reutilização gratuita requer atribuição a tkx.org.
Sobre
GPT-OSS-120b is a large language model served by multiple inference providers on AI model marketplaces, known for its capabilities in natural language processing tasks.
Resumo gerado por IA a partir de informações públicas — é seu?
Perguntas frequentes
Quanto custa gpt-oss-120b?
Oferta medida mais barata agora: $0.03/1M de entrada, $0.17/1M de saída via CoreWeave (fp4) — entre 30 fornecedores, atualizado de hora em hora.
Quem serve gpt-oss-120b?
30 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.
Quanto o gpt-oss-120b é usado?
O gpt-oss-120b roteou 81B tokens nas últimas 24h. As barras diárias mostram o volume recente. Fonte: rankings públicos da OpenRouter, um dos poucos routers que publica uso por modelo; o TKX atualiza a cada hora.