Modelos

gpt-oss-120b

openai ↗ · 131K ctx · 30 provedores · atualizado 2026-08-05 00:15 UTC

Mais barato
$0.065 via OpenRouter
Preço médio
$0.253 /1M
provedores
30
Tokens (24h)
81B
Volume (24h)
$5.7K est.
(3 × $0.030 + $0.170) ÷ 4 = $0.065/1M — o valor $/1M combina entrada e saída na proporção 3:1 — é a única forma de ordenar num eixo modelos com duas tarifas. Sua tarifa real depende da sua própria proporção entrada:saída — só entrada $0.030, 3:1 $0.065, 1:1 $0.100, só saída $0.170 por 1M.

O quadro mostra a oferta medida mais barata deste modelo ($0.065/1M); o número menor abaixo é a média das 48 ofertas listadas abaixo ($0.253/1M). Some e divida — confere. O volume de tokens 24h (81B) vem dos rankings públicos da OpenRouter, hoje a única fonte pública de contagens absolutas por modelo (o Vercel AI Gateway publica percentuais de participação).

ProvedorRouter / Fonte$ in /1M$ out /1MTTFTTPSDisponibilidadeEvidência
CoreWeave (fp4) OpenRouter $0.030$0.170 407ms 36 99.7% Medido por API
deepinfra HuggingFace Router $0.037$0.170 1784ms 40 Medido por API
DeepInfra (bf16) OpenRouter $0.037$0.170 519ms 38 99.8% Medido por API
novita Pricebook (LiteLLM) $0.050$0.250 Tabela oficial
novita HuggingFace Router $0.050$0.250 458ms 66 Medido por API
novita-ai Novita AI $0.050$0.250 Medido por API
Novita (fp4) OpenRouter $0.050$0.250 500ms 88 100% Medido por API
deepinfra Pricebook (LiteLLM) $0.050$0.450 Tabela oficial
SiliconFlow (fp8) OpenRouter $0.050$0.450 1243ms 19 100% Medido por API
Google (global) OpenRouter $0.090$0.360 310ms 173 99.9% Medido por API
ovhcloud Pricebook (LiteLLM) $0.080$0.400 Tabela oficial
DigitalOcean OpenRouter $0.070$0.490 502ms 38 100% Medido por API
nscale HuggingFace Router $0.100$0.400 462ms 107 Medido por API
ovhcloud HuggingFace Router $0.090$0.470 502ms 147 Medido por API
baseten Pricebook (LiteLLM) $0.100$0.500 Tabela oficial
baseten HuggingFace Router $0.100$0.500 262ms 95 Medido por API
BaseTen (fp4) OpenRouter $0.100$0.500 320ms 151 100% Medido por API
Mancer 2 (fp8) OpenRouter $0.100$0.500 925ms 58 99.6% Medido por API
azure_ai Pricebook (LiteLLM) $0.150$0.600 Tabela oficial
fireworks_ai Pricebook (LiteLLM) $0.150$0.600 Tabela oficial
groq Pricebook (LiteLLM) $0.150$0.600 Tabela oficial
together_ai Pricebook (LiteLLM) $0.150$0.600 Tabela oficial
watsonx Pricebook (LiteLLM) $0.150$0.600 Tabela oficial
scaleway Pricebook (LiteLLM) $0.150$0.600 Tabela oficial
tensormesh Pricebook (LiteLLM) $0.150$0.600 Tabela oficial
together HuggingFace Router $0.150$0.600 251ms 111 Medido por API
fireworks-ai HuggingFace Router $0.150$0.600 1652ms 72 Medido por API
requesty Requesty $0.150$0.600 Medido por API
Amazon Bedrock OpenRouter $0.150$0.600 495ms 147 99.9% Medido por API
DeepInfra (turbo) OpenRouter $0.150$0.600 507ms 127 100% Medido por API
Together OpenRouter $0.150$0.600 320ms 64 100% Medido por API
Nebius (fp4) OpenRouter $0.150$0.600 325ms 149 98.6% Medido por API
Amazon Bedrock (eu-west-1) OpenRouter $0.150$0.600 Medido por API
Phala OpenRouter $0.150$0.600 582ms 92 100% Medido por API
Groq OpenRouter $0.150$0.600 227ms 318 100.0% Medido por API
Parasail (fp4) OpenRouter $0.100$0.750 370ms 98 89.5% Medido por API
groq HuggingFace Router $0.150$0.750 270ms 423 Medido por API
Mara OpenRouter $0.150$0.750 96.3% Medido por API
sambanova Pricebook (LiteLLM) $0.220$0.590 Tabela oficial
replicate Pricebook (LiteLLM) $0.180$0.720 Tabela oficial

Quem consome este modelo

Apps que mais rotearam tráfego para este modelo nos últimos 30 dias, via estatísticas públicas da OpenRouter. Só aparecem apps que optaram pelo rastreamento e apenas os primeiros são publicados — não é o quadro completo da demanda. Janela de 30 dias, NÃO comparável aos totais acumulados do quadro de Apps.

AppTokens (30d)Requisições
Mira is the leading AI agent inside Telegram 110B 15M
cvi-magic-tasks-ai-tagging 25B 6M
Craft 22B 6M
OpenClaw 20B 760K
Hermes Agent 11B 395K

Tendência de volume

94B 30d d-29 · 66B tokensd-28 · 75B tokensd-27 · 84B tokensd-26 · 81B tokensd-25 · 69B tokensd-24 · 67B tokensd-23 · 78B tokensd-22 · 72B tokensd-21 · 82B tokensd-20 · 94B tokensd-19 · 90B tokensd-18 · 72B tokensd-17 · 62B tokensd-16 · 57B tokensd-15 · 68B tokensd-14 · 67B tokensd-13 · 72B tokensd-12 · 75B tokensd-11 · 63B tokensd-10 · 60B tokensd-9 · 66B tokensd-8 · 74B tokensd-7 · 87B tokensd-6 · 76B tokensd-5 · 81B tokensd-4 · 78B tokensd-3 · 77B tokensd-2 · 70B tokensd-1 · 66B tokensd-0 · 81B tokens

Últimos 30 dias: 66B → 81B (+24%); faixa 57B–94B tokens/dia. Fonte: OpenRouter; horária.

Dados e método

Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/gpt-oss-120b.json. A reutilização gratuita requer atribuição a tkx.org.

Sobre

GPT-OSS-120b is a large language model served by multiple inference providers on AI model marketplaces, known for its capabilities in natural language processing tasks.

Resumo gerado por IA a partir de informações públicas — é seu?

Perguntas frequentes

Quanto custa gpt-oss-120b?

Oferta medida mais barata agora: $0.03/1M de entrada, $0.17/1M de saída via CoreWeave (fp4) — entre 30 fornecedores, atualizado de hora em hora.

Quem serve gpt-oss-120b?

30 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.

Quanto o gpt-oss-120b é usado?

O gpt-oss-120b roteou 81B tokens nas últimas 24h. As barras diárias mostram o volume recente. Fonte: rankings públicos da OpenRouter, um dos poucos routers que publica uso por modelo; o TKX atualiza a cada hora.

Análises relacionadas

Voltar ao ranking