Modelos

gemma-4-26B-A4B-it:flex

deepinfra · 262K ctx · 10 provedores · atualizado 2026-08-17 15:21 UTC

Mais barato
$0.110 via Requesty
Preço médio
$0.193 /1M
provedores
10
Tokens (24h)
51B
Volume (24h)
$7.0K est.
(3 × $0.056 + $0.272) ÷ 4 = $0.110/1M — o valor $/1M combina entrada e saída na proporção 3:1 — é a única forma de ordenar num eixo modelos com duas tarifas. Sua tarifa real depende da sua própria proporção entrada:saída — só entrada $0.056, 3:1 $0.110, 1:1 $0.164, só saída $0.272 por 1M.

O quadro mostra a oferta medida mais barata deste modelo ($0.110/1M); o número menor abaixo é a média das 13 ofertas listadas abaixo ($0.193/1M). Some e divida — confere. O volume de tokens 24h (51B) vem dos rankings públicos da OpenRouter, hoje a única fonte pública de contagens absolutas por modelo (o Vercel AI Gateway publica percentuais de participação).

ProvedorRouter / Fonte$ in /1M$ out /1MTTFTTPSDisponibilidadeEvidência
requesty Requesty $0.056$0.272 Medido por API
deepinfra HuggingFace Router $0.070$0.340 347ms 46 Medido por API
DeepInfra (fp8) OpenRouter $0.070$0.340 467ms 17 99.7% Medido por API
Cloudflare OpenRouter $0.100$0.300 432ms 66 100.0% Medido por API
NextBit (bf16) OpenRouter $0.100$0.400 893ms 30 99.9% Medido por API
SiliconFlow (fp8) OpenRouter $0.120$0.400 1640ms 24 99.3% Medido por API
novita HuggingFace Router $0.130$0.400 631ms 27 Medido por API
novita-ai Novita AI $0.130$0.400 Medido por API
Novita (bf16) OpenRouter $0.130$0.400 1486ms 20 99.7% Medido por API
Parasail (bf16) OpenRouter $0.130$0.400 775ms 22 99.8% Medido por API
Venice (bf16) OpenRouter $0.130$0.400 1081ms 21 99.7% Medido por API
Google (global) OpenRouter $0.150$0.600 364ms 37 99.5% Medido por API
scaleway HuggingFace Router $0.285$0.570 427ms 147 Medido por API

Tendência de volume

61B 30d d-29 · 53B tokensd-28 · 60B tokensd-27 · 49B tokensd-26 · 51B tokensd-25 · 48B tokensd-24 · 49B tokensd-23 · 46B tokensd-22 · 40B tokensd-21 · 48B tokensd-20 · 50B tokensd-19 · 51B tokensd-18 · 57B tokensd-17 · 56B tokensd-16 · 54B tokensd-15 · 43B tokensd-14 · 46B tokensd-13 · 45B tokensd-12 · 42B tokensd-11 · 45B tokensd-10 · 46B tokensd-9 · 50B tokensd-8 · 60B tokensd-7 · 57B tokensd-6 · 60B tokensd-5 · 61B tokensd-4 · 50B tokensd-3 · 52B tokensd-2 · 50B tokensd-1 · 47B tokensd-0 · 51B tokens

Últimos 30 dias: 53B → 51B (-4%); faixa 40B–61B tokens/dia. Fonte: OpenRouter; horária.

Dados e método

Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/gemma-4-26b-a4b-it.json. A reutilização gratuita requer atribuição a tkx.org.

Sobre

Gemma 4 26B A4B is a large language model served by multiple inference providers on AI model marketplaces. It is used for natural language processing tasks, leveraging its capabilities in understanding and generating human-like text.

Resumo gerado por IA a partir de informações públicas — é seu?

Perguntas frequentes

Quanto custa gemma-4-26B-A4B-it:flex?

Oferta medida mais barata agora: $0.056/1M de entrada, $0.272/1M de saída via requesty — entre 10 fornecedores, atualizado de hora em hora.

Quem serve gemma-4-26B-A4B-it:flex?

10 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.

Quanto o gemma-4-26B-A4B-it:flex é usado?

O gemma-4-26B-A4B-it:flex roteou 51B tokens nas últimas 24h. As barras diárias mostram o volume recente. Fonte: rankings públicos da OpenRouter, um dos poucos routers que publica uso por modelo; o TKX atualiza a cada hora.

Análises relacionadas

Voltar ao ranking