Modelos

gemma-4-26B-A4B-it:flex

deepinfra · 262K ctx · 10 proveedores · actualizado 2026-08-17 15:21 UTC

Más barato
$0.110 vía Requesty
Precio medio
$0.193 /1M
proveedores
10
Tokens (24h)
51B
Volumen (24h)
$7.0K est.
(3 × $0.056 + $0.272) ÷ 4 = $0.110/1M — la cifra $/1M combina entrada y salida en proporción 3:1 — es la única forma de ordenar en un eje modelos con dos tarifas distintas. Tu tarifa real depende de tu propia mezcla entrada:salida — solo entrada $0.056, 3:1 $0.110, 1:1 $0.164, solo salida $0.272 por 1M.

El tablero muestra la oferta medida más barata de este modelo ($0.110/1M); la cifra menor debajo es la media de las 13 ofertas listadas abajo ($0.193/1M). Súmalas y divide — coincide. El volumen de tokens 24h (51B) proviene de OpenRouter, hoy la única fuente pública de recuentos absolutos por modelo (Vercel AI Gateway publica porcentajes de cuota).

ProveedorRouter / Fuente$ in /1M$ out /1MTTFTTPSDisponibilidadEvidencia
requesty Requesty $0.056$0.272 Medido por API
deepinfra HuggingFace Router $0.070$0.340 347ms 46 Medido por API
DeepInfra (fp8) OpenRouter $0.070$0.340 467ms 17 99.7% Medido por API
Cloudflare OpenRouter $0.100$0.300 432ms 66 100.0% Medido por API
NextBit (bf16) OpenRouter $0.100$0.400 893ms 30 99.9% Medido por API
SiliconFlow (fp8) OpenRouter $0.120$0.400 1640ms 24 99.3% Medido por API
novita HuggingFace Router $0.130$0.400 631ms 27 Medido por API
novita-ai Novita AI $0.130$0.400 Medido por API
Novita (bf16) OpenRouter $0.130$0.400 1486ms 20 99.7% Medido por API
Parasail (bf16) OpenRouter $0.130$0.400 775ms 22 99.8% Medido por API
Venice (bf16) OpenRouter $0.130$0.400 1081ms 21 99.7% Medido por API
Google (global) OpenRouter $0.150$0.600 364ms 37 99.5% Medido por API
scaleway HuggingFace Router $0.285$0.570 427ms 147 Medido por API

Tendencia de volumen

61B 30d d-29 · 53B tokensd-28 · 60B tokensd-27 · 49B tokensd-26 · 51B tokensd-25 · 48B tokensd-24 · 49B tokensd-23 · 46B tokensd-22 · 40B tokensd-21 · 48B tokensd-20 · 50B tokensd-19 · 51B tokensd-18 · 57B tokensd-17 · 56B tokensd-16 · 54B tokensd-15 · 43B tokensd-14 · 46B tokensd-13 · 45B tokensd-12 · 42B tokensd-11 · 45B tokensd-10 · 46B tokensd-9 · 50B tokensd-8 · 60B tokensd-7 · 57B tokensd-6 · 60B tokensd-5 · 61B tokensd-4 · 50B tokensd-3 · 52B tokensd-2 · 50B tokensd-1 · 47B tokensd-0 · 51B tokens

Últimos 30 días: 53B → 51B (-4%); rango 40B–61B tokens/día. Fuente: OpenRouter; actualización horaria.

Datos y método

El más barato se clasifica por precio combinado = (3×in + out) ÷ 4; las columnas de rendimiento solo se muestran cuando una fuente las proporciona, nunca se estiman. “Lista oficial” = catálogo de precios abierto de LiteLLM (MIT); “Medido por API” = APIs públicas de proveedores/agregadores. Datos legibles por máquina: /api/v1/models/gemma-4-26b-a4b-it.json. La reutilización gratuita requiere atribución a tkx.org.

Acerca de

Gemma 4 26B A4B is a large language model served by multiple inference providers on AI model marketplaces. It is used for natural language processing tasks, leveraging its capabilities in understanding and generating human-like text.

Resumen generado por IA a partir de información pública — ¿es tuyo?

Preguntas frecuentes

¿Cuánto cuesta gemma-4-26B-A4B-it:flex?

Oferta medida mas barata ahora: $0.056/1M de entrada, $0.272/1M de salida via requesty — entre 10 proveedores, actualizado cada hora.

¿Quién sirve gemma-4-26B-A4B-it:flex?

Actualmente lo sirven 10 proveedores. La tabla superior lista precio, TTFT, TPS, disponibilidad y nivel de evidencia de cada uno.

¿Cuánto se usa gemma-4-26B-A4B-it:flex?

gemma-4-26B-A4B-it:flex enrutó 51B tokens en las últimas 24h. Las barras diarias muestran el volumen reciente. Fuente: rankings públicos de OpenRouter, uno de los pocos routers que publica uso por modelo; TKX se actualiza cada hora.

Análisis relacionados

Volver a los rankings