Models

Gemma 4 31B (free)

google ↗ · 262K ctx · 19 providers · updated 2026-08-05 00:15 UTC

Cheapest
$0.152 via OpenRouter
Avg price
$0.322 /1M
providers
19
Tokens (24h)
56B
Volume (24h)
$9.0K est.
(3 × $0.090 + $0.340) ÷ 4 = $0.152/1M — the $/1M figure blends input and output at 3:1 — that is the only way models with two different rates can be ranked on one axis. Your actual rate depends on your own input:output mix — input only $0.090, 3:1 $0.153, 1:1 $0.215, output only $0.340 per 1M.

The board shows this model's cheapest measured offer ($0.152/1M); the smaller figure under it is the mean of the 26 offers listed below ($0.322/1M). Add those up and divide — it matches. 24h token volume (56B) is sourced from OpenRouter public rankings — today's only public source of absolute per-model token counts (Vercel AI Gateway publishes share-of-traffic percentages); as more sources come online, the per-router breakdown will sum to this total here.

ProviderRouter / Source$ in /1M$ out /1MTTFTTPSUptimeEvidence
DeepInfra (turbo) OpenRouter $0.090$0.340 763ms 20 100.0% API-measured
CoreWeave (bf16) OpenRouter $0.100$0.340 1120ms 34 96.3% API-measured
OpenInference (bf16) OpenRouter $0.100$0.350 913ms 42 99.7% API-measured
Venice (bf16) OpenRouter $0.120$0.360 903ms 45 99.6% API-measured
Chutes (fp4) OpenRouter $0.120$0.370 2010ms 17 98.4% API-measured
deepinfra HuggingFace Router $0.130$0.380 420ms 70 API-measured
requesty Requesty $0.130$0.380 API-measured
DeepInfra (fp8) OpenRouter $0.130$0.380 711ms 35 95.8% API-measured
SiliconFlow (fp8) OpenRouter $0.130$0.400 1696ms 31 99.7% API-measured
novita HuggingFace Router $0.140$0.400 900ms 42 API-measured
novita-ai Novita AI $0.140$0.400 API-measured
Novita (bf16) OpenRouter $0.140$0.400 1068ms 21 99.0% API-measured
Friendli OpenRouter $0.140$0.400 1402ms 102 99.8% API-measured
Morph (fp4) OpenRouter $0.140$0.400 1279ms 16 99.3% API-measured
Crusoe OpenRouter $0.140$0.400 577ms 32 99.6% API-measured
libertai Pricebook (LiteLLM) $0.150$0.400 Official list
Parasail (fp8) OpenRouter $0.150$0.400 996ms 34 99.4% API-measured
Phala OpenRouter $0.150$0.460 1156ms 16 99.8% API-measured
tensormesh Pricebook (LiteLLM) $0.140$0.560 Official list
ModelRun (fp4) OpenRouter $0.220$0.550 107ms 61 100.0% API-measured
Together OpenRouter $0.280$0.860 295ms 42 97.4% API-measured
together HuggingFace Router $0.390$0.970 234ms 57 API-measured
sambanova Pricebook (LiteLLM) $0.380$1.15 Official list
SambaNova OpenRouter $0.380$1.15 2867ms 114 99.7% API-measured
cerebras HuggingFace Router $0.990$1.49 194ms 668 API-measured
Cerebras (fp16) OpenRouter $0.990$1.49 457ms 184 100% API-measured

Volume trend

68B 30d d-29 · 53B tokensd-28 · 47B tokensd-27 · 46B tokensd-26 · 45B tokensd-25 · 50B tokensd-24 · 41B tokensd-23 · 41B tokensd-22 · 49B tokensd-21 · 46B tokensd-20 · 46B tokensd-19 · 48B tokensd-18 · 51B tokensd-17 · 48B tokensd-16 · 46B tokensd-15 · 51B tokensd-14 · 55B tokensd-13 · 60B tokensd-12 · 56B tokensd-11 · 55B tokensd-10 · 46B tokensd-9 · 47B tokensd-8 · 55B tokensd-7 · 57B tokensd-6 · 56B tokensd-5 · 60B tokensd-4 · 68B tokensd-3 · 60B tokensd-2 · 58B tokensd-1 · 58B tokensd-0 · 56B tokens

Last 30 days: 53B → 56B (+7%); range 41B–68B tokens/day. Source: OpenRouter public rankings; refreshed hourly.

Data & method

Cheapest ranked by blended = (3×in + out) ÷ 4; performance columns show only when a source provides them, never estimated. “Official list” = LiteLLM open pricebook (MIT); “API-measured” = provider/aggregator public APIs. Machine-readable data: /api/v1/models/gemma-4-31b-it.json. Free reuse requires attribution to tkx.org.

About

Gemma 4 31B is an AI model served by multiple inference providers on AI model marketplaces, known for its language understanding capabilities.

AI-generated summary from public information — is this yours?

FAQ

How much does Gemma 4 31B (free) cost?

Cheapest measured offer right now: $0.09/1M input, $0.34/1M output via DeepInfra (turbo) — across 19 tracked providers, refreshed hourly.

Who serves Gemma 4 31B (free)?

19 providers currently serve it. The table above lists each with input/output price, TTFT, TPS, uptime and an evidence tier.

How heavily is Gemma 4 31B (free) used?

Gemma 4 31B (free) routed 56B tokens in the last 24h. The daily bars above show routed volume over recent days. Source: OpenRouter public rankings — one of the few routers publishing per-model usage; TKX refreshes hourly.

Related analysis

Back to rankings