O quadro mostra a oferta medida mais barata deste modelo ($0.425/1M); o número menor abaixo é a média das 15 ofertas listadas abaixo ($1.02/1M). Some e divida — confere. O volume de tokens 24h (80B) vem dos rankings públicos da OpenRouter, hoje a única fonte pública de contagens absolutas por modelo (o Vercel AI Gateway publica percentuais de participação).
| Provedor | Router / Fonte | $ in /1M | $ out /1M | TTFT | TPS | Disponibilidade | Evidência |
|---|---|---|---|---|---|---|---|
| Google AI Studio (flex) | OpenRouter | $0.150 | $1.25 | 2607ms | 5 | 100.0% | Medido por API |
| burncloud | burncloud | $0.270 | $2.25 | — | — | — | Medido por API |
| deepinfra | Pricebook (LiteLLM) | $0.300 | $2.50 | — | — | — | Tabela oficial |
| vertex_ai-language-models | Pricebook (LiteLLM) | $0.300 | $2.50 | — | — | — | Tabela oficial |
| gemini | Pricebook (LiteLLM) | $0.300 | $2.50 | — | — | — | Tabela oficial |
| openrouter | Pricebook (LiteLLM) | $0.300 | $2.50 | — | — | — | Tabela oficial |
| vercel_ai_gateway | Pricebook (LiteLLM) | $0.300 | $2.50 | — | — | — | Tabela oficial |
| requesty | Requesty | $0.300 | $2.50 | — | — | — | Medido por API |
| Google (eu) | OpenRouter | $0.300 | $2.50 | 718ms | 88 | 98.7% | Medido por API |
| Google (global) | OpenRouter | $0.300 | $2.50 | 619ms | 84 | 99.7% | Medido por API |
| Google AI Studio | OpenRouter | $0.300 | $2.50 | 500ms | 101 | 100.0% | Medido por API |
| OpenRouter | $0.300 | $2.50 | 1676ms | 50 | 41.8% | Medido por API | |
| Google (global/priority) | OpenRouter | $0.540 | $4.50 | 1275ms | 42 | 99.7% | Medido por API |
| Google AI Studio (priority) | OpenRouter | $0.540 | $4.50 | — | — | 100.0% | Medido por API |
| replicate | Pricebook (LiteLLM) | $2.50 | $2.50 | — | — | — | Tabela oficial |
Quem consome este modelo
Apps que mais rotearam tráfego para este modelo nos últimos 30 dias, via estatísticas públicas da OpenRouter. Só aparecem apps que optaram pelo rastreamento e apenas os primeiros são publicados — não é o quadro completo da demanda. Janela de 30 dias, NÃO comparável aos totais acumulados do quadro de Apps.
| App | Tokens (30d) | Requisições |
|---|---|---|
| payready-document-extraction | 79B | 25M |
| SquadStack AI | 49B | 8M |
| Hermes Agent | 49B | 2M |
| OpenClaw | 45B | 2M |
| GDevelop | 31B | 511K |
Tendência de volume
Últimos 30 dias: 62B → 80B (+28%); faixa 60B–102B tokens/dia. Fonte: OpenRouter; horária.
Dados e método
Mais barato classificado pelo preço combinado = (3×in + out) ÷ 4; as colunas de desempenho aparecem apenas quando uma fonte as fornece, nunca estimadas. “Tabela oficial” = tabela de preços aberta da LiteLLM (MIT); “Medido por API” = APIs públicas de provedores/agregadores. Dados legíveis por máquina: /api/v1/models/gemini-2.5-flash.json. A reutilização gratuita requer atribuição a tkx.org.
Sobre
Gemini 2.5 Flash is an AI model served by multiple inference providers on AI model marketplaces, listed under the org tag "google". It is used for machine learning tasks, leveraging its strengths in natural language processing and understanding.
Resumo gerado por IA a partir de informações públicas — é seu?
Perguntas frequentes
Quanto custa Gemini 2.5 Flash?
Oferta medida mais barata agora: $0.15/1M de entrada, $1.25/1M de saída via Google AI Studio (flex) — entre 7 fornecedores, atualizado de hora em hora.
Quem serve Gemini 2.5 Flash?
7 fornecedores o servem atualmente. A tabela acima lista preço, TTFT, TPS, disponibilidade e nível de evidência de cada um.
Quanto o Gemini 2.5 Flash é usado?
O Gemini 2.5 Flash roteou 80B tokens nas últimas 24h. As barras diárias mostram o volume recente. Fonte: rankings públicos da OpenRouter, um dos poucos routers que publica uso por modelo; o TKX atualiza a cada hora.