Provider
Groq
14 Models · 20 Prices · Cheapest on 5 · Uptime 100.0% · updated 2026-08-05 00:15 UTC
Trust signals · SLA · model-version transparency · pricing stability · quantization-degradation · incident response · data privacy — measured by TKX probe (activating).
About
Groq is a machine-learning system that provides AI inference services, serving 14 models via platforms like Hugging Face, official repositories, and OpenRouter. It specializes in deploying and optimizing machine learning models for various applications.
AI-generated summary from public information — is this yours? Claim & edit
Models served
| Model | $ in /1M | $ out /1M | Cheapest | Router / Source | Evidence |
|---|---|---|---|---|---|
| llama-3.1-8b-instant | $0.050 | $0.080 | ✓ | Pricebook (LiteLLM) | Official list |
| gemma-7b-it | $0.050 | $0.080 | ✓ | Pricebook (LiteLLM) | Official list |
| Llama 3.1 8B Instruct | $0.050 | $0.080 | — | OpenRouter | API-measured |
| gpt-oss-20b | $0.075 | $0.300 | — | Pricebook (LiteLLM) | Official list |
| gpt-oss-safeguard-20b | $0.075 | $0.300 | ✓ | Pricebook (LiteLLM) | Official list |
| llama-4-scout-17b-16e-instruct | $0.110 | $0.340 | — | Pricebook (LiteLLM) | Official list |
| llama-guard-4-12b | $0.200 | $0.200 | — | Pricebook (LiteLLM) | Official list |
| gpt-oss-120b | $0.150 | $0.600 | — | Pricebook (LiteLLM) | Official list |
| llama-4-maverick-17b-128e-instruct | $0.200 | $0.600 | ✓ | Pricebook (LiteLLM) | Official list |
| qwen3-32b | $0.290 | $0.590 | — | Pricebook (LiteLLM) | Official list |
| llama-3.3-70b-versatile | $0.590 | $0.790 | ✓ | Pricebook (LiteLLM) | Official list |
| Llama-3.3-70B-Instruct | $0.590 | $0.790 | — | HuggingFace Router | API-measured |
| MiniMax M2.7 | $0.600 | $1.80 | — | OpenRouter | API-measured |
| kimi-k2-instruct-0905 | $1.00 | $3.00 | — | Pricebook (LiteLLM) | Official list |