Llama 3.1 8B Instruct
meta-llama ↗ · 131K ctx · 9 fournisseurs · mis à jour 2026-08-05 00:15 UTC
Le classement affiche l'offre mesurée la moins chère de ce modèle ($0.025/1M) ; le chiffre plus petit en dessous est la moyenne des 14 offres listées ci-dessous ($0.076/1M). Additionnez et divisez — cela correspond.
| Fournisseur | Router / Source | $ in /1M | $ out /1M | TTFT | TPS | Disponibilité | Preuve |
|---|---|---|---|---|---|---|---|
| DeepInfra (fp8) | OpenRouter | $0.020 | $0.040 | 732ms | 13 | 99.7% | Mesuré via API |
| novita | Pricebook (LiteLLM) | $0.020 | $0.050 | — | — | — | Liste officielle |
| Novita (fp8) | OpenRouter | $0.020 | $0.050 | 457ms | 52 | 99.4% | Mesuré via API |
| novita | HuggingFace Router | $0.020 | $0.050 | 543ms | 130 | — | Mesuré via API |
| deepinfra | HuggingFace Router | $0.020 | $0.050 | 399ms | 12 | — | Mesuré via API |
| novita-ai | Novita AI | $0.020 | $0.050 | — | — | — | Mesuré via API |
| nscale | Pricebook (LiteLLM) | $0.030 | $0.030 | — | — | — | Liste officielle |
| requesty | Requesty | $0.050 | $0.050 | — | — | — | Mesuré via API |
| Groq | OpenRouter | $0.050 | $0.080 | 275ms | 96 | 100.0% | Mesuré via API |
| nscale | HuggingFace Router | $0.060 | $0.060 | 614ms | 149 | — | Mesuré via API |
| ovhcloud | Pricebook (LiteLLM) | $0.100 | $0.100 | — | — | — | Liste officielle |
| Cloudflare (fp8) | OpenRouter | $0.152 | $0.287 | 467ms | 19 | 100% | Mesuré via API |
| perplexity | Pricebook (LiteLLM) | $0.200 | $0.200 | — | — | — | Liste officielle |
| CoreWeave (bf16) | OpenRouter | $0.220 | $0.220 | 195ms | 83 | 100% | Mesuré via API |
Qui consomme ce modèle
Applications ayant le plus routé de trafic vers ce modèle sur les 30 derniers jours, d'après les statistiques publiques d'OpenRouter. Seules les apps ayant activé le suivi apparaissent, et seules les premières sont publiées — ce n'est pas la demande complète. Fenêtre de 30 jours, NON comparable aux totaux cumulés du classement Apps.
| App | Tokens (30j) | Requêtes |
|---|---|---|
| Open WebUI | 10B | 2M |
| Job Agent - LinkedIn Job Matcher | 3B | 2M |
| CCURA Cohort Chat | 3B | 3M |
| pi | 2B | 73K |
| Xreacher | 1B | 6M |
Tendance des prix
Prix mixte le moins cher, 31 derniers jours (USD/1M) : $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.0225 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025 → $0.025
Données et méthode
Le moins cher est classé selon le prix mixte = (3×in + out) ÷ 4 ; les colonnes de performance ne s'affichent que lorsqu'une source les fournit, jamais estimées. “Liste officielle” = grille tarifaire ouverte LiteLLM (MIT) ; “Mesuré via API” = API publiques des fournisseurs/agrégateurs. Données exploitables par machine : /api/v1/models/llama-3.1-8b-instruct.json. Réutilisation gratuite sous réserve d'attribution à tkx.org.
À propos
Llama 3.1 8B Instruct is a large language model (LLM) that specializes in understanding and responding to natural language instructions. It is designed to assist users in generating human-like text based on given prompts.
Résumé généré par IA à partir d'informations publiques — c'est le vôtre ?
FAQ
Combien coûte Llama 3.1 8B Instruct ?
Offre mesurée la moins chère : $0.02/1M en entrée, $0.04/1M en sortie via DeepInfra (fp8) — parmi 9 fournisseurs suivis, rafraîchi chaque heure.
Qui sert Llama 3.1 8B Instruct ?
9 fournisseurs le servent actuellement. Le tableau ci-dessus liste prix, TTFT, TPS, disponibilité et niveau de preuve de chacun.
Le prix de Llama 3.1 8B Instruct monte ou baisse ?
Les bougies quotidiennes suivent le prix combiné le plus bas ($/1M, 3:1). TKX capture chaque heure : baisses et hausses apparaissent le jour même.