Le classement affiche l'offre mesurée la moins chère de ce modèle ($0.311/1M) ; le chiffre plus petit en dessous est la moyenne des 12 offres listées ci-dessous ($0.436/1M). Additionnez et divisez — cela correspond. Le volume de tokens 24h (34B) provient d'OpenRouter, aujourd'hui la seule source publique de volumes absolus par modèle (Vercel AI Gateway publie des parts de trafic en %).
| Fournisseur | Router / Source | $ in /1M | $ out /1M | TTFT | TPS | Disponibilité | Preuve |
|---|---|---|---|---|---|---|---|
| Venice (fp8) | OpenRouter | $0.098 | $0.950 | 696ms | 213 | 99.9% | Mesuré via API |
| deepinfra | HuggingFace Router | $0.100 | $0.950 | 288ms | 93 | — | Mesuré via API |
| DeepInfra (fp8) | OpenRouter | $0.100 | $0.950 | 500ms | 50 | 99.9% | Mesuré via API |
| AkashML (fp8) | OpenRouter | $0.140 | $1.00 | 783ms | 103 | 99.4% | Mesuré via API |
| Parasail (fp8) | OpenRouter | $0.150 | $1.00 | 845ms | 46 | 99.9% | Mesuré via API |
| AtlasCloud (fp8) | OpenRouter | $0.186 | $1.11 | 854ms | 93 | 99.3% | Mesuré via API |
| Io Net (fp8) | OpenRouter | $0.190 | $1.19 | 873ms | 119 | 99.7% | Mesuré via API |
| Phala | OpenRouter | $0.200 | $1.27 | 1895ms | 106 | 99.8% | Mesuré via API |
| CoreWeave (fp8) | OpenRouter | $0.250 | $1.25 | 792ms | 145 | 99.9% | Mesuré via API |
| SiliconFlow (fp8) | OpenRouter | $0.200 | $1.60 | 3425ms | 41 | 99.5% | Mesuré via API |
| novita-ai | Novita AI | $0.248 | $1.49 | — | — | — | Mesuré via API |
| scaleway | HuggingFace Router | $0.285 | $1.71 | 386ms | 122 | — | Mesuré via API |
Tendance du volume
30 derniers jours : 17B → 34B (+99%) ; plage 0–35B tokens/jour. Source : OpenRouter ; horaire.
Données et méthode
Le moins cher est classé selon le prix mixte = (3×in + out) ÷ 4 ; les colonnes de performance ne s'affichent que lorsqu'une source les fournit, jamais estimées. “Liste officielle” = grille tarifaire ouverte LiteLLM (MIT) ; “Mesuré via API” = API publiques des fournisseurs/agrégateurs. Données exploitables par machine : /api/v1/models/qwen3.6-35b-a3b.json. Réutilisation gratuite sous réserve d'attribution à tkx.org.
À propos
"qwen3.6-35b-a3b" is a large language model served by multiple inference providers on AI model marketplaces, listed under the "pinstripes" serving-platform tag. It is designed for natural language processing tasks, such as text generation and understanding.
Résumé généré par IA à partir d'informations publiques — c'est le vôtre ?
FAQ
Combien coûte Qwen3.6 35B A3B ?
Offre mesurée la moins chère : $0.098/1M en entrée, $0.95/1M en sortie via Venice (fp8) — parmi 11 fournisseurs suivis, rafraîchi chaque heure.
Qui sert Qwen3.6 35B A3B ?
11 fournisseurs le servent actuellement. Le tableau ci-dessus liste prix, TTFT, TPS, disponibilité et niveau de preuve de chacun.
À quel point Qwen3.6 35B A3B est-il utilisé ?
Qwen3.6 35B A3B a routé 34B tokens ces dernières 24h. Les barres quotidiennes montrent le volume récent. Source : classements publics OpenRouter, l'un des rares routeurs publiant l'usage par modèle ; TKX s'actualise chaque heure.