TKXのランキング手法:Trustスコアの全解説
ランキングは、なぜその結果になるのかが見えて初めて価値を持ちます。ここに示すのは、すべてのTKXボードの背後にある完全かつ再現可能なロジックです — ブラックボックスも、有料での順位操作もありません。
すべてを貫く唯一のルール
TKXはAIトークン & コンピュート市場を主張ではなく計測によってランク付けします。すべての価格、上乗せ率、レイテンシ、稼働率の数値はソースから取得され、どのように把握したかを示すタグが付与されます。自己申告の数値は一切受け入れず、保有していないデータでランク付けすることもありません — 計測できない項目は推測せず、probe pendingと表示します。
アグリゲーターのTrustスコア
稼働中の各ルーター/アグリゲーターには、4つの項目の加重ブレンドとしてTrustスコア(0–100)が公開されます:
| 項目 | ウェイト | 計測内容 |
|---|---|---|
| カバレッジ信頼度 | 35% | 取り扱いモデル数を対数スケールで評価します — 16モデルは315モデルには遠く及ばず、薄いカタログが一つの狭い指標だけでボードの首位に立つことはできません。 |
| 価格透明性 | 30% | 公式定価に対する上乗せ率の中央値(比較可能なモデルが≥8件の場合のみ算入)。定価を下回るほど高スコアになります。 |
| 信頼性 | 25% | 実測された稼働率(プローブが必要で、現在は大半が計測待ちです)。 |
| エビデンス品質 | 10% | API計測 > 公式定価 > 自己申告。 |
未計測の項目には中立の事前値(0.5)が適用され、加点も減点もされません。さらに、スコアのうちどれだけが実際に計測され、どれだけが仮定なのかが分かるよう、計測完了率(%)を別途公開しています。計測項目を増やすことでスコアが下がることは決してありません。
小規模ルーターはなぜその順位になるのか?
多くの人が意外に思う具体例を挙げましょう:16モデルしか扱わないweb3ルーターです。その価格透明性は非常に優秀な場合があり(定価を下回ることさえあります)、しかし提供モデル数が少ないためカバレッジ信頼度のスコアは低くなります。その結果、中位に着地します — 高い上乗せ率で価格を水増しする大規模ルーターより上、高カバレッジのルーター群より下です。この順位は意見ではなく、公開されたウェイトから自然に導かれるものであり、ホバーすれば4つの構成スコアを確認できます。
モデルボードとプロバイダーボード
さらに2つのボードがあり、それぞれ明示されたシンプルな並び順を持ちます:
- モデルランキング — プロバイダーの広がり(何社のプロバイダーが提供しているか)順、次に最安のブレンド価格順で並べます。ブレンド価格は、実コストの大半を占める出力を重み付けします:1Mトークンあたり
blended = (3 × input + output) / 4。 - プロバイダー信頼ボード — カバーするモデル数順、次に最安獲得数(あるモデルについてそのプロバイダーが最安となった回数)順、その次にオファー数順で並べます。
エビデンスタグ
TKX上のすべてのデータポイントには4種類のタグのいずれかが付与され、自己申告の値は常に格下げされます:
- official — ベンダーが公表する公式定価。
- api — プロバイダーの公開APIからリアルタイムに読み取った値。
- probe — TKXプローブによる実測値(実際のレイテンシ/スループット/稼働率)。
- self — 自己申告。決して真実としては扱いません。
設計段階からの再現可能性
方法論の全文はバージョン管理され(M-2026.1)、/methodology/で公開されています。すべての収集実行は、ソース別のタイムスタンプとペイロードハッシュとともに/data/provenance.jsonで監査できます。さらに、すべての数値は無料データAPIから取得可能です。ルーターやアグリゲーターを運営されている場合は、自動的に計測・掲載を受けることができます — The Open Router Standardをご覧ください。