TKX는 어떻게 랭킹을 매기는가: Trust 점수 해설
랭킹은 왜 그런 결과가 나왔는지 들여다볼 수 있을 때에만 가치가 있습니다. 이것이 모든 TKX 보드 뒤에 있는 완전하고 재현 가능한 로직입니다 — 블랙박스도, 돈을 받고 순위를 파는 일도 없습니다.
모든 것의 바탕이 되는 단 하나의 규칙
TKX는 AI 토큰 & 컴퓨트 시장을 주장이 아닌 측정으로 랭킹합니다. 모든 가격, 마크업, 지연 시간, 가동률 수치는 출처에서 수집되며 어떻게 알아냈는지가 태그로 기록됩니다. 자체 보고 수치는 결코 받아들이지 않으며, 보유하지 않은 데이터로 랭킹하지도 않습니다 — 측정할 수 없는 차원은 추정하지 않고 probe pending으로 표시합니다.
애그리게이터 Trust 점수
운영 중인 각 라우터/애그리게이터에는 네 가지 차원을 가중 합산해 산출한 Trust 점수(0–100)가 공개적으로 부여됩니다:
| 차원 | 가중치 | 측정 내용 |
|---|---|---|
| 커버리지 신뢰도 | 35% | 보유 모델 수를 로그 스케일로 측정합니다 — 16개 모델은 315개 근처에도 가지 못하므로, 얇은 카탈로그가 하나의 좁은 지표만으로 보드 정상에 오를 수 없습니다. |
| 가격 투명성 | 30% | 공식 정가 대비 마크업 중앙값(비교 가능한 모델이 ≥8개일 때만 집계). 정가보다 낮으면 더 높은 점수를 받습니다. |
| 신뢰성 | 25% | 측정된 가동률(프로브 필요, 현재 대부분 대기 중). |
| 증거 품질 | 10% | API 측정 > 공식 정가 > 자체 보고. |
측정되지 않은 차원에는 중립 사전값(0.5)이 적용됩니다 — 보상도 불이익도 주지 않습니다 — 그리고 점수 중 실제로 측정된 부분과 가정에 기댄 부분의 비율을 확인할 수 있도록 별도의 완전성 %를 함께 공개합니다. 더 많이 측정한다고 점수가 내려가는 일은 결코 없습니다.
소규모 라우터는 왜 그 순위에 있을까요?
사람들이 의외라고 느끼는 구체적인 사례를 보겠습니다: 모델을 16개만 보유한 web3 라우터입니다. 이 라우터의 가격 투명성은 매우 우수할 수 있지만(정가보다 낮게 책정할 수도 있습니다), 서비스하는 모델 수가 적어 커버리지 신뢰도 점수는 낮습니다. 그래서 중위권에 자리합니다 — 높은 마크업으로 가격을 부풀리는 대형 라우터보다는 위, 커버리지가 높은 라우터들보다는 아래입니다. 이 순서는 의견이 아니라 공개된 가중치에서 자연스럽게 도출되며, 마우스를 올리면 네 가지 구성 점수를 확인할 수 있습니다.
모델 및 프로바이더 보드
두 개의 보드가 더 있으며, 각각 단순하고 명시된 정렬 기준을 따릅니다:
- 모델 랭킹 — 프로바이더 폭(해당 모델을 서비스하는 프로바이더 수) 기준으로 먼저 정렬한 뒤, 최저 혼합 가격순으로 정렬합니다. 혼합 가격은 실제 비용을 좌우하는 출력에 가중치를 둡니다: 1M 토큰당
blended = (3 × input + output) / 4. - 프로바이더 신뢰 보드 — 커버하는 모델 수, 최저가 달성 횟수(해당 프로바이더가 특정 모델에서 최저가가 되는 빈도), 오퍼 수 순으로 정렬합니다.
증거 태그
TKX의 모든 데이터 포인트에는 네 가지 태그 중 하나가 붙으며, 자체 보고 값은 항상 하향 평가됩니다:
- official — 벤더가 공표한 정가.
- api — 프로바이더의 라이브 공개 API에서 읽은 값.
- probe — TKX 프로브로 측정한 값(실제 지연 시간 / 처리량 / 가동률).
- self — 자체 보고 값. 결코 사실로 취급하지 않습니다.
설계부터 재현 가능하게
전체 방법론은 버전 관리되며(M-2026.1) /methodology/에 공개되어 있습니다. 모든 수집 실행은 소스별 타임스탬프와 페이로드 해시와 함께 /data/provenance.json에서 감사할 수 있으며, 모든 수치는 무료 데이터 API로 제공됩니다. 라우터나 애그리게이터를 운영하고 있다면 자동으로 측정되어 등재될 수 있습니다 — The Open Router Standard를 참고하십시오.