GPU · Dedicated Accelerators · by comparability tier

GPU leaderboards

Ranked by capability composite inside each tier. Tiers are derived from the exact recorded GPU model, never from a label — an entry card and a datacenter part are different experiments and share no ranking.

everything above the entry cards — consumer Ampere–Ada through Blackwell / Hopper datacenter silicon, any count; ranked by capability composite

ndc · vllm99% done · 2 timeouts64.3 tok/s
Categories:
Aug 30
ndc · vllm100% done132.5 tok/s
Categories:
Aug 30
ndc · vllm100% done46.7 tok/s
Categories:
Aug 30
ndc · vllm100% done94.7 tok/s
Categories:
Aug 30
ndc · vllm100% done98.7 tok/s
Categories:
Aug 30
ndc · vllm100% done58.5 tok/s
Categories:
Aug 30

Entry GPU (16 GB class)

filter & Pareto view →

single entry datacenter card — Tesla T4 / L4 class: the 'runs on what you already have' tier; ranked by usability because item budgets bite here

cdc · ollama97% done · 5 timeouts37.3 tok/s
Categories:
Aug 31
cdc · ollama60% done · 66 timeouts · 27 not attempted (6 h run cap)17.3 tok/s
Categories:
Aug 30