按硬件看
库里有记录的,每一张卡
这一页是"取值"的入口,不是天梯。表按记录条数降序——那是我们有多少观测, 不是谁更快。显存够不够跑某个模型,去能不能跑问;想看记录本身,去 Benchmark。
全部硬件
10 个取值 · 72 条记录这是库里有记录的全部硬件。点一个进去,就是它自己的页面:在这张卡上跑过的模型、各自的证据级别,以及我们没有收录的组合。
| 硬件 | decode 中位 | 区间 | 记录数 | 证据 |
|---|---|---|---|---|
| Apple M3 Max · 128G 统一内存 | 28.9tok/sn=123 | 8.7 – 70.5tok/s | 11条占 15% | L1 已复现 |
| RX 7900 GRE · 未归一化 | 46.4tok/sn=88 | 41.2 – 96.1tok/s | 10条占 14% | L1 已复现 |
| M2 Ultra · 未归一化 | 40.9tok/sn=80 | 17.7 – 109.8tok/s | 8条占 11% | L1 已复现 |
| NVIDIA RTX 3090 · 24G | 73.2tok/sn=74 | 48.2 – 109.8tok/s | 7条占 10% | L0 自报 |
| RTX 3060 · 未归一化 | 29.8tok/sn=51 | 25.5 – 55.6tok/s | 7条占 10% | L2 跨框架已验证 |
| RTX 4080 SUPER · 未归一化 | 57.9tok/sn=66 | 39.5 – 113.6tok/s | 7条占 10% | L0 自报 |
| Arc A770 · 未归一化 | 57.5tok/sn=60 | 33.7 – 87.6tok/s | 6条占 8% | L1 已复现 |
| NVIDIA RTX 4090 · 24G | 77.6tok/sn=56 | 62.5 – 155.5tok/s | 6条占 8% | L2 跨框架已验证 |
| RX 7800 XT · 未归一化 | 49.5tok/sn=68 | 44.6 – 85.4tok/s | 6条占 8% | L2 跨框架已验证 |
| AMD Radeon RX 7900 XTX · 24G | 107.0tok/sn=48 | 37.2 – 169.3tok/s | 4条占 6% | L0 自报 |