Qwen3.8-27B
L0 自报Q6_K · llama.cpp 10453
- AMD Radeon RX 7900 GRE + NVIDIA GTX 1080Ti
- 27GB
- Ubuntu
12.53tok/s
Decode
116.21tok/s
Prefill
23GB
VRAM
- AMD
- llama.cpp
- 个人自报
基于真实运行数据,查询你硬件能跑的模型、框架、量化组合。
不只是速度,更告诉你:这条数据有多可靠,能不能直接比较,证据从哪里来。
基于真实采集的数据,展示最新的模型运行结果。
Q6_K · llama.cpp 10453
12.53tok/s
Decode
116.21tok/s
Prefill
23GB
VRAM
Q4_K_M · llama.cpp 10453
11.13tok/s
Decode
71.46tok/s
Prefill
17.2GB
VRAM
UD-Q8_K_XL · llama.cpp moecachev1.6-rc0
32.08tok/s
Decode
671.43tok/s
Prefill
60.7GB
VRAM
UD-Q8_K_XL · llama.cpp b10236
43.65tok/s
Decode
1,600.18tok/s
Prefill
44.12GB
VRAM
我们用结构化的证据体系,告诉你每条数据的可信度。
来自社区或个人发布,未经过独立验证。
社区复现,小规模独立验证,含复现次数。
同硬件 + 同模型,同量化下的多框架实测数据。