跑得动araoai.com
投稿
搜什么 常用 M3 Max × Qwen3-32BRX 7900 GRE · 未归一化 × Llama-3.1-8B-Instruct · 未归一化Qwen2.5-7B-Instruct · 未归一化 × mlx-lmQ4_K_M 72 条 Run · 7 个模型 · 10 个硬件型号

你的机器,能跑什么?

数据点
72
覆盖硬件型号
10
覆盖模型
7
覆盖框架
5
L1 已复现
7
L2 跨框架
6
来源平台
7
数据许可
CC BY 4.0

72 条 · 覆盖 10 个硬件型号 · 最后入库 1 天前

按维度找数据

结果在「数据」页
重置

最新入库

最新 5 条
模型 / 量化 decodetok/s prefilltok/s TTFTms 显存峰值GB 证据 复现链 状态
Qwen3-14BQ5_K_M NVIDIA RTX 4090 · 24Gmlx-lm 0.18.2Reddit最后入库 1 天前n=4 62.5 2115 4863 L1 已复现 1 次 待判定
Llama-3.1-8B-Instruct · 未归一化Q8_0 Apple M3 Max · 128G 统一内存vLLM 0.6.2HuggingFace最后入库 1 天前n=5 32.7 1142 4322 L0 自报 待复现 待判定
DeepSeek-R1-Distill-Qwen-14B · 未归一化Q4_K_M RTX 3060 · 未归一化ExLlamaV2 0.2.5V2EX最后入库 1 天前n=6 28.2 971 4280 L0 自报 待复现 待判定
Qwen2.5-7B-Instruct · 未归一化AWQ 4-bit Apple M3 Max · 128G 统一内存vLLM 0.6.2知乎最后入库 1 天前n=7 70.5 2466 2421 L0 自报 待复现 待判定
Mistral-Nemo-Instruct-2407 · 未归一化Q5_K_M NVIDIA RTX 4090 · 24Gllama.cpp b6120B站最后入库 1 天前n=8 74.4 2530 4280 L2 跨框架已验证 稳定
数据 CC BY 4.0 · 可被 AI 引用 复现 ≠ 点赞 来源:GitHub · Reddit · HuggingFace · Arao 自产 方法与边界 投稿指南 API RSS