怎么配
这个模型,在这台机器上怎么配
选好机器和模型,我们给你两套能直接照抄的方案:最快的那套和最省显存的那套。 参数逐行列出来,命令拼好给你复制。全部来自别人的实测记录,每个数字都带着证据级别与样本量。
你的机器
先选好模型
这一页回答的是「某个模型在某台机器上怎么配」,两个都得有。你已经选了<b>rx_7900_gre</b>,还差一个。我们不替你猜缺的那个——猜出来的配置不是给你的。
这一页怎么算的
- 「最快」和「最省显存」是两套建议,不是两套「都好」。最快那套按实测 decode 速度选, 最省那套按实测显存峰值选。它们经常不是同一个配置——换框架往往能更快,但显存峰值会上去。 两张卡各自写着自己是按什么选的。
-
没有样本量的数字我们不渲染,改渲染
—。一个不知道是几次跑出来的速度, 不能拿来建议你照抄。—的意思是来源没说这一项,不是「关」也不是「0」—— 反过来,「关」是一个值,那是来源明确写了关闭。 - 命令是本站按参数表拼出来的,不是来源帖子的原文。来源里通常只有半条命令行或一张截图。 所以参数相同不代表环境相同:你的驱动、系统、显存占用都会影响结果,我们不承诺你能跑到同样的速度。
- 没有驱动这一行,是我们答不了,不是我们不答。记录里只有框架与框架版本。 「哪个驱动最省事」这种问题需要驱动版本才能回答——缺的那一行就是我们的缺口清单。
- 「没有记录」不等于「跑不了」。前者是我们还没收录这个组合,后者是有证据表明它不成立。 把前者读成后者,就是拿记录的沉默冒充站方的结论。