RX 7900 GRE · 未归一化在我们记录里的实测
关于这台机器,我们收录了 10 条记录。 这一页把它们摊开:中位吞吐与区间、每一行的样本量与证据级别,以及我们没有收录的组合 ——缺的那些我们不会替你补一个数字。
在当前记录里,RX 7900 GRE · 未归一化 的解码吞吐中位数是 46.4 tok/s (41.2 – 96.1,n=88,共 10 条记录), 最高证据级别是 L1 已复现。
在这些模型里,Qwen2.5-7B-Instruct · 未归一化 的中位数最高(中位 96.1 tok/s, n=5,证据 L0)。 这是表里数字的高低,不是我们在替你选——样本量、量化档、框架都不同,能核对的都在表里。
模型 × 这台机器
6 个模型 · 10 条记录同一台机器上不同模型之间的数字也不是同一件事:量化档、框架、上下文长度都会影响结果。 这张表只回答「我们在这个组合上测到过什么」。
行按记录条数降序排列——条数是「我们有多少条观测」,不是「谁更强」:不同模型之间的量化档、框架、上下文长度都不一样。每一行的 n= 是那一格参与统计的样本量之和;没有有效样本量的格子不渲染数字,渲染 ———— 是"我们不知道",不是 0。
| 模型 | decode 中位 | 区间 | 记录数 | 证据 |
|---|---|---|---|---|
| Llama-3.1-8B-Instruct · 未归一化 | 60.6tok/sn=30 | 41.2 – 77.8tok/s | 3条占 30% | L0 自报 |
| Mistral-Nemo-Instruct-2407 · 未归一化 | 51.9tok/sn=23 | 47.6 – 56.1tok/s | 2条占 20% | L1 已复现 |
| Qwen3-14B14B | 43.0tok/sn=15 | 41.7 – 44.4tok/s | 2条占 20% | L0 自报 |
| DeepSeek-R1-Distill-Qwen-14B · 未归一化 | 42.2tok/sn=5 | 42.2 – 42.2tok/s | 1条占 10% | L0 自报 |
| phi-4 · 未归一化 | 45.1tok/sn=10 | 45.1 – 45.1tok/s | 1条占 10% | L0 自报 |
| Qwen2.5-7B-Instruct · 未归一化 | 96.1tok/sn=5 | 96.1 – 96.1tok/s | 1条占 10% | L0 自报 |
表里没有 Qwen3-32B:我们还没收录这个组合。 「没有数据」不等于「跑不动」——前者是我们还没收录,后者是有证据表明显存不够。 把前者读成后者,就是拿记录的沉默冒充站方的结论。这不是模型的问题,是我们的缺口。
全部实测记录
含跑不通的phi-4 · 未归一化Q4_K_M ExLlamaV2 0.2.5GitHub最后入库 1 天前n=10 45.1 1554 4280 — L0 自报 待复现 稳定
「稳定」已被独立来源复现过,当前没有已知分歧。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
985fffc75c709be230923d65ed466d222c60d67174e5a09d11f0c13731937736快照长度 100 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Mistral-Nemo-Instruct-2407 · 未归一化AWQ 4-bit ExLlamaV2 0.2.5B站最后入库 1 天前n=7 56.1 1934 3592 — L1 已复现 1 次 待判定
「待判定」只有一次或单一来源的读数,还没等到独立复现。数字照常可用,但按 L0/L1 对待。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
c8d01e539905226f362f044339ec311ced35f1c4ab1aee3ed2d8f6a969932feb快照长度 120 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Llama-3.1-8B-Instruct · 未归一化Q6_K vLLM 0.6.2V2EX最后入库 1 天前n=4 60.6 2119 3530 — L0 自报 待复现 待判定
「待判定」只有一次或单一来源的读数,还没等到独立复现。数字照常可用,但按 L0/L1 对待。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
0801fec71022a8416d6443e20b83f5d03295d70aabaceddd4241e0007b7ac338快照长度 103 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
DeepSeek-R1-Distill-Qwen-14B · 未归一化AWQ 4-bit ollama 0.5.1B站最后入库 1 天前n=5 42.2 1410 4061 — L0 自报 待复现 待判定
「待判定」只有一次或单一来源的读数,还没等到独立复现。数字照常可用,但按 L0/L1 对待。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
bf966187ee370e84f59f94b2835d3d135d11d2e9b91333740a39d4da026bdf46快照长度 121 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Qwen3-14BQ4_K_M mlx-lm 0.18.2GitHub最后入库 1 天前n=7 41.7 1410 4280 — L0 自报 待复现 待判定
「待判定」只有一次或单一来源的读数,还没等到独立复现。数字照常可用,但按 L0/L1 对待。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
1704504f701d191f7d18e823cc906bd1cece4cd8f4b5c6101ce1b305a49bb8d1快照长度 94 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Qwen3-14BAWQ 4-bit mlx-lm 0.18.2Reddit最后入库 1 天前n=8 44.4 1504 4061 — L0 自报 待复现 稳定
「稳定」已被独立来源复现过,当前没有已知分歧。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
9cbe1e2594572e05305fcabee9820cb024b24ebb7ef783ef817de730cf8e7342快照长度 96 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Mistral-Nemo-Instruct-2407 · 未归一化Q5_K_M vLLM 0.6.2HuggingFace最后入库 1 天前n=16 47.6 1665 4280 — L0 自报 待复现 稳定
「稳定」已被独立来源复现过,当前没有已知分歧。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
db42efa2fb35a72b56eb36f108a8db3cfb293372ddf9a511d76d3ef02ccdde5b快照长度 116 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Llama-3.1-8B-Instruct · 未归一化AWQ 4-bit mlx-lm 0.18.2V2EX最后入库 1 天前n=17 77.8 2632 2655 — L0 自报 待复现 稳定
「稳定」已被独立来源复现过,当前没有已知分歧。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
4d0bd5dd22b4397ecae0529099cfca76f83a50f10a2caf499d102fe190c25c96快照长度 107 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Qwen2.5-7B-Instruct · 未归一化AWQ 4-bit ExLlamaV2 0.2.5Arao 自产最后入库 1 天前n=5 96.1 3315 2421 — L0 自报 待复现 待判定
「待判定」只有一次或单一来源的读数,还没等到独立复现。数字照常可用,但按 L0/L1 对待。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
3a771ac4b5cf3f32ac02b0a97bccfe93c5ee2516c97bdeed1fba31c635334e20快照长度 109 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
Llama-3.1-8B-Instruct · 未归一化Q8_0 mlx-lm 0.18.2V2EX最后入库 1 天前n=9 41.2 1393 4322 — L0 自报 待复现 稳定
「稳定」已被独立来源复现过,当前没有已知分歧。
复现链从这条记录出发,每格是一次独立来源的复现。空链条表示还没有复现记录,不是我们没有记。
要和另一条记录直接比较,这几项得一样:模型 · 量化 · 框架(含版本) · 上下文长度 · 硬件 · batch · 并发数。少一项就只能当数量级参考——差额可能来自那一项,而不是你想比的东西。
完整配置 · 来源 · 复现链 16 项
eb04af7fe0acbc6eb8ff9ffac17aaae4cd7037175e3a8e702ffff6312e96568e快照长度 103 字符(按码点计)我们存下了抓取那一刻的原文副本与内容哈希,但不转载原文:本站只取事实(数字),不取表达。来源被删除或改版之后,我们可以拿哈希说明「当时读到的就是这段文本」,但不能说明它现在还在。
目前没有断言引用这条记录
高级元数据 5 项
接着看
这台机器在站内的其他入口这一页怎么算的
三件我们不做的事-
只列有记录的模型。这台机器上某个模型一条记录都没有时,表里没有这一行,
我们只会在表下把它点名——不会渲染一个
0, 也不会把它写进「跑不动」那一类。那是两件事:前者是我们还没收录,后者是有证据表明显存不够。 - 「跑不动」也是一条记录。下面那张完整表里,标着「跑不动」的行照常渲染, 并带着自己的证据级别——把它们藏起来等于只给你看赢的那些,那不叫数据。
- 不给"该跑哪个模型"这类排序。表按记录条数降序(那是"我们有多少观测"); 「中位数最高」那种句子是可核对的陈述。同一台机器上不同模型之间的量化档、框架、 上下文长度都不一样,所以"哪个更好"这种问题我们不答——记录里没有能力字段,答了就是编。