Arao AI本地 AI 部署实测数据库

搜索实测数据

筛选

模型
硬件
框架
量化
证据等级

结果

共 6 个配置组合
模型量化硬件框架DecodePrefill显存证据等级来源更新时间
Qwen3-32BQ4_K_MNVIDIA RTX 4090llama.cpp18.4216.9319.5L2 跨框架验证GitHub、Reddit2026-09-18
Qwen3-32BQ4_K_MNVIDIA RTX 4090Ollama17.4198.219.8L1 已复现V2EX2026-09-18
Qwen3-32BQ4_K_MNVIDIA RTX 3090llama.cpp12.95143.3519.5L1 已复现GitHub、Bilibili2026-09-18
Llama-3.1-8B-InstructQ5_K_MNVIDIA RTX 4060 Ti 16GBllama.cpp33.8620.46.2L1 已复现GitHub2026-09-18
Llama-3.1-8B-InstructQ4_K_MApple M3 Max(MacBook Pro 14)Ollama39.15408.855.8L1 已复现Reddit、Hugging Face2026-09-18
DeepSeek-R1-Distill-Qwen-14BAWQ-INT4NVIDIA RTX 4090vLLM63.61192.7511.1L2 跨框架验证GitHub、Hugging Face2026-09-18

一行 = 一个「模型 + 硬件 + 框架 + 量化」组合,数字是该组合下已上架记录的均值。

共 6 条 · 第 1 / 1 页