最佳本地聊天模型 — RTX 5090 32GB

甜点区间:60–60 分 · 60.3–60.3 tok/s,共 2 个模型符合。

  1. 1. Qwen3.6 27B — 60 分 · 60.3tok/s · 17.6GB · AA 37.7
  2. 2. Qwen3.8 27B — 60 分 · 60.3tok/s · 17.9GB
  3. 3. Muse Glimmer 30B — 56 分 · 47.6tok/s · 20.1GB · AA 35
  4. 4. Qwen3.6 35B-A3B — 51 分 · 212.1tok/s · 23GB · AA 32.1
  5. 5. GLM-4.7-Flash — 48 分 · 212.1tok/s · 19.2GB · AA 30

共 11 个装得下的可用模型。← RTX 5090 全部能力