最佳本地聊天模型 — RTX 5070 Ti 16GB

甜点区间:60–60 分 · 39.4–39.4 tok/s,共 2 个模型符合。

  1. 1. Qwen3.6 27B — 60 分 · 39.4tok/s · 14.4GB · AA 37.7
  2. 2. Qwen3.8 27B — 60 分 · 39.4tok/s · 14.6GB
  3. 3. Muse Glimmer 30B — 56 分 · 36tok/s · 14.3GB · AA 35
  4. 4. GLM-4.7-Flash — 48 分 · 150tok/s · 15.5GB · AA 30
  5. 5. Ling 3.0 Tiny — 39 分 · 150tok/s · 9GB · AA 24.5

共 7 个装得下的可用模型。← RTX 5070 Ti 全部能力