最佳本地编码模型 — RTX 5090 32GB

甜点区间:73–77 分 · 60.3–212.1 tok/s,共 2 个模型符合。

  1. 1. Qwen3.6 27B — 77 分 · 60.3tok/s · 17.6GB
  2. 2. Qwen3.6 35B-A3B — 73 分 · 212.1tok/s · 23GB
  3. 3. Qwen3.5 27B — 72 分 · 62.1tok/s · 17.5GB
  4. 4. Qwen3.5 35B-A3B — 69 分 · 212.1tok/s · 22.9GB
  5. 5. Devstral Small 2 24B — 68 分 · 69.9tok/s · 14.9GB

共 7 个装得下的可用模型。← RTX 5090 全部能力