最佳本地聊天模型 — RTX 5070 Ti 16GB
甜点区间:60–60 分 · 39.4–39.4 tok/s,共 2 个模型符合。
- 1. Qwen3.6 27B — 60 分 · 39.4tok/s · 14.4GB · AA 37.7
- 2. Qwen3.8 27B — 60 分 · 39.4tok/s · 14.6GB
- 3. Muse Glimmer 30B — 56 分 · 36tok/s · 14.3GB · AA 35
- 4. GLM-4.7-Flash — 48 分 · 150tok/s · 15.5GB · AA 30
- 5. Ling 3.0 Tiny — 39 分 · 150tok/s · 9GB · AA 24.5
共 7 个装得下的可用模型。← RTX 5070 Ti 全部能力