最佳本地聊天模型 — NVIDIA DGX Spark 128GB
甜点区间:56–60 分 · 31.82–52.55 tok/s,共 2 个模型符合。
- 1. Qwen3.6 27B — 60 分 · 31.82tok/s · 29.4GB · AA 37.7
- 2. Qwen3.8 27B — 60 分 · 22.74tok/s · 29.8GB
- 3. Muse Glimmer 30B — 56 分 · 52.55tok/s · 20.1GB · AA 35
- 4. Qwen3.6 35B-A3B — 51 分 · 218.85tok/s · 37.8GB · AA 32.1
- 5. GLM-4.7-Flash — 48 分 · 33.45tok/s · 32.7GB · AA 30
共 13 个装得下的可用模型。← NVIDIA DGX Spark 全部能力