最佳本地聊天模型 — NVIDIA DGX Spark 128GB
甜点区间:75–75 分 · 37.51–37.51 tok/s,共 1 个模型符合。
- 1. Qwen3.8 27B — 75 分 · 37.51 tok/s · 29.8GB
- 2. DeepSeek V4 Flash 0731 — 74 分 · 20 tok/s · 108.1GB
- 3. Qwen3.6 27B — 72 分 · 31.82 tok/s · 29.4GB · AA 38
- 4. Laguna S 2.1 — 72 分 · 2 tok/s · 97.9GB
- 5. Qwen3.6 35B-A3B — 69 分 · 218.85 tok/s · 37.8GB · AA 32
共 36 个装得下的可用模型。← NVIDIA DGX Spark 全部能力
常见问题
NVIDIA DGX Spark 上跑聊天模型最好的是哪个?
Qwen3.8 27B,75 分,37.51 tok/s,占用 29.8GB(NVIDIA DGX Spark 共 128GB)。
NVIDIA DGX Spark 上速度最快的是哪个?
Qwen3.6 35B-A3B,218.85 tok/s,69 分,占用 37.8GB。分数最高的不一定最快——这台机器上两者是不同的模型。
显存/内存最省的是哪个?
BTL 3,只要 1.4GB,44 分。
有哪些模型这台机器装不下?
没有——本站收录的该项能力模型,NVIDIA DGX Spark 全部装得下。