最佳本地聊天模型 — NVIDIA DGX Spark 128GB

甜点区间:75–75 分 · 37.51–37.51 tok/s,共 1 个模型符合。

  1. 1. Qwen3.8 27B — 75 分 · 37.51 tok/s · 29.8GB
  2. 2. DeepSeek V4 Flash 0731 — 74 分 · 20 tok/s · 108.1GB
  3. 3. Qwen3.6 27B — 72 分 · 31.82 tok/s · 29.4GB · AA 38
  4. 4. Laguna S 2.1 — 72 分 · 2 tok/s · 97.9GB
  5. 5. Qwen3.6 35B-A3B — 69 分 · 218.85 tok/s · 37.8GB · AA 32

共 36 个装得下的可用模型。← NVIDIA DGX Spark 全部能力

常见问题

NVIDIA DGX Spark 上跑聊天模型最好的是哪个?

Qwen3.8 27B,75 分,37.51 tok/s,占用 29.8GB(NVIDIA DGX Spark 共 128GB)。

NVIDIA DGX Spark 上速度最快的是哪个?

Qwen3.6 35B-A3B,218.85 tok/s,69 分,占用 37.8GB。分数最高的不一定最快——这台机器上两者是不同的模型。

显存/内存最省的是哪个?

BTL 3,只要 1.4GB,44 分。

有哪些模型这台机器装不下?

没有——本站收录的该项能力模型,NVIDIA DGX Spark 全部装得下。