最佳本地聊天模型 — Apple M5 26GB

甜点区间:75–75 分 · 6.1–6.1 tok/s,共 1 个模型符合。

  1. 1. Qwen3.8 27B — 75 分 · 6.1 tok/s · 14.6GB
  2. 2. Qwen3.6 27B — 72 分 · 6.1 tok/s · 14.4GB · AA 38
  3. 3. Gemma 4 31B — 63 分 · 5.5 tok/s · 15.6GB · AA 30
  4. 4. Muse Glimmer 30B — 56 分 · 5.6 tok/s · 14.3GB · AA 35
  5. 5. Gemma 4 26B-A4B — 56 分 · 34.3 tok/s · 17.7GB · AA 26

共 14 个装得下的可用模型。← Apple M5 全部能力

常见问题

Apple M5 上跑聊天模型最好的是哪个?

Qwen3.8 27B,75 分,6.1 tok/s,占用 14.6GB(Apple M5 共 26GB)。

Apple M5 上速度最快的是哪个?

BTL 3,82.2 tok/s,44 分,占用 1.4GB。分数最高的不一定最快——这台机器上两者是不同的模型。

显存/内存最省的是哪个?

BTL 3,只要 1.4GB,44 分。

有哪些模型这台机器装不下?

22 个,例如 Qwen3.6 35B-A3B(需 23GB)、Ornith 1.5 35B-A3B(需 22.9GB)、Nemotron 3.5 Lightning 30B-A3B(需 26.2GB)。