最佳本地聊天模型 — Apple M5 26GB
甜点区间:75–75 分 · 6.1–6.1 tok/s,共 1 个模型符合。
- 1. Qwen3.8 27B — 75 分 · 6.1 tok/s · 14.6GB
- 2. Qwen3.6 27B — 72 分 · 6.1 tok/s · 14.4GB · AA 38
- 3. Gemma 4 31B — 63 分 · 5.5 tok/s · 15.6GB · AA 30
- 4. Muse Glimmer 30B — 56 分 · 5.6 tok/s · 14.3GB · AA 35
- 5. Gemma 4 26B-A4B — 56 分 · 34.3 tok/s · 17.7GB · AA 26
共 14 个装得下的可用模型。← Apple M5 全部能力
常见问题
Apple M5 上跑聊天模型最好的是哪个?
Qwen3.8 27B,75 分,6.1 tok/s,占用 14.6GB(Apple M5 共 26GB)。
Apple M5 上速度最快的是哪个?
BTL 3,82.2 tok/s,44 分,占用 1.4GB。分数最高的不一定最快——这台机器上两者是不同的模型。
显存/内存最省的是哪个?
BTL 3,只要 1.4GB,44 分。
有哪些模型这台机器装不下?
22 个,例如 Qwen3.6 35B-A3B(需 23GB)、Ornith 1.5 35B-A3B(需 22.9GB)、Nemotron 3.5 Lightning 30B-A3B(需 26.2GB)。