最佳本地聊天模型 — Apple M5 Pro 64GB
甜点区间:75–75 分 · 12.3–12.3 tok/s,共 1 个模型符合。
- 1. Qwen3.8 27B — 75 分 · 12.3 tok/s · 14.6GB
- 2. Qwen3.6 27B — 72 分 · 12.3 tok/s · 14.4GB · AA 38
- 3. Qwen3.6 35B-A3B — 69 分 · 48.2 tok/s · 37.8GB · AA 32
- 4. Ornith 1.0 35B — 67 分 · 7.5 tok/s · 22.1GB
- 5. Gemma 4 31B — 63 分 · 11.1 tok/s · 15.6GB · AA 30
共 28 个装得下的可用模型。← Apple M5 Pro 全部能力
常见问题
Apple M5 Pro 上跑聊天模型最好的是哪个?
Qwen3.8 27B,75 分,12.3 tok/s,占用 14.6GB(Apple M5 Pro 共 64GB)。
Apple M5 Pro 上速度最快的是哪个?
Ornith 1.5 35B-A3B,88.7 tok/s,51 分,占用 22.9GB。分数最高的不一定最快——这台机器上两者是不同的模型。
显存/内存最省的是哪个?
BTL 3,只要 1.4GB,44 分。
有哪些模型这台机器装不下?
8 个,例如 gpt-oss-120b(需 65.3GB)、DeepSeek V4 Flash 0731(需 108.1GB)、Laguna S 2.1(需 97.9GB)。