甜点区间:81–81 分 · 6.1–6.1 tok/s,共 1 个模型符合。
共 6 个装得下的可用模型。← Apple M5 全部能力
Qwen3.8 27B,81 分,6.1 tok/s,占用 14.6GB(Apple M5 共 26GB)。
gpt-oss-20b,40 tok/s,55 分,占用 12.9GB。分数最高的不一定最快——这台机器上两者是不同的模型。
gpt-oss-20b,只要 12.9GB,55 分。
5 个,例如 DeepSeek V4-Flash 284B-A13B(需 170.9GB)、Qwen3.6 35B-A3B(需 23GB)、Ornith 1.5 35B-A3B(需 22.9GB)。