最佳本地编码模型 — RTX 5090 32GB
甜点区间:81–81 分 · 60.3–60.3 tok/s,共 1 个模型符合。
- 1. Qwen3.8 27B — 81 分 · 60.3 tok/s · 17.3GB
- 2. Qwen3.6 27B — 77 分 · 60.3 tok/s · 17.6GB
- 3. Qwen3.6 35B-A3B — 73 分 · 212.1 tok/s · 23GB
- 4. Ornith 1.5 35B-A3B — 73 分 · 212.1 tok/s · 22.9GB
- 5. Qwen3.5 27B — 72 分 · 62.1 tok/s · 17.5GB
共 9 个装得下的可用模型。← RTX 5090 全部能力
常见问题
RTX 5090 上跑编码模型最好的是哪个?
Qwen3.8 27B,81 分,60.3 tok/s,占用 17.3GB(RTX 5090 共 32GB)。
RTX 5090 上速度最快的是哪个?
Qwen3.6 35B-A3B,212.1 tok/s,73 分,占用 23GB。分数最高的不一定最快——这台机器上两者是不同的模型。
显存/内存最省的是哪个?
gpt-oss-20b,只要 12.9GB,55 分。
有哪些模型这台机器装不下?
2 个,例如 DeepSeek V4-Flash 284B-A13B(需 170.9GB)、Qwen3-Coder-Next 80B-A3B(需 99.3GB)。