放个预告,正在给大家准备大横评,包含: Qwen3.6-27B Qwen3.6-35b-A3B Gemma4-31B Gemma4-26B-A4B Gemma4-12B GPT-OSS-20B Qwen3.8-27B.
每个模型会测试3bit,4bit,5bit,8bit.
然后 Qwen3.8-27B 还会测试 --reasoning-effort minimal|low|medium|high|xhigh|max 6档思考强度。
给本地部署爱好者一个全量参考。解答几个问题,比如:
Qwen3.8-27B 3bit 量化会比 Qwen3.6-27B 4bit 量化强吗? Qwen3.8-27B 几个思考强度差距大吗? Qwen3.8-27B 断崖领先吗? Qwen3.8-27B Agent 能力怎么样? 这些用哪个写代码最好?
目前正在用本地的Apple M2 Ultra + 租了个H100正在测。应该本周能发出来。