Qwen3.8-27B 小模型 Agent 能力测试天梯

karminski-牙医 · @karminski3 · X·2026-08-31 16:26·58分钟前
AI 导读

karminski 发布小模型 Agent 能力测试天梯,最推荐 Qwen3.8-27B-UD-Q4_K_XL 版本,Agent 用 reasoning_effort=low,写代码开到 medium/high。测试统一使用单卡 H100 NVL+llama.cpp 最新版,Mac 用户建议优先用 MLX,实测其开 MTP 比 llama.cpp 更快。

karminski-牙医@karminski3
42AI 编辑部评分,满分 100

Qwen3.8-27B 小模型 Agent 能力测试天梯

2026-08-31 16:26· 58分钟前
AI 导读

karminski 发布小模型 Agent 能力测试天梯,最推荐 Qwen3.8-27B-UD-Q4_K_XL 版本,Agent 用 reasoning_effort=low,写代码开到 medium/high。测试统一使用单卡 H100 NVL+llama.cpp 最新版,Mac 用户建议优先用 MLX,实测其开 MTP 比 llama.cpp 更快。

小模型 Agent 能力测试的天梯在这里~ (希望图不要被压得太狠....)

目前来看最值得使用是我测试的 Qwen3.8-27B-UD-Q4_K_XL 版本, Agent 用使用 reasoning_effort = low, 然后写代码开到 medium / high.

另外文中是统一使用单卡 H100 NVL+llama.cpp 最新版本测试的. 如果是Mac用户还是建议优先使用MLX, 实测 MLX 开 MTP 会比 llama.cpp 放在 Mac 上开MTP要快一些.

最后老铁们还想看什么模型的评测欢迎留言~ 我赶紧肝哈哈

#qwen38

来源:karminski-牙医· x.com