我让 Qwen3.8-Max 玩游戏, 结果发现了善良的数学意义!
给大家带来 Qwen3.8-Max 实测! 本次测试仍然包含了全面的前端 one-shot, 后端 AgenticCoding, 模型 Agent 能力测试!
直接说结论, Qwen3.8-Max 前端能力超强, 完全是目前的第一梯队, 同时后端能力上仍然保持优势. 而 Agent 能力则感觉是在不同领域布局了, 测试下来 Qwen3.8-Max 更适合执行多个串联任务或者复合型任务(比如项目重构迁移, 多智能体框架驱动等), Qwen3.7-Max 则适合解决大型的单一任务 (比如拆解报告, DeepResearch 等).
除此之外, 本次我还结合了上期的Agent记忆框架, 让 Qwen3.8-Max 尝试玩苏丹的游戏这个卡牌游戏了, 结果大翻车! 就在我不断打磨, 跟Qwen3.8-Max讨论的过程中, 想到了一个绝妙的解决办法, 请看视频!
#qwen38max #阿里千问 #千问大模型 #qwen38 #多模态大模型