karminski-牙医@karminski3
62AI 编辑部评分,满分 100
2026-08-06 13:10· 9分钟前
AI 导读

博主实测 Qwen3.8-Max,其前端能力达第一梯队,后端能力保持优势。Agent 能力上,Qwen3.8-Max 更适合串联或复合型任务(如项目重构、多智能体驱动),Qwen3.7-Max 则擅长大型单一任务(如拆解报告、DeepResearch)。此外,结合记忆框架让其玩卡牌游戏《苏丹的游戏》时翻车,博主在讨论中想出解决办法。

我让 Qwen3.8-Max 玩游戏, 结果发现了善良的数学意义!

给大家带来 Qwen3.8-Max 实测! 本次测试仍然包含了全面的前端 one-shot, 后端 AgenticCoding, 模型 Agent 能力测试!

直接说结论, Qwen3.8-Max 前端能力超强, 完全是目前的第一梯队, 同时后端能力上仍然保持优势. 而 Agent 能力则感觉是在不同领域布局了, 测试下来 Qwen3.8-Max 更适合执行多个串联任务或者复合型任务(比如项目重构迁移, 多智能体框架驱动等), Qwen3.7-Max 则适合解决大型的单一任务 (比如拆解报告, DeepResearch 等).

除此之外, 本次我还结合了上期的Agent记忆框架, 让 Qwen3.8-Max 尝试玩苏丹的游戏这个卡牌游戏了, 结果大翻车! 就在我不断打磨, 跟Qwen3.8-Max讨论的过程中, 想到了一个绝妙的解决办法, 请看视频!

#qwen38max #阿里千问 #千问大模型 #qwen38 #多模态大模型

来源:karminski-牙医 · x.com

karminski-牙医 · @karminski3 · X·2026-08-06 13:10·9分钟前
AI 导读

博主实测 Qwen3.8-Max,其前端能力达第一梯队,后端能力保持优势。Agent 能力上,Qwen3.8-Max 更适合串联或复合型任务(如项目重构、多智能体驱动),Qwen3.7-Max 则擅长大型单一任务(如拆解报告、DeepResearch)。此外,结合记忆框架让其玩卡牌游戏《苏丹的游戏》时翻车,博主在讨论中想出解决办法。

我让 Qwen3.8-Max 玩游戏, 结果发现了善良的数学意义!

给大家带来 Qwen3.8-Max 实测! 本次测试仍然包含了全面的前端 one-shot, 后端 AgenticCoding, 模型 Agent 能力测试!

直接说结论, Qwen3.8-Max 前端能力超强, 完全是目前的第一梯队, 同时后端能力上仍然保持优势. 而 Agent 能力则感觉是在不同领域布局了, 测试下来 Qwen3.8-Max 更适合执行多个串联任务或者复合型任务(比如项目重构迁移, 多智能体框架驱动等), Qwen3.7-Max 则适合解决大型的单一任务 (比如拆解报告, DeepResearch 等).

除此之外, 本次我还结合了上期的Agent记忆框架, 让 Qwen3.8-Max 尝试玩苏丹的游戏这个卡牌游戏了, 结果大翻车! 就在我不断打磨, 跟Qwen3.8-Max讨论的过程中, 想到了一个绝妙的解决办法, 请看视频!

#qwen38max #阿里千问 #千问大模型 #qwen38 #多模态大模型

来源:karminski-牙医· x.com