Yuchen Jin · @Yuchenj_UW · X·2026-08-25 01:35·15小时前
AI 导读

我越是使用前沿模型,就越不相信存在一个模型能统治一切。 - Opus 5:最擅长用生成的 HTML 教我东西,但冗长且潦草。 - GPT-5.6 Sol:后端很强,前端较弱。 - Kimi K3 / GLM-5.2:日常编码中 90% 的场景便宜又高效,但在写内核这类 AI 研究任务上较弱。 每个实验室都在为 AGI 而训练。但今天的 LLM 仍然是专才。

Yuchen Jin@Yuchenj_UW
47AI 编辑部评分,满分 100
2026-08-25 01:35· 15小时前
AI 导读

我越是使用前沿模型,就越不相信存在一个模型能统治一切。 - Opus 5:最擅长用生成的 HTML 教我东西,但冗长且潦草。 - GPT-5.6 Sol:后端很强,前端较弱。 - Kimi K3 / GLM-5.2:日常编码中 90% 的场景便宜又高效,但在写内核这类 AI 研究任务上较弱。 每个实验室都在为 AGI 而训练。但今天的 LLM 仍然是专才。

The more I use frontier models, the less I believe in one model to rule them all.

• Opus 5: best at teaching me with generated html, but verbose and sloppy. • GPT-5.6 Sol: great backend, weak frontend. • Kimi K3 / GLM-5.2: cheap and efficient for 90% of day-to-day coding, but weaker at AI research tasks like writing kernels.

Every lab is training for AGI. But today’s LLMs are still specialists.

来源:Yuchen Jin· x.com