AYi@AYi_AInotes
45AI 编辑部评分,满分 100
2026-08-09 03:12· 1小时前
AI 导读

Grok 4.6即将发布,重点优化写作质量与设计品味,减少AI味。xAI与Cursor在硬能力之外转向“品味”竞争,Grok 4.5发布不到一个月即迭代,依托Cursor数百万开发者的真实交互数据快速反馈。AI竞争正从跑分转向审美与产品感等“虚”的体验维度。

Grok 4.6要来了,这个版本我们有望看到更干净的写作、更少的 AI-slop,以及生成 UI/前端时更好的默认审美。

当各家在卷大模型谁推理更强、谁coding分更高的时候, @SpaceXAI 和@cursor_ai 偷偷卷到了下一个战场,

Cursor 的模型与行为科学家@leerob 发推说, Grok在写作质量和设计品味上进步很大,并且Grok 4.6马上就来。

很多人看了没当回事, 觉得不就是写得好看点吗? 但这才是AI竞争真正变天的信号呀,

Grok 4.5 是Cursor 与 SpaceXAI联合训练的第一款模型,出来才不到一个月, coding能力和性价比已经很能打了, 正常思路应该是继续卷跑分、卷硬能力,

但他们没这么做, 转头去优化写作质量和设计品味去了。

这两个词听起来很虚, 但你天天用AI就知道, 这才是最影响体验的东西。

现在所有大模型写代码都能写对, 但写出来的东西, 那个感觉就是不一样。

有的模型给你写个前端, 代码是能跑, 但按钮的位置、颜色、间距, 怎么看怎么丑, 一股模板味;

有的模型给你写文案, 语法全对,逻辑也通顺, 但读起来就是像机器人, 全是正确的废话, 没有一点人味。

这就是品味的差距, 硬能力决定了它能不能把事做对, 品味决定了你愿不愿意天天用它。

以前大家觉得AI只要聪明就行, 现在发现, 聪明只是及格线, 有没有审美,有没有判断力, 写出来的东西像不像一个有经验的高级同事做的, 才是真正拉开差距的地方。

为什么是xAI和Cursor先提这个? 因为Cursor手里有几百万开发者每天真实的交互数据。

他们最清楚, 用户现在吐槽最多的早就不是"AI写不对代码"了, 是"写出来的东西太丑"、"文案太AI"、"没有产品感"。

这些东西在benchmark上考不出来, 但在真实使用里, 每一次都在影响你的感受。

而且你看这个迭代速度, 4.5到4.6不到一个月, 还公开在X上要反馈。

这根本不是以前大模型半年憋一个大版本的节奏了, 完全是互联网产品的迭代速度, 预训练完了就用真实用户的反馈做后训练,

一周一个小版本, 一月一个中版本, 哪里不好改哪里。 这个快节奏, 比一次憋个大的吓人多了。

所以接下来我们会看到, 大模型的竞争会越来越"虚"。

卷谁更会写文章, 谁做的UI更好看, 谁说话更像人, 谁更有产品感, 谁能在你还没说出口的时候就知道, 并满足你想要什么,

硬能力大家都会追上来, 最后留下来的差别, 全是这些"虚"的东西。

Grok 4.6应该很快就推了, 到时候可以重点试试, 它写出来的东西是不是真的没有那股AI味了~

Lee RobinsonWe're making great progress on improving the writing quality and design taste of Grok. Still a lot more to do, but I'm encouraged by how quickly we're iterating...

来源:AYi · x.com

AYi · @AYi_AInotes · X·2026-08-09 03:12·1小时前
AI 导读

Grok 4.6即将发布,重点优化写作质量与设计品味,减少AI味。xAI与Cursor在硬能力之外转向“品味”竞争,Grok 4.5发布不到一个月即迭代,依托Cursor数百万开发者的真实交互数据快速反馈。AI竞争正从跑分转向审美与产品感等“虚”的体验维度。

Grok 4.6要来了,这个版本我们有望看到更干净的写作、更少的 AI-slop,以及生成 UI/前端时更好的默认审美。

当各家在卷大模型谁推理更强、谁coding分更高的时候, @SpaceXAI 和@cursor_ai 偷偷卷到了下一个战场,

Cursor 的模型与行为科学家@leerob 发推说, Grok在写作质量和设计品味上进步很大,并且Grok 4.6马上就来。

很多人看了没当回事, 觉得不就是写得好看点吗? 但这才是AI竞争真正变天的信号呀,

Grok 4.5 是Cursor 与 SpaceXAI联合训练的第一款模型,出来才不到一个月, coding能力和性价比已经很能打了, 正常思路应该是继续卷跑分、卷硬能力,

但他们没这么做, 转头去优化写作质量和设计品味去了。

这两个词听起来很虚, 但你天天用AI就知道, 这才是最影响体验的东西。

现在所有大模型写代码都能写对, 但写出来的东西, 那个感觉就是不一样。

有的模型给你写个前端, 代码是能跑, 但按钮的位置、颜色、间距, 怎么看怎么丑, 一股模板味;

有的模型给你写文案, 语法全对,逻辑也通顺, 但读起来就是像机器人, 全是正确的废话, 没有一点人味。

这就是品味的差距, 硬能力决定了它能不能把事做对, 品味决定了你愿不愿意天天用它。

以前大家觉得AI只要聪明就行, 现在发现, 聪明只是及格线, 有没有审美,有没有判断力, 写出来的东西像不像一个有经验的高级同事做的, 才是真正拉开差距的地方。

为什么是xAI和Cursor先提这个? 因为Cursor手里有几百万开发者每天真实的交互数据。

他们最清楚, 用户现在吐槽最多的早就不是"AI写不对代码"了, 是"写出来的东西太丑"、"文案太AI"、"没有产品感"。

这些东西在benchmark上考不出来, 但在真实使用里, 每一次都在影响你的感受。

而且你看这个迭代速度, 4.5到4.6不到一个月, 还公开在X上要反馈。

这根本不是以前大模型半年憋一个大版本的节奏了, 完全是互联网产品的迭代速度, 预训练完了就用真实用户的反馈做后训练,

一周一个小版本, 一月一个中版本, 哪里不好改哪里。 这个快节奏, 比一次憋个大的吓人多了。

所以接下来我们会看到, 大模型的竞争会越来越"虚"。

卷谁更会写文章, 谁做的UI更好看, 谁说话更像人, 谁更有产品感, 谁能在你还没说出口的时候就知道, 并满足你想要什么,

硬能力大家都会追上来, 最后留下来的差别, 全是这些"虚"的东西。

Grok 4.6应该很快就推了, 到时候可以重点试试, 它写出来的东西是不是真的没有那股AI味了~

Lee RobinsonWe're making great progress on improving the writing quality and design taste of Grok. Still a lot more to do, but I'm encouraged by how quickly we're iterating...

来源:AYi· x.com