Grok 4.6 在多项基准测试中登顶
Grok 4.6 发布,多项基准登顶,价格不变。
事件全貌
SpaceXAI 发布 Grok 4.6 模型,在多项基准测试中登顶。该模型在 Artificial Analysis 智能指数上得分 61,与 GPT-5.6 Sol 并列前沿,仅次于 Anthropic 的 Claude 系列。在 GDPval-AA v2 上 Elo 达 1753,排名第一;在 AA-Briefcase、Harvey LAB 等基准中也位列第一,在 CursorBench、FrontierCode、APEX-Agents、APEX-SWE 中排名第二。
Grok 4.6 定价与 Grok 4.5 一致,为每百万 token 输入 2 美元、输出 6 美元,成本较 Claude Opus 5 和 GPT-5.6 Sol 低 60% 以上。模型已在 Cursor、grok Build、OpenRouter 全平台上线,首周提供双倍额度。
该模型针对长时间运行的智能体任务进行了强化,提升了跨代码库分析与自我验证能力,并改进了复杂交互和视觉工作。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
本事件热度走势
移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。
报道时间线
- Grok 4.6 发布:价格不变,智能跃居第一梯队
Grok 4.6 正式发布,价格与 4.5 完全一致($2/M input、$6/M output),智能大幅跃升,AA智能指数61,与 GPT-5.6 Sol Max 持平,仅比 Fable 5 低1分。模型已在 Cursor、grok Build、OpenRouter 全平台上线,首周双倍额度,并针对长运行 Agent 升级了跨代码库分析与自我验证能力。
- 剑指 GPT-5.6 Sol,SpaceXAI 发布 Grok 4.6 模型
SpaceXAI 发布 Grok 4.6,强化长时间运行的智能体任务及复杂交互和视觉工作。在综合 9 项基准测试的 Artificial Analysis Intelligence Index 上,Grok 4.6 与 GPT-5.6 Sol 取得相同成绩。
- Grok 4.6 发布,多基准登顶
Grok 4.6 是一次重大升级 🚀 它在所列出的每一项基准测试中都超越了 Grok 4.5 High,目前排名如下: 🥇 #1 GDPVal-AA v2 — 1,753 🥇 #1 AA-Briefcase — 1,577 🥇 #1 Harvey LAB — 15.8% 🥈 #2 CursorBench — 69.9% 🥈 #2 FrontierCode — 61.3% 🥈 #2 APEX-Agents — 57.5% 🥈 #2 APEX-SWE — 56.4% 它在 Artificial Analysis Intelligence Index 上以 61 分的成绩与 GPT-5.6 Sol Max 持平。 Grok 4.6 即日起在 Cursor 和 Grok Build 中可用,首周使用量翻倍。
- Grok 4.6 登顶智能前沿,智能体性能亮眼
SpaceXAI 的 Grok 4.6 在 Artificial Analysis 智能指数上得分 61,与 GPT-5.6 Sol 并列前沿,仅次于 Anthropic 的 Claude 系列。该模型智能体性能突出,GDPval-AA v2 Elo 达 1753,且定价不变($2/$6 每百万 token),成本较 Claude Opus 5 和 GPT-5.6 Sol 低 60% 以上。