Grok 4.5正式发布:首个编码与智能体专用模型,定价仅为Claude Opus四分之一

AYi · @AYi_AInotes · X·2026-07-09 09:48·47天前
AI 导读

Grok 4.5今日正式发布,是SpaceXAI首个专为编码和智能体训练的模型,通过Cursor训练。输入定价2美元、输出6美元,分别为Claude Opus的五分之二和四分之一;单任务token效率提升4.2倍,推理速度更快。该模型不追求通用榜单第一,而是瞄准真实生产场景,背后依托Cursor生态、SpaceX/特斯拉内部工程数据形成闭环。定价将顶级工程能力从企业级降至个人开发者可负担水平,计划每月发布一个新模型,推动智能体AI从Demo走向大规模落地。

AYi@AYi_AInotes
69AI 编辑部评分,满分 100

Grok 4.5正式发布:首个编码与智能体专用模型,定价仅为Claude Opus四分之一

2026-07-09 09:48· 47天前
AI 导读

Grok 4.5今日正式发布,是SpaceXAI首个专为编码和智能体训练的模型,通过Cursor训练。输入定价2美元、输出6美元,分别为Claude Opus的五分之二和四分之一;单任务token效率提升4.2倍,推理速度更快。该模型不追求通用榜单第一,而是瞄准真实生产场景,背后依托Cursor生态、SpaceX/特斯拉内部工程数据形成闭环。定价将顶级工程能力从企业级降至个人开发者可负担水平,计划每月发布一个新模型,推动智能体AI从Demo走向大规模落地。

说个暴论,今天之后前沿大模型的战争已经彻底换赛道了,顶级工程能力的边际成本,今天被彻底打穿了!🤯

Grok 4.5 今天正式发布,直接掀翻了前沿大模型的定价桌子。

对标 Claude Opus 级别的编码与智能体能力,输入定价仅为后者五分之二,输出定价仅为其四分之一,

叠加 4.2 倍的单任务 token 效率提升,再加上更快的推理速度,没有死磕通用榜单第一,直接在开发者最买单的真实生产场景里,扔下了一枚性价比核弹。

这不只是单模型的胜利,更是垂直整合闭环的胜利,背后站着的也不再是孤军奋战的@elonmusk 的XAI实验室,还有SpaceXAI 的模型能力,加 Cursor 的开发者工具生态,加 SpaceX 特斯拉海量内部工程场景的三位一体飞轮,

开发者工具提供真实交互数据反哺训练,场景验证真实需求分布,模型持续迭代优化,这种闭环比单纯堆参数刷通用榜单难复制得多,也更贴近真实生产力落地。

但绝大多数人没看懂,token 效率才是智能体时代的真正杀手锏。

大多数人只会盯着基准分数的高低较劲,却忽略了效率叠加低价的复合效应,单次问答看起来差距甚微,但在多步工具调用自我修正的完整智能体工作流里,token 消耗直接等于延迟与真金白银的成本,跑完整端到端工程项目,

Grok 4.5 的实际花费可能只有 Opus 方案的十分之一,速度优势更是碾压级,这对生产部署的意义,远大于跑分多几个百分点。

顶级工程能力的边际成本,今天被彻底打穿了, 2 美元输入 6 美元输出的定价,第一次把顶级编码与智能体能力,从企业级奢侈品降到了个人开发者和小团队可以放开用的价位,这会直接加速智能体 AI 从演示 demo 走向大规模生产落地,也必然倒逼头部厂商在短期内跟进调价,前沿大模型的价格战,今天才算真正拉开序幕。

更恐怖的是迭代加速度,SpaceX 今年计划每月发布一款从头训练的新模型,内部海量工程数据的持续喂养,会让它的进化速度甩开传统实验室的节奏。

我觉得这件事最本质的意义,是 AI 行业的竞争逻辑正在悄然转向, 它不再是堆出一个全能的通用神坛模型,而是在最高价值的垂直赛道里,做到够用的智能,加极致的效率,加亲民的价格,

大多数开发者日常 80% 的需求,从来不是解出世界最难的题,而是可靠地写代码调 bug 搭系统,Grok 4.5 精准命中了这个痛点。

当顶级工程能力的边际成本被彻底打穿,下一波 AI 生产力的爆发,会不会比所有人预想的都要早呢?

SpaceXAIAnnouncing Grok 4.5, our first model trained specifically for coding and agents. It was trained with Cursor and offers frontier intelligence at leading speeds a...