📅 2026-07-09 · 约 8 分钟阅读
Cursor 中的 Grok 4.5:可用性、定价、基准与 Composer 2.5 差异
Grok 4.5 把 Cursor 的一等模型池扩展到编程专精之外。本指南拆开官方可用性、定价、基准上下文,以及与 Composer 2.5 的实务差别。
发布了什么
Cursor 将 Grok 4.5 纳入一等模型选择,扩展了超出「编程专精」默认路线的可用权重。官方口径强调:Grok 4.5 与 Composer 2.5 是不同权重类别,Composer 2.5 仍可继续使用——不是互相替换。
对本站读者,这意味着选型问题变成:在 Cursor 里什么时候用 Grok 4.5,什么时候继续用 Composer 或其它模型,以及如何按官方标价与基准语境解读宣传分数。
可用性
Cursor 称 Grok 4.5 可在桌面端、Web、iOS、CLI 与 SDK 使用。具体入口、套餐额度与地区可用性可能随产品更新变化;把生产默认绑到某一入口前,请以 Cursor 应用内模型列表与官方公告为准。
官方模型定价
上线时 Cursor 与 SpaceXAI 列出的 Grok 4.5 基础模型价为:每 100 万输入 tokens $2、每 100 万输出 tokens $6。这是模型标价,不等于 Cursor 订阅档的全部账单结构(仍可能有请求额度、加速或套餐包)。
预算建模时请把「模型标价」与「Cursor 产品套餐」分开核对,避免把 token 价直接当成月费。
基准上下文
提供方报告的上线分数包括 DeepSWE 1.0 约 62.0%、DeepSWE 1.1 约 53%,以及 SWE Marathon 约 29.0%。这些数字只在同一基准版本与 harness 内有比较意义;跨基准或跨 harness 的「谁更强」叙述容易误导。
实务评测应在你自己的仓库任务上量:可接受 diff、测试通过率、重试次数、延迟与审阅负担——而不是只盯一张外部排行表。
Grok 4.5 vs Composer 2.5
Cursor 明确二者不是同一权重类别:Composer 2.5 仍面向编程工作流的产品化模型选择;Grok 4.5 扩大了一等模型池,适合需要不同能力画像或成本/延迟权衡的场景。
- 不要默认「新模型替换旧默认」:先在同一任务集上 A/B。
- Composer 2.5 仍可用:迁移应是有意识的路由决策,而不是隐性替换。
- 看工作流经济性:接受率、返工与总 token 往往比单一基准分更能决定默认模型。
谁该先试
- 已在 Cursor 里跑通工作流、想扩展模型池做对比试点的团队
- 需要在编程专精默认之外尝试不同能力/成本画像的个人开发者
- 愿意用代表性仓库任务记录接受率与成本,而不是只看发布文案的采购方
若当前 Composer 或其它默认模型已稳定且无质量瓶颈,先做小范围试点再决定是否改默认路由。
常见问题
Grok 4.5 是否在 Cursor 里替换了 Composer 2.5?
没有。Cursor 称二者是不同模型权重类别,Composer 2.5 仍可用。
Grok 4.5 官方基础模型价是多少?
上线时列出为输入 $2 / 输出 $6(每 100 万 tokens)。
在 Cursor 哪里能用 Grok 4.5?
官方称桌面端、Web、iOS、CLI 与 SDK 可用;以产品内模型列表为准。
定价与可用性请以 Cursor / SpaceXAI 上线材料为准;基准分数仅供同 harness 内参考。
相关阅读: