Grok 4.5 是什么?xAI 编程 Agent 模型发布:价格、跑分与争议全解析(2026)
2026 年 7 月 8 日 xAI 发布 Grok 4.5:主打编程与 Agent 任务、$2/$6 的激进定价、50 万 token 上下文。本文解析 Grok 4.5 跑分、价格战逻辑、争议点与上手方法。
2026 年 7 月 8 日,xAI 正式发布 Grok 4.5——这是它第一个明确瞄准编程与 Agent(智能体)任务的模型,也是本周 AI 圈最大的新闻之一。Grok 4.5 是什么、跑分到底怎么样、$2/$6 的定价意味着什么?这篇文章基于发布当天的一手信息做一次全解析,并给出现在就能上手的具体步骤。
Grok 4.5 是什么?这次发布有什么不同
据 Axios 的独家报道,Grok 4.5 于 7 月 8 日发布,基于 1.5 万亿参数的 V9 基座,提供 50 万 token 上下文窗口,内置服务器端工具(联网搜索、X 搜索、代码执行)。和以往「全能型」发布不同,这次 xAI 把话说得很窄:就是为写代码和跑长任务的 Agent 场景而生,训练数据里甚至用上了真实的 Cursor 开发者会话数据。
Grok 4.5 跑分表现如何?
根据 Kingy AI 汇总的独立基准,Grok 4.5 在 Artificial Analysis 智能指数上得分 54,位列第四,超过所有开源模型和全部 Gemini 系列,agentic 工具调用是它的强项:
| 模型 | Artificial Analysis 指数 | API 价格(输入/输出,每百万 token) |
|---|---|---|
| Claude Fable 5 | 60 | 更高 |
| Claude Opus 4.8 | 56 | 更高 |
| GPT-5.5 | 55 | 更高 |
| Grok 4.5 | 54 | $2 / $6 |
Grok 4.5 价格多少?为什么说它在打价格战
$2(输入)/ $6(输出)每百万 token,比 Opus 4.8 和 GPT-5.5 便宜超过 60%,缓存输入还能降到 $0.50。按 eesel 的分析,xAI 的赌注很清楚:智能差一点点,但价格差一大截,对高频调用的 Agent 工作负载来说,成本数学会重写选型逻辑。注意 20 万 token 以上有长上下文附加费,重度长文档场景要先算账。
争议在哪?
发布首日就出现两类争论:一是 xAI 自报跑分与独立测试之间的落差被拿出来逐项对比(尤其是「对标 Opus」的说法);二是有媒体报道其在事实性/幻觉相关测试中的表现和政治偏向问题引发讨论。结论还需要更多第三方复测,但「发布日跑分要打折听」这条经验,这次再次适用。
Marco 观点:谁应该认真看 Grok 4.5
我的判断:Grok 4.5 最大的意义不是「第四名」,而是把旗舰级 Agent 编程能力打到了 $2/$6 这个价位。 如果你在跑高频、可自动验证的任务(批量代码重构、测试生成、数据清洗 Agent),错误可以被 CI 兜底,那它的性价比值得立刻试;但如果是对准确性敏感的场景(对外内容、法律财务分析),我仍会选 Claude 或 GPT 系——省下的 token 钱不够赔一次事实错误。对中文用户还有一个现实问题:生态和文档成熟度仍落后于 OpenAI/Anthropic,团队选型别只看单价。
现在怎么上手 Grok 4.5?
- 网页端:grok.com 或 X(原 Twitter)的 Grok 入口,Premium 订阅用户可直接切换到 Grok 4.5。
- API:在 xAI 开发者控制台创建 API Key,模型名选 grok-4.5,注意给长任务开启缓存输入以吃到 $0.50 的折扣价。
- 编程工具里试:在 Cursor 等支持自定义模型的 IDE 中把模型切到 Grok 4.5,用同一个重构任务和你现在的主力模型跑 A/B 对比——用自己的真实任务测,比看任何跑分都靠谱。
常见问题 FAQ
Q:Grok 4.5 免费吗? A:网页端需要 X Premium 类订阅;API 按 $2/$6 每百万 token 计费,缓存输入 $0.50。
Q:Grok 4.5 和 Claude Opus 4.8、GPT-5.5 比谁强? A:独立指数上 Grok 4.5(54)略低于 GPT-5.5(55)与 Opus 4.8(56),但价格便宜 60% 以上,agentic 工具调用表现突出。
Q:Grok 4.5 上下文窗口多大? A:50 万 token,超过 20 万 token 部分有附加费。
Q:Grok 4.5 适合写中文内容吗? A:可以用,但它的训练重心是编程与 Agent 任务;中文长文创作与事实性要求高的场景,目前更稳的仍是 Claude / GPT / Gemini 系。
延伸阅读
- Gamma AI 怎么用?一键生成 PPT 完整教程与价格方案(2026 实操)
- OpenAI GPT-5.6 是什么?Sol、Terra、Luna 正式发布全解析(2026)
- Cursor、Claude Code、GitHub Copilot 怎么选?2026 三大 AI 编程工具对比 + 实操
写在最后
Grok 4.5 的发布把「Agent 编程模型价格战」正式打响了:智能第四、价格第一,这套打法接下来大概率会被跟进。想第一时间看懂每一次 AI 大事件对你意味着什么,欢迎关注 Marco聊科技,并订阅我们的免费 AI 资源。