📅 2026年7月11日

Grok 4.5 是什么?xAI 编程 Agent 模型发布:价格、跑分与争议全解析(2026)

2026 年 7 月 8 日 xAI 发布 Grok 4.5:主打编程与 Agent 任务、$2/$6 的激进定价、50 万 token 上下文。本文解析 Grok 4.5 跑分、价格战逻辑、争议点与上手方法。

Grok 4.5 是什么?xAI 编程 Agent 模型发布:价格、跑分与争议全解析(2026)

2026 年 7 月 8 日,xAI 正式发布 Grok 4.5——这是它第一个明确瞄准编程与 Agent(智能体)任务的模型,也是本周 AI 圈最大的新闻之一。Grok 4.5 是什么、跑分到底怎么样、$2/$6 的定价意味着什么?这篇文章基于发布当天的一手信息做一次全解析,并给出现在就能上手的具体步骤。

Grok 4.5 是什么?这次发布有什么不同

Axios 的独家报道,Grok 4.5 于 7 月 8 日发布,基于 1.5 万亿参数的 V9 基座,提供 50 万 token 上下文窗口,内置服务器端工具(联网搜索、X 搜索、代码执行)。和以往「全能型」发布不同,这次 xAI 把话说得很窄:就是为写代码和跑长任务的 Agent 场景而生,训练数据里甚至用上了真实的 Cursor 开发者会话数据。

Grok 4.5 跑分表现如何?

根据 Kingy AI 汇总的独立基准,Grok 4.5 在 Artificial Analysis 智能指数上得分 54,位列第四,超过所有开源模型和全部 Gemini 系列,agentic 工具调用是它的强项:

模型 Artificial Analysis 指数 API 价格(输入/输出,每百万 token)
Claude Fable 5 60 更高
Claude Opus 4.8 56 更高
GPT-5.5 55 更高
Grok 4.5 54 $2 / $6

Grok 4.5 价格多少?为什么说它在打价格战

$2(输入)/ $6(输出)每百万 token,比 Opus 4.8 和 GPT-5.5 便宜超过 60%,缓存输入还能降到 $0.50。按 eesel 的分析,xAI 的赌注很清楚:智能差一点点,但价格差一大截,对高频调用的 Agent 工作负载来说,成本数学会重写选型逻辑。注意 20 万 token 以上有长上下文附加费,重度长文档场景要先算账。

争议在哪?

发布首日就出现两类争论:一是 xAI 自报跑分与独立测试之间的落差被拿出来逐项对比(尤其是「对标 Opus」的说法);二是有媒体报道其在事实性/幻觉相关测试中的表现和政治偏向问题引发讨论。结论还需要更多第三方复测,但「发布日跑分要打折听」这条经验,这次再次适用。

Marco 观点:谁应该认真看 Grok 4.5

我的判断:Grok 4.5 最大的意义不是「第四名」,而是把旗舰级 Agent 编程能力打到了 $2/$6 这个价位。 如果你在跑高频、可自动验证的任务(批量代码重构、测试生成、数据清洗 Agent),错误可以被 CI 兜底,那它的性价比值得立刻试;但如果是对准确性敏感的场景(对外内容、法律财务分析),我仍会选 Claude 或 GPT 系——省下的 token 钱不够赔一次事实错误。对中文用户还有一个现实问题:生态和文档成熟度仍落后于 OpenAI/Anthropic,团队选型别只看单价。

现在怎么上手 Grok 4.5?

  1. 网页端:grok.com 或 X(原 Twitter)的 Grok 入口,Premium 订阅用户可直接切换到 Grok 4.5。
  2. API:在 xAI 开发者控制台创建 API Key,模型名选 grok-4.5,注意给长任务开启缓存输入以吃到 $0.50 的折扣价。
  3. 编程工具里试:在 Cursor 等支持自定义模型的 IDE 中把模型切到 Grok 4.5,用同一个重构任务和你现在的主力模型跑 A/B 对比——用自己的真实任务测,比看任何跑分都靠谱。

常见问题 FAQ

Q:Grok 4.5 免费吗? A:网页端需要 X Premium 类订阅;API 按 $2/$6 每百万 token 计费,缓存输入 $0.50。

Q:Grok 4.5 和 Claude Opus 4.8、GPT-5.5 比谁强? A:独立指数上 Grok 4.5(54)略低于 GPT-5.5(55)与 Opus 4.8(56),但价格便宜 60% 以上,agentic 工具调用表现突出。

Q:Grok 4.5 上下文窗口多大? A:50 万 token,超过 20 万 token 部分有附加费。

Q:Grok 4.5 适合写中文内容吗? A:可以用,但它的训练重心是编程与 Agent 任务;中文长文创作与事实性要求高的场景,目前更稳的仍是 Claude / GPT / Gemini 系。

延伸阅读

写在最后

Grok 4.5 的发布把「Agent 编程模型价格战」正式打响了:智能第四、价格第一,这套打法接下来大概率会被跟进。想第一时间看懂每一次 AI 大事件对你意味着什么,欢迎关注 Marco聊科技,并订阅我们的免费 AI 资源。

Marco聊科技 — AI 工具 · 教程 · 自动化

Marco 分享最新的 AI 工具评测、Claude / ChatGPT / Gemini 深度教程,以及 AI 自动化与效率提升技巧,帮助你在 AI 时代保持领先。以下是最新发布的文章:

查看全部文章 →