先说结论

如果你今天只想知道 xAI API 该怎么迁,先记住下面 7 句话:

  • xAI 已经明确:grok-4-0709grok-4-fast-*grok-4-1-fast-*grok-code-fast-1grok-3 等旧模型会在 2026 年 5 月 15 日 12:00pm PT 退役。
  • 这对应中国时间是 2026 年 5 月 16 日 03:00(北京时间 / 上海时间),不是“本地 5 月 15 日中午”。
  • 推理类工作负载,官方推荐直接迁到 grok-4.3
  • 非推理类低延迟工作负载,官方推荐迁到 grok-4.20-non-reasoning
  • 代码类工作负载,官方也建议从 grok-code-fast-1 迁到 grok-4.3
  • grok-4.3 的价格是 输入 $1.25 / 1M、缓存输入 $0.20 / 1M、输出 $2.50 / 1M,同时给到 1M contextnone / low / medium / high 四档 reasoning_effort。
  • 如果你今天还把 grok-4-0709 当成默认主力,不应该先争论 benchmark,而应该先完成迁移清点。

一句话判断:

  • 需要推理、代码、代理任务:先迁 grok-4.3
  • 需要低延迟非推理:迁 grok-4.20-non-reasoning
  • 仍在用旧 Grok 4 / Fast / Code Fast 线路的人:优先级是“先迁移”,不是“再观望一周”

外部标杆页面怎么写,我们补了什么

这次最值得研究的页面主要有三类:

  • xAI 官方退役页,会直接给出退役日期、替代模型和工作负载映射。
  • xAI 官方模型 / 定价页,会把 grok-4.3 的 1M 上下文、费率和 reasoning_effort 讲清楚。
  • 媒体和第三方评测更喜欢抓 Grok 4 的 benchmark 或订阅价格,但往往不会把“明天 / 后天 API 怎么迁”写得足够清楚。

这些页面共同做对的一件事是:先解决模型生命周期问题,再谈模型有多强。

这篇文章补的是更适合工程团队做决策的三件事:

  1. 退役时间换算到中国时区后,真实 deadline 到底是什么。
  2. grok-4.3grok-4.20-non-reasoning 分别该接什么工作负载。
  3. 这次迁移除了换模型名,还该顺手检查哪些请求参数和调用习惯。

先把时间说清楚:退役不是“今天”,也不是中国时间 5 月 15 日中午

xAI 官方 Grok Model Retirement on May 15, 2026 文档写得非常明确:

  • 生效时间:May 15, 2026 at 12:00pm PT

如果换算成中国时间,就是:

  • 2026-05-16 03:00(北京时间 / 上海时间)

今天系统日期是 2026-05-14,所以对中国团队来说,这不是“已经过期”,也不是“明天中午”,而是还有一个跨时区窗口,但已经非常近

这类时间差最容易让中文团队误判,所以必须按绝对时间执行。

哪些模型会退役,哪些替换最重要

按 xAI 官方退役文档,以下模型会被退役:

  • grok-4-1-fast-reasoning
  • grok-4-1-fast-non-reasoning
  • grok-4-fast-reasoning
  • grok-4-fast-non-reasoning
  • grok-4-0709
  • grok-code-fast-1
  • grok-3
  • grok-imagine-image-pro

官方给出的核心替换关系是:

旧模型官方推荐替代
grok-4-1-fast-reasoninggrok-4.3
grok-4-fast-reasoninggrok-4.3
grok-4-0709grok-4.3
grok-code-fast-1grok-4.3
grok-3grok-4.3
grok-4-1-fast-non-reasoninggrok-4.20-non-reasoning
grok-4-fast-non-reasoninggrok-4.20-non-reasoning
grok-imagine-image-progrok-imagine-image

最值得注意的不是“替换表存在”,而是 xAI 已经把工作负载路线讲得很明确了。

为什么推理和代码负载优先看 grok-4.3

xAI 官方退役文档对 grok-4.3 的描述非常直接:

  • 1M context
  • low / medium / high 三档 reasoning_effort
  • 输入 $1.25 / 1M
  • 输出 $2.50 / 1M
  • 官方称其为“fastest, most intelligent model we have ever built”

与此同时,独立模型页还给出了:

  • cached input = $0.20 / 1M
  • reasoning 也可以设为 none
  • 默认 reasoning_effort 是 low

这意味着它比旧 grok-4-0709 更像一个统一主力层

  • grok-4-0709256K context,$3 / $15
  • grok-4.31M context,$1.25 / $2.50

不管是上下文、价格还是分档推理控制,grok-4.3 都更适合做新的主力迁移目标。

什么时候该迁到 grok-4.20-non-reasoning

xAI 官方退役页给出的建议也很明确:

  • 如果你在用 grok-4-1-fast-non-reasoninggrok-4-fast-non-reasoning
  • 推荐迁到 grok-4.20-non-reasoning

这条路线更适合:

  • 非推理问答
  • 强低延迟要求
  • 批量轻任务
  • 你明确不想付 reasoning token 成本的场景

如果你的负载并没有那么极端追低延迟,官方也建议你考虑用 grok-4.3reasoning_effort: low

这其实给了团队一个很好的分层方式:

  • 低延迟纯吞吐层:grok-4.20-non-reasoning
  • 统一主力层:grok-4.3

这次迁移不只是改模型名

很多团队会把迁移理解成只改一行:

{
  "model": "grok-4.3"
}

但 xAI 文档其实提醒了更多事。

1. 推理参数要重看

xAI Reasoning 文档明确写到:

  • grok-4.3 支持 reasoning_effort
  • 可选值:nonelowmediumhigh
  • 默认值是 low

如果你过去靠不同“fast / non-fast / reasoning / non-reasoning”模型名来分层,现在更合理的做法是把分层逻辑写进参数和路由策略里

2. 旧 endpoint 和旧兼容习惯也该一起检查

xAI Migrating to New Models 文档建议同时确认:

  • 你是否仍在用旧 endpoint
  • 你是否仍在依赖已经不再推荐的 legacy 兼容方式
  • 你的 prompt、请求参数和工具调用是否适配新模型

这意味着这次迁移更像一次小规模 API 清理,而不是单纯字符串替换。

3. 成本模型要重算

如果你之前在用:

  • grok-4-0709:高输入 / 输出单价,256K context
  • grok-4-fast-non-reasoning:更低成本,但能力更窄

那迁到 grok-4.3 后,你应该重新评估:

  • 默认层是否统一成一个模型
  • 哪些请求开 none
  • 哪些请求开 low
  • 哪些请求真的需要 medium / high

这样才算把这次迁移做完整。

普通开发者、Agent 团队、站长分别该怎么做

1. 普通开发者

如果你只是偶尔调 xAI API,先做两件事:

  1. 搜一遍仓库里是否还写着 grok-4-0709grok-3
  2. 迁到 grok-4.3 后重跑关键 prompt

2. Agent 团队

更合理的做法是分层:

  • 默认推理和代码层:grok-4.3
  • 强低延迟非推理层:grok-4.20-non-reasoning

同时检查工具调用、超时、reasoning_effort 和缓存收益。

3. 站长与内容团队

如果你在用 xAI 做:

  • 搜索增强问答
  • 热点追踪
  • 代码脚本
  • 多文档摘要

那么这次更值得你关注的是“是否可以把默认层统一、把成本压平”,而不是只盯着 Grok 4 旧 benchmark。

和站内哪些页面应该一起看

如果你想把 xAI 这条线看完整,建议把这篇和下面几页一起看:

这样你看到的就不只是“xAI 要退役旧模型”,还包括它在搜索、研究和工具调用路线里的位置。

质量门槛判断

如果一篇 Grok 文章只会重复“Grok 4 benchmark 很强”,它通常低于官方迁移文档的价值。

真正值得发布的页面,至少要回答:

  • 退役的绝对时间是什么,换到中国时区后是什么时间?
  • 哪些工作负载迁 grok-4.3,哪些迁 grok-4.20-non-reasoning
  • grok-4.3 为什么比旧 grok-4-0709 更适合做统一主力层?
  • 迁移时除了改模型名,还要检查哪些参数和 endpoint?

常见问题

我现在还在用 grok-4-0709,需要马上迁吗?

需要。xAI 官方已经写明它会在 2026-05-15 12:00pm PT 退役。对中国团队来说,对应的是 2026-05-16 03:00,窗口已经很近。

我做代码和推理任务,迁到哪个最稳?

官方建议直接迁到 grok-4.3。它更适合推理、代码和代理任务,而且上下文和价格都比旧 grok-4-0709 更友好。

我只做低延迟、非推理请求怎么办?

优先看 grok-4.20-non-reasoning。如果你的场景不是极致低延迟,也可以试 grok-4.3 + reasoning_effort=low

这篇文章的首图来源是什么?

首图为本站根据 xAI 官方退役页、模型页和定价页公开信息自制的信息图,文件为 /article-images/grok-4-3-migration-guide-2026-05-14.svg,未使用受限版权截图或第三方图库素材。

资料来源

延伸阅读