← 返回全球模型雷达

美国 · OpenAI

OpenAI 模型历史

OpenAI 现在最值得看的不是只看 GPT-5.5 更强,而是 GPT-5.4 和 GPT-5.5 已经明确分成了默认高价值工作层和高返工成本 Agent 层,而 Codex 的手机协作与 Remote SSH 又把执行层往前推了一步。

GPT-5.4 vs GPT-5.5 路由GPT-5.5 InstantCodex mobile / Remote SSHCodex hybrid / on-premCodex pricing / Business CodexThinking / Pro 分层Workspace AgentsRealtime Voice / TranslateAPI 成本上下文窗口

当前重点模型

GPT-5.6 Sol

当前 OpenAI 旗舰层,更像高价值任务模型而不是省钱模型。

官方/参考来源 →
最新 · 2026-07-09

GPT-5.6 Sol

当前 OpenAI 旗舰层,更像高价值任务模型而不是省钱模型。

推理代码中文多模态上下文速度成本友好
推理98
代码97
中文89
多模态94
上下文94
速度80
成本友好44

类型:闭源API

上下文:Official model page: verify current context in console

输入:$5.00 / 1M tokens

输出:$30.00 / 1M tokens

更适合高价值编码、Agent 和复杂专业任务,不适合作为全量默认模型;是否回本取决于返工是否明显下降。

现役 · 2026-07-09

GPT-5.6 Terra

A practical execution-tier candidate, subject to your own evals and regional availability.

推理代码中文多模态上下文速度成本友好
推理93
代码92
中文88
多模态92
上下文92
速度86
成本友好66

类型:closed API

上下文:Official model page: verify current context in console

输入:$2.50 / 1M tokens

输出:$15.00 / 1M tokens

Balanced tier for real workflow pilots; measure completed-task cost, not one prompt.

现役 · 2026-07-09

GPT-5.6 Luna

Suitable for high-volume, low-risk work after task-specific testing.

推理代码中文多模态上下文速度成本友好
推理88
代码87
中文86
多模态88
上下文88
速度92
成本友好82

类型:closed API

上下文:Official model page: verify current context in console

输入:$1.00 / 1M tokens

输出:$6.00 / 1M tokens

Lowest-cost GPT-5.6 tier; retain human review for factual or high-impact outputs.

现役 · 2026-04

GPT-5.4

旗舰综合模型,适合复杂任务,但成本不是最低。

推理代码中文多模态上下文速度成本友好
推理96
代码94
中文88
多模态93
上下文92
速度82
成本友好55

类型:闭源API

上下文:1,050,000 context / 128,000 max output

输入:$2.50 / 1M tokens

输出:$15.00 / 1M tokens

适合作为高价值任务主模型;超过标准 272K 输入的长上下文会按更高倍率计费。

现役 · 2025-2026

GPT-5.2

更适合稳定工作流和成本可控场景。

推理代码中文多模态上下文速度成本友好
推理92
代码90
中文86
多模态90
上下文88
速度86
成本友好62

类型:闭源API

上下文:按官方模型页核准

输入:见官方价格页

输出:见官方价格页

适合稳定生产工作流,对比 GPT-5.4 看质量和价格差。

历史 · 2024

GPT-4o

代表多模态和低延迟入口开始普及。

推理代码中文多模态上下文速度成本友好
推理82
代码80
中文82
多模态90
上下文78
速度90
成本友好76

类型:闭源API

上下文:长上下文

输入:历史低成本多模态档

输出:历史低成本多模态档

作为多模态普及节点,适合看 OpenAI 成本曲线变化。