GPT-5.4 系列模型档案
- 厂商:OpenAI
- 版本:GPT-5.4 / GPT-5.4 Pro / GPT-5.4 mini / GPT-5.4 nano
- 调用方式:OpenAI API / ChatGPT / Codex
- 上下文窗口:400,000~1,050,000 tokens
- 计费方式:按输入、缓存输入和输出 Token 计费
一句话介绍
GPT-5.4 是 OpenAI 将专业推理、前沿编程和计算机使用能力整合到主线模型,并向 mini、nano 扩展成本梯度的一代模型系列。
模型概览
| 项目 | 信息 |
|---|---|
| 主模型发布时间 | 2026-03-05 |
| mini/nano 快照 | 2026-03-17 |
| 模型类型 | 推理、编程、多模态、Agent |
| 开源状态 | 闭源 |
| 参数规模 | 官方未披露 |
| GPT-5.4 上下文 | 1,050,000 tokens |
| mini/nano 上下文 | 400,000 tokens |
| 最大输出长度 | 128,000 tokens |
| 知识截止时间 | 2025-08-31 |
| 输入/输出模态 | 文本与图像输入、文本输出 |
综合评分
系列综合得分:89.2/100|数据覆盖率:100%|证据强度:B|核对日期:2026-07-20
| 型号 | 综合得分 | 定位 |
|---|---|---|
| GPT-5.4 Pro | 88.4/100 | 最高准确率、最高成本的复杂任务 |
| GPT-5.4 | 88.0/100 | 专业工作、编程和通用 Agent |
| GPT-5.4 mini | 86.0/100 | 高吞吐编程、计算机使用和子智能体 |
| GPT-5.4 nano | 82.0/100 | 分类、抽取、排序和大规模简单任务 |
评分是基于官方参数、定位和发布评测的相对评价,不是 OpenAI 官方评级。
| 维度 | 系列评分 | 权重 | 评分依据 |
|---|---|---|---|
| 推理能力 | 9.0/10 | 20% | 主模型与 Pro 面向复杂专业推理;小模型按成本缩放 |
| 编程能力 | 9.1/10 | 15% | 主线整合 GPT-5.3-Codex 能力;SWE-Bench Pro 57.7% |
| 语言与知识 | 8.8/10 | 15% | 专业知识工作表现较 GPT-5.2 提升 |
| 多模态能力 | 8.7/10 | 10% | 支持图像理解和计算机使用 |
| 上下文能力 | 8.9/10 | 10% | 主模型 1.05M,mini/nano 400K,均可输出 128K |
| 速度 | 8.8/10 | 10% | mini/nano 适合高并发;Pro 延迟更高 |
| 成本效益 | 8.7/10 | 10% | nano 低至 $0.20/$1.25,覆盖完整成本梯度 |
| 工具与生态 | 9.4/10 | 5% | 支持 Responses API、工具调用、MCP 与 Skills |
| 安全与稳定性 | 9.0/10 | 5% | 已正式上线并发布 Thinking 系统卡 |
版本信息
| 型号 | 官方模型 ID | 上下文 | 输入 | 缓存输入 | 输出 | 主要用途 |
|---|---|---|---|---|---|---|
| GPT-5.4 | gpt-5.4 |
1.05M | $2.50 | $0.25 | $15.00 | 编程、专业工作、复杂 Agent |
| GPT-5.4 Pro | gpt-5.4-pro |
以官方模型页为准 | $30.00 | — | $180.00 | 最高准确率复杂任务 |
| GPT-5.4 mini | gpt-5.4-mini |
400K | $0.75 | $0.075 | $4.50 | 高吞吐编程、计算机使用、子智能体 |
| GPT-5.4 nano | gpt-5.4-nano |
400K | $0.20 | $0.02 | $1.25 | 分类、抽取、排序、简单子任务 |
价格单位为每 100 万 Token。GPT-5.4 主模型的 272K 以上长上下文请求存在额外费率,应以模型页和价格页为准。
公开能力依据
官方发布评测中,GPT-5.4 取得:
- GDPval:83.0%;
- SWE-Bench Pro(Public):57.7%;
- Terminal-Bench 2.0:75.1%;
- OSWorld-Verified:75.0%;
- BrowseComp:82.7%;
- GPQA Diamond:92.8%。
这些结果来自 OpenAI 发布设置,适合说明版本内能力提升,但不应与测试条件不同的第三方结果直接混排。
核心能力
- 支持
none、low、medium、high、xhigh推理强度。 - 支持函数调用、结构化输出、Web/File Search、Code Interpreter、Hosted Shell 和 MCP。
- GPT-5.4 与 mini 支持 Computer Use;nano 官方模型页标注不支持 Computer Use 和 Tool Search。
- 支持图像输入与文本输出,不原生支持音频或视频。
- 官方模型页标注不支持微调。
调用示例
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-mini",
"input": "从这些工单中抽取故障模块、严重级别和修复建议。",
"reasoning": {"effort": "low"}
}'
模型优势
- 从 Pro 到 nano 提供完整能力与成本梯度。
- 主模型将专业推理、编码和计算机使用能力合并,适合通用 Agent。
- mini 在工具能力、速度和成本之间平衡较好。
已知限制
- 已被 GPT-5.5 和 GPT-5.6 取代为前沿默认选择。
- nano 不适合复杂推理、Computer Use 或最高难度编程任务。
- 1M 标称窗口不代表所有超长上下文任务都能保持短上下文准确率。
- Pro 价格高,应以业务评测证明收益。
选型建议
- 常规专业工作:GPT-5.4。
- 极难、低频、高价值问题:GPT-5.4 Pro。
- 高吞吐代码、工具调用和子智能体:GPT-5.4 mini。
- 抽取、分类、排序和简单批处理:GPT-5.4 nano。
- 新建前沿系统:同时比较 GPT-5.6 Terra/Luna,避免锁定旧代际。
结论
GPT-5.4 的价值在于成熟且完整的产品梯度:主模型负责复杂专业工作,mini 适合高吞吐 Agent,nano 适合规模化简单任务。虽然它已不是最新一代,但在已有稳定提示词、固定快照或成本经过验证的系统中仍有保留价值。
官方资料
更新记录
| 日期 | 更新内容 | 编辑者 |
|---|---|---|
| 2026-07-20 | 创建系列档案 | Codex |
评论
欢迎分享你的游玩体验与看法。