GPT-5.4 系列模型档案

GPT-5.4 系列模型档案

  • 厂商:OpenAI
  • 版本:GPT-5.4 / GPT-5.4 Pro / GPT-5.4 mini / GPT-5.4 nano
  • 调用方式:OpenAI API / ChatGPT / Codex
  • 上下文窗口:400,000~1,050,000 tokens
  • 计费方式:按输入、缓存输入和输出 Token 计费

一句话介绍

GPT-5.4 是 OpenAI 将专业推理、前沿编程和计算机使用能力整合到主线模型,并向 mini、nano 扩展成本梯度的一代模型系列。

模型概览

项目 信息
主模型发布时间 2026-03-05
mini/nano 快照 2026-03-17
模型类型 推理、编程、多模态、Agent
开源状态 闭源
参数规模 官方未披露
GPT-5.4 上下文 1,050,000 tokens
mini/nano 上下文 400,000 tokens
最大输出长度 128,000 tokens
知识截止时间 2025-08-31
输入/输出模态 文本与图像输入、文本输出

综合评分

系列综合得分:89.2/100|数据覆盖率:100%|证据强度:B|核对日期:2026-07-20

型号 综合得分 定位
GPT-5.4 Pro 88.4/100 最高准确率、最高成本的复杂任务
GPT-5.4 88.0/100 专业工作、编程和通用 Agent
GPT-5.4 mini 86.0/100 高吞吐编程、计算机使用和子智能体
GPT-5.4 nano 82.0/100 分类、抽取、排序和大规模简单任务

评分是基于官方参数、定位和发布评测的相对评价,不是 OpenAI 官方评级。

维度 系列评分 权重 评分依据
推理能力 9.0/10 20% 主模型与 Pro 面向复杂专业推理;小模型按成本缩放
编程能力 9.1/10 15% 主线整合 GPT-5.3-Codex 能力;SWE-Bench Pro 57.7%
语言与知识 8.8/10 15% 专业知识工作表现较 GPT-5.2 提升
多模态能力 8.7/10 10% 支持图像理解和计算机使用
上下文能力 8.9/10 10% 主模型 1.05M,mini/nano 400K,均可输出 128K
速度 8.8/10 10% mini/nano 适合高并发;Pro 延迟更高
成本效益 8.7/10 10% nano 低至 $0.20/$1.25,覆盖完整成本梯度
工具与生态 9.4/10 5% 支持 Responses API、工具调用、MCP 与 Skills
安全与稳定性 9.0/10 5% 已正式上线并发布 Thinking 系统卡

版本信息

型号 官方模型 ID 上下文 输入 缓存输入 输出 主要用途
GPT-5.4 gpt-5.4 1.05M $2.50 $0.25 $15.00 编程、专业工作、复杂 Agent
GPT-5.4 Pro gpt-5.4-pro 以官方模型页为准 $30.00 $180.00 最高准确率复杂任务
GPT-5.4 mini gpt-5.4-mini 400K $0.75 $0.075 $4.50 高吞吐编程、计算机使用、子智能体
GPT-5.4 nano gpt-5.4-nano 400K $0.20 $0.02 $1.25 分类、抽取、排序、简单子任务

价格单位为每 100 万 Token。GPT-5.4 主模型的 272K 以上长上下文请求存在额外费率,应以模型页和价格页为准。

公开能力依据

官方发布评测中,GPT-5.4 取得:

  • GDPval:83.0%;
  • SWE-Bench Pro(Public):57.7%;
  • Terminal-Bench 2.0:75.1%;
  • OSWorld-Verified:75.0%;
  • BrowseComp:82.7%;
  • GPQA Diamond:92.8%。

这些结果来自 OpenAI 发布设置,适合说明版本内能力提升,但不应与测试条件不同的第三方结果直接混排。

核心能力

  • 支持 nonelowmediumhighxhigh 推理强度。
  • 支持函数调用、结构化输出、Web/File Search、Code Interpreter、Hosted Shell 和 MCP。
  • GPT-5.4 与 mini 支持 Computer Use;nano 官方模型页标注不支持 Computer Use 和 Tool Search。
  • 支持图像输入与文本输出,不原生支持音频或视频。
  • 官方模型页标注不支持微调。

调用示例

curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.4-mini",
    "input": "从这些工单中抽取故障模块、严重级别和修复建议。",
    "reasoning": {"effort": "low"}
  }'

模型优势

  1. 从 Pro 到 nano 提供完整能力与成本梯度。
  2. 主模型将专业推理、编码和计算机使用能力合并,适合通用 Agent。
  3. mini 在工具能力、速度和成本之间平衡较好。

已知限制

  1. 已被 GPT-5.5 和 GPT-5.6 取代为前沿默认选择。
  2. nano 不适合复杂推理、Computer Use 或最高难度编程任务。
  3. 1M 标称窗口不代表所有超长上下文任务都能保持短上下文准确率。
  4. Pro 价格高,应以业务评测证明收益。

选型建议

  • 常规专业工作:GPT-5.4。
  • 极难、低频、高价值问题:GPT-5.4 Pro。
  • 高吞吐代码、工具调用和子智能体:GPT-5.4 mini。
  • 抽取、分类、排序和简单批处理:GPT-5.4 nano。
  • 新建前沿系统:同时比较 GPT-5.6 Terra/Luna,避免锁定旧代际。

结论

GPT-5.4 的价值在于成熟且完整的产品梯度:主模型负责复杂专业工作,mini 适合高吞吐 Agent,nano 适合规模化简单任务。虽然它已不是最新一代,但在已有稳定提示词、固定快照或成本经过验证的系统中仍有保留价值。

官方资料

更新记录

日期 更新内容 编辑者
2026-07-20 创建系列档案 Codex