GPT-5.6 系列模型档案
- 厂商:OpenAI
- 版本:GPT-5.6 Sol / Terra / Luna
- 调用方式:OpenAI API / ChatGPT / Codex
- 上下文窗口:1,050,000 tokens
- 计费方式:按输入、缓存输入和输出 Token 计费
核对日期:2026-07-20。用户提供的“150 万上下文”与官方资料不一致,官方当前标注为 105 万(1.05M)。官方于 2026-07-09 宣布开始全球上线并在随后 24 小时内逐步完成,因此“2026-07-10 全量上线”可作为 rollout 完成日理解,但不是公告标题中的发布日期。
一句话介绍
GPT-5.6 是 OpenAI 面向复杂专业工作、高性价比通用任务和低成本高并发场景推出的三档前沿模型系列。
模型概览
| 项目 | 信息 |
|---|---|
| 模型厂商 | OpenAI |
| 正式发布 | 2026-07-09,随后 24 小时逐步全量上线 |
| 模型类型 | 通用语言、推理、编程、多模态、Agent |
| 开源状态 | 闭源 |
| 参数规模 | 官方未披露 |
| 上下文窗口 | 1,050,000 tokens |
| 最大输出长度 | 128,000 tokens |
| 知识截止时间 | 2026-02-16 |
| 输入模态 | 文本、图像 |
| 输出模态 | 文本 |
综合评分
以下是基于官方参数、价格、能力定位和公开评测的编辑部相对评分,不是 OpenAI 官方评级。
| 型号 | 综合得分 | 定位 | 核心判断 |
|---|---|---|---|
| GPT-5.6 Sol | 92.0/100 | 旗舰 | 推理、深度编程、科研和复杂 Agent 任务优先 |
| GPT-5.6 Terra | 91.4/100 | 均衡 | 能力、速度与成本平衡,适合企业日常生产负载 |
| GPT-5.6 Luna | 89.2/100 | 轻量 | 最快、最便宜,适合实时交互和高并发简单任务 |
数据覆盖率:100%|证据强度:B|核对日期:2026-07-20
| 维度 | Sol | Terra | Luna | 评分依据 |
|---|---|---|---|---|
| 推理能力(20%) | 9.8 | 9.2 | 8.5 | Sol 为旗舰;三档均支持最高到 max 的推理强度 |
| 编程能力(15%) | 9.7 | 9.1 | 8.4 | 官方编码与终端任务评测显示三档均较强,Sol 领先 |
| 语言与知识(15%) | 9.4 | 9.0 | 8.7 | 面向专业知识工作,知识截止时间一致 |
| 多模态能力(10%) | 9.2 | 8.9 | 8.6 | 支持文本和图像输入、文本输出 |
| 上下文能力(10%) | 9.4 | 9.4 | 9.4 | 三档均为 1.05M 上下文、128K 最大输出 |
| 速度(10%) | 8.0 | 9.0 | 9.7 | Luna 最快,Terra 居中,Sol 更重推理 |
| 成本效益(10%) | 7.5 | 9.0 | 9.6 | 三档输入/输出价格依次下降 |
| 工具与生态(5%) | 9.8 | 9.7 | 9.4 | 支持函数、搜索、计算机使用及 Responses API 工具链 |
| 安全与稳定性(5%) | 9.5 | 9.3 | 9.1 | 正式上线并配套新版安全防护;多智能体仍为 beta |
系列成员
| 型号 | 官方模型 ID | 推荐场景 | 输入价格 | 缓存读取 | 输出价格 |
|---|---|---|---|---|---|
| Sol | gpt-5.6-sol,别名 gpt-5.6 |
复杂推理、深度编程、科研、复杂专业工作 | $5.00 | $0.50 | $30.00 |
| Terra | gpt-5.6-terra |
企业日常、知识工作、成本敏感的复杂任务 | $2.50 | $0.25 | $15.00 |
| Luna | gpt-5.6-luna |
低延迟对话、分类抽取、高并发任务 | $1.00 | $0.10 | $6.00 |
单价单位均为每 100 万 Token。超过 272K 输入的请求,官方模型页提示整次请求按 2 倍输入价、1.5 倍输出价计费。缓存写入按未缓存输入价格的 1.25 倍计费,缓存读取享受 90% 折扣。
Ultra 与多智能体
max是单模型更高推理强度,Sol、Terra、Luna 均支持。ultra通过子智能体并行处理复杂任务;官方发布说明中,ChatGPT Work 的 Pro/Enterprise 与 Codex Plus 及以上计划可用。- Responses API 的 Multi-agent 当前为 beta,不应将其视为已经稳定的通用生产接口。
- 因此“Sol Ultra 多智能体”可以作为旗舰使用方式描述,但
ultra更准确地说是产品运行模式,而不是独立 API 模型 ID。
核心能力
| 能力 | 支持情况 | 说明 |
|---|---|---|
| 文本生成与复杂推理 | 支持 | none、low、medium、high、xhigh、max |
| 代码生成与工具协同 | 支持 | 适合终端、仓库和长链路 Agent 工作 |
| 图像理解 | 支持 | 图像输入、文本输出 |
| 音频与视频 | 不支持原生输入输出 | 应改用 Realtime、音频或视频专用模型 |
| 函数调用与结构化输出 | 支持 | 推荐 Responses API |
| Web/File Search、Computer Use | 支持 | 可能产生额外工具调用费用 |
| 微调 | 官方模型页标注不支持 | 不要按可微调模型规划方案 |
调用示例
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"input": "分析这份企业经营报告并给出风险清单。",
"reasoning": {"effort": "medium"}
}'
优势与限制
主要优势
- 同一代内提供清晰的旗舰、均衡和轻量档位。
- 三档共享 1.05M 上下文和 128K 最大输出,便于按成本动态路由。
- 工具调用、计算机使用、长链路编程和多智能体能力完整。
已知限制
- 官方上下文是 1.05M,不是 1.5M;超长输入还会触发更高费率。
- Luna 适合低延迟,但不应替代 Sol 处理最高难度科研和深度推理。
- Multi-agent 仍为 beta,高风险结论必须保留人工复核。
选型建议
- 默认企业生产:优先 Terra。
- 科研、复杂架构与深度编程:优先 Sol,必要时启用
max或产品侧ultra。 - 实时对话、批量分类抽取:优先 Luna。
- 高风险医疗、法律、金融决策:只能作为辅助,并建立证据引用与人工审批流程。
结论
GPT-5.6 将模型尺寸改造成 Sol、Terra、Luna 三个长期能力档位。Sol 适合能力优先的复杂推理和编程,Terra 是大多数企业任务更稳妥的默认选择,Luna 则面向低延迟与大规模调用。实际迁移时应重点验证 272K 以上长上下文成本、推理强度对延迟的影响,以及 beta 多智能体的稳定性。
官方资料
更新记录
| 日期 | 更新内容 | 编辑者 |
|---|---|---|
| 2026-07-20 | 创建系列档案并核对上下文、价格、上线时间与 Ultra 定位 | Codex |