本文最后核验于 2026-08-03。OpenAI 当前官方资料列出的是六档推理强度,而不是五档:none、low、medium、high、xhigh、max。
一分钟结论
GPT-5.6 是一个由三款模型组成的系列。gpt-5.6 当前会路由到旗舰版 Sol;Terra 更强调能力与成本平衡;Luna 面向成本敏感的大规模任务。三款模型都支持文本和图像输入、文本输出、流式响应、结构化输出、函数调用,以及 Responses、Chat Completions 与 Batch API。
| 模型 | 官方定位 | 适合场景 |
|---|---|---|
| GPT-5.6 Sol | 复杂专业工作的旗舰模型 | 高难度代码、研究、复杂代理任务 |
| GPT-5.6 Terra | 智能、速度与成本的平衡 | 日常生产、编码助手、内容与分析 |
| GPT-5.6 Luna | 成本敏感的高吞吐模型 | 分类、抽取、批处理与轻量代理 |
上下文与输出上限
三款模型当前都提供 1,050,000 token 上下文窗口、922,000 token 最大输入和 128,000 token 最大输出。知识截止日期为 2026-02-16。超长上下文很强,但不要把“能放进去”误解为“应该全部放进去”:生产环境仍应做检索、裁剪和缓存。
六档推理强度
通过 reasoning.effort 选择 none、low、medium、high、xhigh 或 max,默认值是 medium。强度越高,通常会消耗更多推理 token,并增加响应时间。简单提取可从 none/low 开始;复杂编码与多约束规划再逐步升高。
OpenAI 还提供独立的 reasoning.mode:standard 为默认模式,pro 会用更多计算换取更强的复杂任务表现,也会带来更高延迟和 token 使用。它不是另一条模型 ID。
标准价格(USD / 100 万 token)
| 模型 | 输入 | 缓存输入 | 缓存写入 | 输出 |
|---|---|---|---|---|
| Sol | $5.00 | $0.50 | $6.25 | $30.00 |
| Terra | $2.00 | $0.20 | $2.50 | $12.00 |
| Luna | $0.20 | $0.02 | $0.25 | $1.20 |
当请求输入超过 272K token 时,官方会对整次请求使用长上下文价格:输入为标准价 2 倍,输出为标准价 1.5 倍。Batch 与 Flex 的表格价格为标准价的 50%;Fast 短上下文价格为标准价的 2 倍。符合条件的数据驻留区域端点还可能有 10% 上浮。实际结算前,请以 OpenAI 官方价格页和 OpenTokenRouter 的实时价格为准。
怎么选
- 先用 Terra 做默认模型,再用真实任务评测质量、延迟和成本。
- 只有复杂专业任务确实得到明显收益时,才升级到 Sol。
- 结构化抽取、分类和大批量轻任务优先评测 Luna。
- 把推理强度当成可调参数,不要给所有请求固定 max。
Responses API 示例
curl "$OPEN_TOKEN_ROUTER_BASE_URL/v1/responses" \
-H "Authorization: Bearer $OPEN_TOKEN_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"reasoning": {"effort": "medium"},
"input": "为这个 Go 服务设计一份发布前检查清单"
}'额度与速率限制不是一个固定的公开数字,会随账户层级、项目和模型变化;请在供应商控制台的 Limits 页面核对,不要把单一额度写进长期文档。