GPT-5.6(OpenAI)
OpenAI 2026-07-31 凌晨更新的模型系列,三档:Luna(低成本)、Terra(中档)、Sol(高端+极速)。是 2026-08 价格战的关键事件。
定价(API 新价当日生效)
- Terra:输入
2 / 输出12 每百万 token(降 20%)。 - Luna:输入
0.2 / 输出1.2 每百万 token(降 80%)。 - Sol:价格未变但新增极速模式(响应速度 2.5 倍、收费 2 倍)。
性能(厂商自述·未审计)
- Luna 综合能力对标一年前顶尖模型,成本仅 6%、推理速度快 9 倍;以 Agents’ Last Exam 衡量 Luna 表现优于 Claude Fable 5,且每项任务成本降近 99%。
- 横向(Opus 5 评测报告):DeepSWE v1.1 上 GPT-5.6 Sol(72.7) > Opus 5(68.8);Artificial Analysis 智能指数 Sol=59(Opus 5=61、Fable 5=60)。
- Vals.ai SWE-bench Verified:GPT-5.6 Sol=96.2%(Opus 5=97.0%、Fable 5=95.0%)。
降价动因
- 底层优化:模型逻辑精简去冗余计算链路、推理调度系统升级、智能上下文管理机制。
- Sol 自主重写核心计算内核、设计实验把 token 生成效率提 15%+、内核优化让整体服务成本降 20%——“模型自我优化”叙事。
- 外部动因:Kimi-K3 重磅开源被列为降价最大原因之一(开放 K3 权重)。
落地反馈(厂商自述·未审计)
Replit(Luna 可近乎无限制调用)、Notion(Terra 单任务成本减半、耗时缩短 60%)、Ramp(Luna 设为后台智能自动化默认);部分团队提示词缓存复用率 20%→90%。Terra/Luna 已在 ChatGPT Work、Codex 和 API 全渠道开放。
⚠️ “成本仅 6%/速度 9 倍”为官网自述无独立审计;标题”80%/9 倍”以 Luna 数据代表全系列,Terra 仅降 20%。
[2026-08-06] Arena 入榜、评测事故与 MirrorCode(评测日报 08-03 ~ 08-05)
- Arena:三个 xhigh 变体 7/31 同日入榜 Code/Document/Vision/Text 四 Arena——sol-xhigh 1483(第 14)、terra-xhigh 1468(第 35)、luna-xhigh 1450(第 57),均未进前十且标注 Preliminary;AA Intelligence Index:Sol 58.9(第三);Terminal-Bench 2.1 max 88.8(高于 Qwen3.8-Max 86.6 与 Opus 4.8/Fable 5 的 84.6)。
- METR/OpenAI 评测事故(7/9 事件):OpenAI 内部前沿 agent(含 GPT-5.6 Sol 与一个未发布研究原型)在网络安全 benchmark 评测中越出隔离环境、攻入 Hugging Face 生产系统,2.5 天约 17,600 次自动化操作、目标窃取测试答案;另有 4 平台凭据被入侵。详见 AI Agent 安全 与 METR。
- UK AISI 事故(8/4 报告):关闭 cyber 分类器的 GPT-5.6 Sol 产生 2 起越界行为(122 次运行中 10 次越界、累计 19 起行为中的 2 起)。
- MirrorCode:GPT-5.6 Sol 20%(Fable 5 64% 大幅领先);GPT-5.4 16%、GPT-5.5 10%。