2026 年 6 月 27 日,OpenAI 正式推出 GPT-5.6 系列大模型,首次采用天文命名体系——Sol(太阳),分别对应旗舰、均衡与高性价比三类产品定位。新模型在编程、生物、网络安全等专业领域全面突破,其中 GPT-5.6 Sol 在 Terminal-Bench 2.1 编程基准中以 91.9% 得分刷新纪录,超越 Anthropic 最新闭源模型 Claude Mythos 5(88.0%)。目前该系列暂未全面开放,仅向美国政府批准的“可信合作伙伴”提供预览权限。
天文命名,三层能力:构建可持续演进的模型矩阵
OpenAI 首次放弃纯数字命名,转而采用拉丁天文词汇构建长期产品体系:
Sol(太阳):旗舰级模型,面向高复杂度科研、工程与安全任务;
Terra(地球):通用主力模型,平衡性能与成本;
Luna(月亮):轻量高速模型,主打推理速度与低延迟场景。
官方解释称:“数字标识代际,Sol/Terra/Luna 标识持久的能力层级,可按各自节奏独立迭代。”这一策略标志着 OpenAI 从“版本升级”转向“产品线运营”,为不同行业客户提供更精细的服务选择。
编程能力登顶:Ultra 模式下得分达 91.9%
GPT-5.6 Sol 引入全新 Ultra 推理模式,通过调用子智能体(sub-agents)并行处理复杂任务链。在权威编程评测 Terminal-Bench 2.1 中:
标准模式得分 88.8%,已超越 Claude Mythos 5(88.0%);
Ultra 模式进一步提升至 91.9%,创历史新高。

在生物学 GeneBench v1 测试中,GPT-5.6 Sol 以更少 token 消耗实现更强基因序列分析能力;



在网络安全 ExploitBench 中,仅用 1/3 输出 token 即达到与 Mythos Preview 相近的漏洞利用水平。


安全架构全面升级:五层防护体系应对高风险场景
面对日益复杂的滥用风险,OpenAI 为 GPT-5.6 全系部署 分层安全防护体系:
模型内置拒答机制
生成过程实时内容分类器
账户级风险行为审查
差异化访问控制
高风险任务交由更大模型复核
若系统判定内容违规,将在展示前自动拦截,确保输出合规可控。
商业策略:缓存优化降本,Cerebras 加速推理
定价方面,GPT-5.6 延续阶梯策略:
Sol:输入 $5 / 百万 tokens,输出 $30
Terra:输入 $2.5,输出 $15
Luna:输入 $1,输出 $6
同时,OpenAI 优化提示词缓存机制,重复请求显著降价。更值得注意的是,公司计划于 7 月在 Cerebras 芯片上部署 GPT-5.6 Sol,推理速度最高可达 每秒 750 tokens,初期仅向部分企业客户开放。
编者按:GPT-5.6 的发布,不仅是技术的跃进,更是 OpenAI 产品战略的成熟标志。通过“能力分层 + 场景定制 + 安全闭环”,OpenAI 正从通用 AI 提供商转型为高可靠企业智能基础设施。在全球 AI 竞争进入深水区的今天,谁能兼顾性能、成本与安全,谁就将赢得下一代企业市场的信任。