此前,OpenAI 推出的 GPT-5.6 系列因美国政府审批要求,仅向部分受信任的合作伙伴开放测试。随着相关审批流程完成,OpenAI 已确认将于北京时间 7 月 9 日正式向全球用户开放 GPT-5.6 系列模型,并同步开放 API 调用。
GPT-5.6 系列采用全新的三档产品体系,不同版本针对性能、速度与成本进行了差异化定位。
其中,GPT-5.6 Sol 为旗舰版本,拥有最高的智能水平,同时集成更完善的安全防护机制,适用于复杂推理、Agent 以及高质量内容生成等场景。
GPT-5.6 Terra 则定位于均衡版本,在智能水平和响应速度之间取得平衡,官方表示其整体性能接近 GPT-5.5,但 API 成本仅为 GPT-5.5 的约一半,更适合大规模商业部署。
GPT-5.6 Luna 主打低成本与高响应速度,虽然推理能力相对有所取舍,但能够以更低价格完成日常对话、文本处理和轻量级 AI 应用,对于高并发服务具有较高性价比。
在 API 定价方面,OpenAI 也公布了各版本价格:
- GPT-5.6 Sol(标准模式):每百万输入 Token 5 美元,每百万输出 Token 30 美元。
- GPT-5.6 Sol(高速模式):最高支持 750 Tokens/秒,每百万输入 Token 12.5 美元,每百万输出 Token 75 美元。
- GPT-5.6 Terra:每百万输入 Token 2.5 美元,每百万输出 Token 15 美元。
- GPT-5.6 Luna:每百万输入 Token 1 美元,每百万输出 Token 6 美元。
除了模型本身,OpenAI 还进一步优化了 Prompt Cache(提示缓存)机制,引入更灵活的显式缓存断点,并将最低缓存时长提升至 30 分钟,以减少重复计算带来的 Token 消耗,从而进一步降低 API 使用成本。
对于 ChatGPT 订阅用户,新模型将在订阅额度内逐步开放,同时也可在 Codex 等开发工具中直接调用。