GPT-5.6系列模型正式发布与开放
2026年6月30日,OpenAI宣布GPT-5.6系列模型结束为期4天的受限预览期,正式向全部开发者开放。该系列包含Sol、Terra和Luna三档模型,同步在ChatGPT、API以及Azure OpenAI Service三端上线。OpenAI官方表示,此前的受限预览期是基于美国政府6月18日更新的AI出口管制规则而要求的安全审查,而非公司自主选择。
在基础设施方面,Cerebras推理服务同步开通,为GPT-5.6 Sol Ultra提供最高750 tokens/s的吞吐速度高速通道。在定价上,Sonnet定价维持在每百万token 5美元输入和30美元输出不变,但通过新增的显式cache breakpoint与30分钟强制缓存,长prompt场景的成本可削减50%以上。
模型分层定位与实测表现
GPT-5.6采用了分梯度限速策略,三档模型针对不同应用场景进行定位:
- Sol(旗舰版): 定位于最强推理,适用于复杂交叉分析、科研数据建模、大型微服务代码重构等重度复杂任务。实测显示其上下文窗口提升至150万Token,在处理超长文档时无记忆断层。但其响应速度偏慢且算力成本较高。
- Terra(均衡版): 定位于日常工作与普通代码,适用于文案撰写、办公排版及中小型代码调试等场景。其推理能力接近GPT-5.5旗舰水平,但调用成本减半。
- Luna(轻量版): 定位于高频轻量化任务,如简单问答、批量生成短句及客服对话。该版本主打零延迟响应与低成本,但逻辑推理能力有限。
对比前代GPT-5.5,该系列在长文本归纳、跨内容对比、漏洞识别及工程化重构等方面的准确率有所提高。
功能升级与渠道扩展
在功能演进上,GPT-5.6增强了工具协作能力,支持“可编程工具的调用”。模型能够根据用户目标自主拆分任务、调用工具并编写轻量程序过滤数据,从而完成复杂工作流。
在分发渠道方面,亚马逊云服务(AWS)于2026年7月24日宣布,GPT-5.6系列模型已在Amazon Bedrock平台正式上线。企业客户可通过AWS调用这些模型,无需单独管理底层基础设施。
评论区
已通过 0 条 · 审核通过后展示