GPT-5.6降价20%-80%,智能成本4个月降13倍

7月30日,OpenAI通过Sam Altman的推文公布了GPT-5.6系列模型的大幅降价:GPT-5.6 Luna输入价格降至每百万tokens 0.20美元,降幅80%,输出价格1.20美元;Terra输入2美元、输出12美元,降幅20%;Sol新增Fast模式,速度提高2.5倍,价格为2倍,智能水平不变。文章同时指出,GPT-5.4级别智能的成本在4个月内下降了13倍。
OpenAI发布的优化细节显示,GPT-5.6 Sol能够主动分析生产流量、调优负载均衡,并自主用Triton和Gluon语言重写内核,使端到端服务成本降低20%。推测解码方面,通过自主设计实验改进草稿模型,token生成效率提升超过15%。KV缓存则针对不同工作负载优化批处理、分片和缓存管理。此外,Agentic Harness也做了改进,包括按需浮现工具和限制工具输出默认1万tokens,以及采用只追加的历史处理来维持高缓存命中率。
文章引用一年前的图表指出,保持LMSys Elo分数不变时,GPT-4级智能的成本在18个月内下降了1000倍。当时有人怀疑这是从密集模型到MoE、从补全到推理等“新手红利”。但此次GPT-5.6的优化证明,同等智能水平的成本仍在持续快速下降,并非一次性收益。
关键信息
- OpenAI于7月30日宣布GPT-5.6降价,Luna降80%至每百万tokens输入0.20美元、输出1.20美元
- Terra降20%至2美元/12美元,Sol新增Fast模式,2倍价格获得2.5倍速度
- GPT-5.6自优化内核使端到端服务成本降低20%,推测解码提升效率超15%
- 文章称GPT-5.4级别智能成本4个月下降13倍,延续成本下降趋势
- OpenAI还优化了Agentic Harness,包括限制工具输出和提示缓存
GPT-5.6 Sol gets Fast mode in the API, up to 2.5x the speed for 2x the price, same intelligence
GPT-5.6 Sol 在 API 中新增 Fast 模式,速度提升至 2.5 倍,价格为 2 倍,智能水平不变。
Latent Space
为什么上榜
如果你在调用GPT系列API,Luna降价80%和Sol快模式直接影响你的成本和速度。
每天早上,把当日 AI 精选送进你的邮箱
公众号 AI去噪 · 每日一期同步推送
