GPT-5.6降价20%-80%,智能成本4个月降13倍

Latent Space · 2026.07.31 12:40

7月30日,OpenAI通过Sam Altman的推文公布了GPT-5.6系列模型的大幅降价:GPT-5.6 Luna输入价格降至每百万tokens 0.20美元,降幅80%,输出价格1.20美元;Terra输入2美元、输出12美元,降幅20%;Sol新增Fast模式,速度提高2.5倍,价格为2倍,智能水平不变。文章同时指出,GPT-5.4级别智能的成本在4个月内下降了13倍。

OpenAI发布的优化细节显示,GPT-5.6 Sol能够主动分析生产流量、调优负载均衡,并自主用Triton和Gluon语言重写内核,使端到端服务成本降低20%。推测解码方面,通过自主设计实验改进草稿模型,token生成效率提升超过15%。KV缓存则针对不同工作负载优化批处理、分片和缓存管理。此外,Agentic Harness也做了改进,包括按需浮现工具和限制工具输出默认1万tokens,以及采用只追加的历史处理来维持高缓存命中率。

文章引用一年前的图表指出,保持LMSys Elo分数不变时,GPT-4级智能的成本在18个月内下降了1000倍。当时有人怀疑这是从密集模型到MoE、从补全到推理等“新手红利”。但此次GPT-5.6的优化证明,同等智能水平的成本仍在持续快速下降,并非一次性收益。

  • OpenAI于7月30日宣布GPT-5.6降价,Luna降80%至每百万tokens输入0.20美元、输出1.20美元
  • Terra降20%至2美元/12美元,Sol新增Fast模式,2倍价格获得2.5倍速度
  • GPT-5.6自优化内核使端到端服务成本降低20%,推测解码提升效率超15%
  • 文章称GPT-5.4级别智能成本4个月下降13倍,延续成本下降趋势
  • OpenAI还优化了Agentic Harness,包括限制工具输出和提示缓存

GPT-5.6 Sol gets Fast mode in the API, up to 2.5x the speed for 2x the price, same intelligence

GPT-5.6 Sol 在 API 中新增 Fast 模式,速度提升至 2.5 倍,价格为 2 倍,智能水平不变。

为什么上榜

如果你在调用GPT系列API,Luna降价80%和Sol快模式直接影响你的成本和速度。

每天早上,把当日 AI 精选送进你的邮箱

公众号 AI去噪 · 每日一期同步推送

AI去噪公众号二维码