OpenAI:GPT-5.6成本砍一半,到底怎么做到的
小红书全在传GPT-6要来了。说实话我没看到什么实锤。但GPT-5.6这个版本本身OpenAI昨天发了一篇技术文把效率优化的底裤都扒了。看完最大的感受这代模型已经能自己优化自己的代码了。先看三个数字GPT-5.6 Sol 在编程Agent排行榜上干掉了 Claude Fable 5成本不到一半。Terra版轻量版智能跟GPT-5.5持平价格直接腰斩。最便宜的Luna版比Sol便宜80%。它怎么省下来的三层叠buff第一层推理内核重写。GPT-5.6 Sol 在 Codex 里自己写了GPU内核代码用 Triton 和 GluonOpenAI维护的两个开源GPU编程语言端到端服务成本降了20%。不是工程师写的是模型自己写的。第二层推测解码。搞了个小的草稿模型先猜答案大模型只负责验证。Sol自己跑了上百个实验优化这个草稿模型的架构token生成效率涨了15%。它连训练过程都自己管硬件故障了自己处理。第三层智能体编排层。用Rust写的核心三招工具延迟发现不用的工具不塞进上下文、仅追加上下文保持提示词前缀稳定→缓存命中率高、确定性工具排序避免重复计算。最狠的一点这不是OpenAI的工程师在做优化——是GPT-5.6自己优化自己。写内核、分析生产流量、发现负载不均、测试新路由策略全是Sol在Codex里自主完成的。说白了模型已经在给自己的推理引擎做手术了。10亿用户、200万企业的规模下每优化1%就是天文数字的成本。我的判断GPT-6的炒作不重要重要的是GPT-5.6已经在自我优化。这才是真正的技术跳跃。每token智能密度才是新战场。不是谁的模型更大是谁用同样的硬件跑出更多活。模型自己写内核代码这条路的尽头是AI优化AI。人类工程师的角色正在从写代码变成验收代码。引用[1] OpenAI 官方技术博客 — GPT-5.6 效率优化全面拆解→ https://openai.com/index/gpt-5-6-frontier-intelligence-efficiency