PChome 7月31日消息,近日,OpenAI官方甩出一组数字:GPT-5.6 Sol参与的内核优化,让对外服务成本降了20%,token生成效率提升超过15%。
PChome 7月31日消息,近日,OpenAI官方甩出一组数字:GPT-5.6 Sol参与的内核优化,让对外服务成本降了20%,token生成效率提升超过15%。这次动的不是演示环境里的Demo,而是OpenAI每天承载十亿级用户请求的那套生产系统。

GPT-5.6通过Codex接入生产推理栈,分析真实流量、重写GPU内核、优化推测解码。它学习了Triton和Gluon两种GPU编程语言,自主改写底层代码,还针对draft模型设计并跑了数百次实验。说白了就是:让AI自己给自己改代码、调参数,把运行效率抠到极致。

目前模型写的代码仍需人类审核,关键决策仍由团队把控。但“让AI优化AI本身”这条路已经跑通了——分析流量、写代码、跑实验、验证结果,每一环模型几乎都能参与。当AI开始自己给自己打工,省下来的成本,最终会变成用户更便宜的账单。