GPT 5.6 Luna降价以后,最近被人吹得多的几个开源模型已经没有使用价值了。2026年7月30日,OpenAI宣布GPT 5.6 Luna 降价80%。
绝大多数说开源模型性价比高的人,都是找错了比较对象。当年拿一个8B的模型去碰瓷GPT 4.1,真正世界表现连GPT 4.1 nano都比不过。GLM 5.2、Kimi K3,实际上可比模型只是GPT 5.6 Luna,一个小杯模型。这里面选用的是ECI指数,一个聚合benchmark指标。
很多benchmark已经饱和,几分的差距已经意义不大,很容易操纵。Epoch Capability Index (ECI)通过IRT方式,对于不同的benchmark难度系数进行了调整,相比于Artificial Analsysis直接取平均更能够体现出真实能力水平。

美国商务部标准研究院,同样使用IRT对于一组benchmark进行调整,GLM 5.2的能力和7个月前的GPT 5.2差不多。

同时要注意的是,这两个只是benchmark的聚合,并不能完全代表真实世界表现。例如Claude系列模型,就因为模型的品味、解决真实世界问题的能力,只看benchmark就会显著低估,但公司营收不会说谎。
在GPT 5.6 Luna价格只有输入0.2美元、输出1.2美元以后,价格甚至低于一些吹上天的开源模型。现实世界不是童话故事。GPT 5.6 Luna,能力差不多,价格还更便宜,服务更加稳定,吞吐速度快。更不用说OpenAI的品牌和声誉,GPT系列模型经过了全球10亿用户的检验。
除了给自己找不痛快,使用这几个拼命营销的开源模型已经失去了经济上使用的合理性,只能回到微调、私有部署这类已经被证明为死路一条的老调重弹了。
吹Kimi和GLM的人,绝大多数都是张口就来,比肩Fable 5、吊打GPT 5.6 Sol。就像当初Deepseek V4 Pro也想碰瓷GPT 5.5,但我早在2个月前就指出,V4 Pro真正可比模型只是GPT 5.4 mini;V4模型定价虚高,原价没有任何竞争力。

发表评论