感觉GPT-6 Sol这次被Opus 5.5的性能完全给打懵了,OpenAI全员原地陷入下一轮备战。这会不会给OpenAI一种不好的错觉,即,便宜没那么重要?
它的便宜战略,不是轻易定下来、也不是公开表达的,而是从五月份Codex开始支持其他模型接入的时候,能够被观察到的战略级方向——不再求垄断,而是在价格上也能碾压开源模型。他们做到了。
尤其是这次的GPT-6 Luna比Astra便宜100倍。这种巨大的、里程碑式的性价比,竟然没能获得市场的奖励和带来良好的评价,完全被Opus 5.5的性能抢了风头,这是非常可惜的。性价比这一点是不能够动摇的,不能因为一两次没能获得应有的对待而放弃这一点。因为它是终极的、对抗开源模型的方式。
OpenAI的主线大致分这么几层,第一是旗舰模型维持世界前二的性能;第二是小模型维持全球最便宜的价格;第三,是有专用的模型主攻几千token每秒的速度;第四是维持C端庞大的用户;第五是维持最好用的编程Agent;第六是维持体量庞大的企业用户,第七是维持最强的图片生成,它和语音模型组成了多模态的底子,只要调度资源就能融合。不久会再增加个人云端Bot.
它要的太多。而从风险管理的角度来看,每一项都非常合理。尤其是性价比这一点,这种优势一直被低估,它的重要性也被低估。其实它是有关存亡的战略级重点。当然,他们都是绝顶聪明的人,不太可能说遇到一点小挫折,就放弃这个重点。在这一点上它已经走得很深,可以说,即使它的硬件和人工比开源的贵很多倍,拿出来的价格也可以做到低很多倍。
OpenAI的反击很快就会来。性能还是应该作为第一优先级。实际上大家都在怀疑,Sol只是把5.6 Sol蒸馏了一下。
在这个节骨眼,连我这种铁杆、尤其是不喜欢Anthropic的人,都想开个号了。所以OpenAI的出手必须足够迅疾。这一周还没有结束,新产品还会有。估计下一个版本的Astra也将呼之欲出。不是叫6.1 Astra,那就叫mini,不管叫什么,把Opus 5.5压下去是当务之急。这只是工程问题,不是技术问题。这只是去不去做的问题,而不是有什么门槛。
头部的用户的评价还是至关重要,个个都像大爷一样难哄。不管在真实的场景中,大多数用户需不需要用几倍的价格去换5%的智能提升。就是,你要满足大家对于“最强”的期待。随后才能谈到,你还便宜5倍、100倍这件事。
这跟普通的产业或产品真的不同。假如是个iPhone,顶配2万,普通版200块,大家会批评吗?人们会需要有故事可聊。人们的首先期待的还是“够不够强”。尽管我实际看下来,几乎没有人能够拿出实际的场景来证明这种差异,都是模板测试。
我当然也希望用到的是最强的模型,同时能够耐用。Astra很好,问题是太贵。如果后续,或者在未来几个月内,与Astra同等智能的模型,能够实现目前6 Sol的耐用,像我的那些史诗级的、几乎在地球上没人做过的大型软件工程,就可以轻松且不焦虑的去驾驭了。事实上,极少有用户玩到我那种广度和纵深,以至于比Astra低一点点智能,很多时候就都无法完成。