OpenRouter最新一期的全球大模型真实调用量账单出炉,硅谷最不愿面对的一幕还是发生了。全球开发者用真金白银和代码请求,硬生生把这份榜单砸成了一场国产模型的“集体肌肉秀”。
仔细看这份榜单的前五名,战况可以用惨烈来形容:
第一名:DeepSeek V4.1 Flash,周调用量高达19.6万亿 Token,环比再涨24%,稳稳霸榜。
第二名:智谱 GLM 5.3 Flash,以16.3万亿 Token 紧随其后,暴涨16%。
第三名:仅上榜5天的匿名黑马 Space Bunny Alpha,疯狂轰出13.9万亿 Token,业界推测这大概率又是 MiniMax 系的杀手锏。
第四名:腾讯 Hy4 preview,输出 9.64万亿 Token。
直到第五名,才终于见到了昔日霸主 OpenAI 的身影——GPT-5.6 Luna 调用量只有 8.53万亿,而且还在持续下滑。
前四名全是中国系,美国只剩第5。
后排甚至还有小米 MiMo-V2.6-Flash 这种新势力杀入前八。
这可不是什么靠刷题凑出来的 BenchMark 跑分,而是全球开发者调用 API 跑出来的真实流量。
如果说跑分测试是实验室里的选美比赛,那 OpenRouter 的流量榜就是农贸市场的实际走货量。
眼下的竞争态势很有意思:硅谷巨头还在高高在上地讲着神级推理的科幻故事,把 API 定价捧成奢侈品;而中国开源与低价模型早已参透了商业的底层逻辑——极致性价比才是硬道理。
当别人还在算计着调用一次要花几美分时,国产 Flash 系列已经把算力做成了工业大塘电,量大管饱还便宜。全球的创业团队和程序员都不傻,在绝大多数落地场景里,能用极低成本搞定需求,谁还会去为高昂的魔法溢价买单?
当 AI 竞争从“谁的理论上限高”演变成“谁能把算力成本打到地心”,这场工程化和规模化倾泻的后劲才刚刚开始。
靠真实流量改写格局,属于硅谷的“高定价溢价神话”,这次是真的被彻底敲碎了。
