前几年,不少精美分子说我们的大模型,是在别人的桶里钓鱼。现在这群人都沉默了,为什么呢?因为有数据显示,现在是老美过来抄作业了,只不过咱们家的企业,并没有过激反应,反而还很欢迎而已。
Hugging Face刚刚公布了今年最新的开放模型数据,一个谁都看得出的变化就是,中国AI已经从追赶,变成了输出。这个变化来得有多快呢?从今年开始,几乎每个月,中国企业发布的开放模型,规模都超过了美国。最高做到2.78万亿参数,美国在过去7个月里,有5个月最大的开放模型,还不到1300亿。
最重要的还不是参数大不大,是有没有人用。Hugging Face的这组数据里面,有一个非常有意思的排名,就是点赞量和下载量,在前25名里,居然只有一个是重合的。什么意思呢?就是都在为自己家里面的模型点赞,到了使用的时候,真拿回去干活的时候,就原形毕露了,选择了别人家的模型。
这里面下载量最大的,就是中国模型。比如说,在Hugging Face上,基于千问做出来的衍生模型,就已经超过了15万个,是Llama的4.7倍。整个千问家族的下载量,已经超过20亿次。
这说明什么呢?说明全世界已经,不再质疑中国模型的质量了,开始大规模在中国模型的基础上,做各种应用和智能体了。
Hugging Face还特别补刀,说美国今年发布的一些千亿参数模型,也开始建立在中国模型之上了。就是说,他们开始蒸馏我们的模型了,开始到咱们家的水桶里钓鱼了。
很难想象吧,这个时代当美吹,脸必须得厚才行。以前咱们天天说,中国模型不可能追得上GPT,追得上Claude。现在必须要习惯,别家做应用,要先用中国模型。到了这一步,竞争已经分出个大概了,谁在做底座,谁就是赢家。
不要以为这就完了,底座这块才刚刚攻守易形,真正分出高下还需要一段时间。在顶层的应用端,中国模型的优势更加明显。Hugging Face上,十亿参数以下的小模型,占了83%的历史下载量。
这是为什么呢?因为真正把AI装进电脑、手机和企业系统里干活,很多时候拼的不是参数的多少,而是便宜、快、稳定、能跑,也就是我们说的极致性价比,这几乎就是中国人的天下。
大模型解决的是聪不聪明的问题,智能体解决的是能不能把活干完,这是两个概念。前者我们已经追上来了,后者我们明显占优。
这也是为什么,我会坚定看好中国AI的原因。不是说在某个权威网站上,又拿了一个第一,而是从电脑时代就有的焦虑,操作系统是别人的,芯片生态是别人的,连基础软件也是别人的。但是在人工智能时代,这些问题通通都没有了,就连国外的开发者,都开始拿中国模型做自己的AI了。
以前我们站在别人的肩膀上追赶,现在是别人站在我们的肩膀上往前走。这种技术自信,注定会让中国AI成为下一个时代的全球引擎。
