月之暗面最强模型KimiK3发布 月之暗面扔了个大的——Kimi K3正式发布,参数2.8万亿,全球最大开源模型。看数据:
- 2.8万亿参数,MoE架构,896个专家,每次只激活16个- 100万Token上下文窗口,能塞下整套代码库或几十篇论文- 前端代码能力登顶Arena,1679分超越Claude Fable 5- 综合智能全球第三,仅次于Claude Fable 5和GPT-5.6 Sol- 从Kimi k2.6的第18名跳到第1名,跃升17位自研了个KDA注意力机制,长文本不丢信息,效率比上一代快2.5倍。
但月之暗面自己也说了,这模型有毛病:对历史思考内容高度敏感,中途切换模型会上下文干扰;行为过于主动,小问题容易自作主张;部署门槛高,推理成本不低。
国产大模型这次是真跟海外头部模型掰手腕了。参数堆到2.8万亿,不是傻大个,MoE架构省推理成本,100万上下文专治长文本。
参数大≠好用,官方自己都说了有毛病。吹得再响,开发者实测说了算。
能正面刚就是进步。国产大模型从追到并跑,K3算个里程碑。Kimi K3参数达2.8万亿KimiK3局限性
