DC娱乐网

标签: kimi

德国之声昨晚(7月21日晚)写道:“【德语媒体:Kimi时刻到来–西方必须正

德国之声昨晚(7月21日晚)写道:“【德语媒体:Kimi时刻到来–西方必须正

德国之声昨晚(7月21日晚)写道:“【德语媒体:Kimi时刻到来–西方必须正视中国的成功】《新苏黎世报》发表评论称,KimiK3模型发布引起的轰动效应足以说明,西方已经不能再继续漠视中国的高科技实力了。《法兰克福汇报》评论称,德国车企如果不尽快找到应对中国挑战的策略,德国汽车工业就将面临生存考验。”评几句:德国之声转引《新苏黎世报》《法兰克福汇报》借KimiK3炒作“Kimi时刻”、预警德系车企“生存考验”,表面是难得承认中国AI与新能源实力,骨子里仍是西方叙事的老套路。《新苏黎世报》一边称西方不能再漠视中国高科技,一边仍将中国创新框定为“西方必须正视的挑战”而非平等合作对象。《法兰克福汇报》把德系车溃败归咎于“中国冲击2.0”,却对德企固守燃油车利润、电动化转型迟缓、软件定义汽车全面落后等自身结构性顽疾避而不谈。KimiK3作为全球最大开源模型逼近顶尖闭源水准确是事实,但德媒将此包装成“西方惊醒”的道德剧,可能是为了欧盟加码对华技术壁垒、产业保护政策刷舆论铺垫。
我有一种预感:第二个震惊硅谷的"梁文锋",已经出现了!谁能想到,DeepSee

我有一种预感:第二个震惊硅谷的"梁文锋",已经出现了!谁能想到,DeepSee

KimiK3麻烦了!我的kimiAllegle套餐的月度token额度一晚全

KimiK3麻烦了!我的kimiAllegle套餐的月度token额度一晚全

在欧美人看来Kimi的价格比Claude和chatGPT实惠,却能有相匹敌的实力

在欧美人看来Kimi的价格比Claude和chatGPT实惠,却能有相匹敌的实力

中国的应试教育慢慢开始在世界出新成果了,Kimi(月之暗面)创始人,九零后,曾

中国的应试教育慢慢开始在世界出新成果了,Kimi(月之暗面)创始人,九零后,曾

KimiK3发布,OpenAI急了!OpenAI新来的战略主管,在X上发了篇长

KimiK3发布,OpenAI急了!OpenAI新来的战略主管,在X上发了篇长

7月20日,月之暗面联合创始人周昕宇(XinyuYang),在X平台回复的一条

7月20日,月之暗面联合创始人周昕宇(XinyuYang),在X平台回复的一条

Kimi研究员XinyuYang亲自回应:OpenAI一个研究员几千张

Kimi研究员XinyuYang亲自回应:OpenAI一个研究员几千张

Kimi研究员XinyuYang亲自回应:OpenAI一个研究员几千张

Kimi研究员XinyuYang亲自回应:OpenAI一个研究员几千张

KimiK3最狠的,不是干掉同行。KimiK3出来以后,大家都在讨论Mini

KimiK3最狠的,不是干掉同行。KimiK3出来以后,大家都在讨论Mini

绝了,Anthropic指责kimi蒸馏其尚为开发的

绝了,Anthropic指责kimi蒸馏其尚为开发的

我的KIMI API调用3分钟的消耗太吓人了

我的KIMI API调用3分钟的消耗太吓人了

美国人现在开始大反思了!CMU顶级天才、Kimi-K3创始人杨植麟,坐拥留美

美国人现在开始大反思了!CMU顶级天才、Kimi-K3创始人杨植麟,坐拥留美

美反思流失华裔精英人才,连重金都挖不动墙角,硅谷模式已经过时了!KimiK3大

美反思流失华裔精英人才,连重金都挖不动墙角,硅谷模式已经过时了!KimiK3大

美反思流失华裔精英人才,连重金都挖不动墙角,硅谷模式已经过时了!KimiK3大模型一发布,美国媒体铺天盖地的讨论就从模型本身转向了创始人杨植麟。很多人追问:美国为什么没留住这个人?一款中国大模型登场,硅谷先盯技术指标,随后却把放大镜挪到了创始人的履历。模型能写代码、做研究固然吸睛,可更让美国科技圈坐不住的问题是,杨植麟在美国接受过顶尖科研训练,也得到过大企业招揽,为何最终选择回国创业?这不是一张签证能解释的故事,而是一场人才选择题正在改写答案。2026年7月14日,月之暗面发布KimiK3。官方资料显示,这款旗舰模型拥有2.8万亿参数,原生支持多模态能力,具备百万次元上下文窗口,重点面向软件工程、知识工作和深度推理。新华每日电讯随后将其称为全球参数规模最大的开源模型。模型亮相后,海外科技媒体迅速跟进,讨论也从跑分表格转向杨植麟为何离开美国。杨植麟本科毕业于清华大学,随后赴卡内基梅隆大学攻读计算机博士,长期研究自然语言处理和大模型。他曾在谷歌大脑和脸书人工智能研究机构实习,博士毕业后并不缺少留在美国科技行业的机会。这样的履历放在硅谷人才市场,基本属于招聘人员见了就想把咖啡端稳一点的类型。争议出现后,其博士导师萨拉胡特迪诺夫公开说明,杨植麟并不是因为抽签或签证问题被迫离开美国。他当时拥有多种职业选择,苹果方面也曾表达招揽意愿,甚至提到可以安排其在北京办公室工作。但杨植麟已经决定回国创业,希望亲手创建一家面向通用人工智能的公司,而不是在大企业里做一枚待遇优厚的螺丝钉。2023年4月,杨植麟领衔创立月之暗面。公司此后围绕长文本、基础模型、智能体和开源生态持续投入。KimiK3的出现,说明这条创业路线已经形成了可以被全球开发者检验的产品。美国舆论感到别扭的地方正在这里:门开着,职位摆着,薪酬也不会寒酸,可人才还是选择了另一条路。过去几十年,硅谷最强的武器并非办公楼,也不是永远喝不完的免费咖啡,而是全球优秀人才愿意汇聚于此。高薪、资本、大学和大企业共同形成吸力,人才在美国完成训练,再进入科技公司和创业体系。这套循环仍然存在,却不再只有一个中心。英国金融时报和美国华尔街日报近年都注意到,一批在美国工作的中国人工智能、机器人和生物医药人才正在回国发展。原因既有家庭和生活考虑,也有职业空间、产业机会和创业环境的变化。对顶尖研究者而言,能否主持项目、组织团队、决定技术路线,有时比工资数字多几个零更重要。这也解释了重金为何未必能挖到墙角。人才不是仓库里的零件,贴上更高价格就能自动搬家。科研人员要看算力、数据、工程团队和市场场景,也要看成果能否快速走出实验室。中国拥有完整产业体系、广阔应用空间和不断壮大的开发者群体,大模型可以进入制造、交通、金融、医疗和科研等领域,技术迭代更容易获得真实反馈。2026年,中国继续推进人工智能赋能行动,并强调开源社区、人才培养和产业协同。相关政策支持模型、工具和数据集开放,推动人工智能与重点领域深度融合。杨植麟也在人民日报撰文表示,中国开源模型正在成为全球创新的重要基座。开源不是把家底往门外一摆,而是用更多开发者、更丰富场景和更快迭代换取生态影响力。所谓硅谷模式已经过时,不能理解成硅谷失去了科研和资本实力。真正过时的,是把美国视为全球顶尖人才唯一终点的想法。今天的竞争,不再是谁能一次性挖走人才,而是谁能长期提供尊重创造、允许试错、支持创业的环境。硅谷的磁铁仍然很强,中国的磁场也已经形成。KimiK3引发的讨论,表面是模型较量,背后却是创新体系的较量。留住人才,靠的不是口号和支票,而是让研究者有项目可做、有团队可带、有成果可落地。美国需要反思人才吸引机制为何松动,中国则要继续完善基础研究、知识产权保护、科研评价和创业服务。科技竞争像跑马拉松,靠抢跑赢不了全程,靠挖走几名选手也建不起完整队伍。硅谷仍是重要创新高地,但不再拥有唯一答案;中国人才也完全可以在自己的土地上,把月之暗面走成一条明亮大道。
Kimi的LinearAttention(KLA)架构与数学原理大致是:线

Kimi的LinearAttention(KLA)架构与数学原理大致是:线

国外软件工程师对KIMIK3的测试评价,同样的任务Anthropic的Fabl

国外软件工程师对KIMIK3的测试评价,同样的任务Anthropic的Fabl

OpenAI称Kimi开源是减速主义说白了,意思就一点,你把最牛的模型开源了,那

OpenAI称Kimi开源是减速主义说白了,意思就一点,你把最牛的模型开源了,那

8月又有一个中国开源大模型要发布了!美国已经完全陷入了恐慌,特朗普焦躁不安,An

8月又有一个中国开源大模型要发布了!美国已经完全陷入了恐慌,特朗普焦躁不安,An

美国网友讨论杨植麟为何回国美国拟限制中国开源AI模型因为Kimi过于诚信经营,

美国网友讨论杨植麟为何回国美国拟限制中国开源AI模型因为Kimi过于诚信经营,

美国网友讨论杨植麟为何回国美国拟限制中国开源AI模型因为Kimi过于诚信经营,已经快让老外看不下去了😂月之暗面的KimiK3发布48小时后,由于过于火爆,导致GPU被打满了,直接宣布暂停新用户订阅。在官方公告贴下,老外开始反向给他出主意了:“你们为什么不继续收钱呢?把最好的模型从套餐里抽掉,悄悄换个便宜的,用户又发现不了。干嘛跟钱过不去?”看似出主意,实则阴阳其他一些AI大厂和中转站的基本操作。更常见的做法大家应该都体验过:付着同样的钱,突然觉得回答变蠢了,以为是自己的问题,其实是后台换了个便宜模型。目测Kimi的鲶鱼效应还得搅动一阵子,逼着AI模型厂商们在竞争中不断降价提量,最终受益的还是普通用户。
日本NHK电视台报道世界最新Ai排名,两位主持人表情有些沉重…Kimi称欢迎马斯

日本NHK电视台报道世界最新Ai排名,两位主持人表情有些沉重…Kimi称欢迎马斯

杨植麟,一个比梁文峰还牛逼的AI大牛…杨植麟,1992年生于广东汕头,月之

杨植麟,一个比梁文峰还牛逼的AI大牛…杨植麟,1992年生于广东汕头,月之

DeepSeek、Kimi接连爆火后,日本网上出现越来越多“反思派”。有日本学者

DeepSeek、Kimi接连爆火后,日本网上出现越来越多“反思派”。有日本学者

这是KimiK3出来之前,中美大模型的价格表,综合价格。仔细研究这个表,美国大

这是KimiK3出来之前,中美大模型的价格表,综合价格。仔细研究这个表,美国大

Kimi称欢迎马斯克加入现在大模型竞争早就不只是拼参数量了,比的是谁能把长上下文

Kimi称欢迎马斯克加入现在大模型竞争早就不只是拼参数量了,比的是谁能把长上下文

Kimi称欢迎马斯克加入现在大模型竞争早就不只是拼参数量了,比的是谁能把长上下文和视觉能力真正落地到实际场景里。马斯克把Kimi设为超越目标,反而证明国产AI已经成了国际巨头眼里的硬骨头。不过超越靠嘴说没用,还是等Grok4.6真跑出来跑个分再说吧,别到时候又延期了。
卡梅隆教授祝贺Kimi创始人取得巨大胜利!

卡梅隆教授祝贺Kimi创始人取得巨大胜利!

美国为什么没留住,大模型Kimi创始人杨植麟?这位在美留学生,曾和两位图灵奖

美国为什么没留住,大模型Kimi创始人杨植麟?这位在美留学生,曾和两位图灵奖

美国为什么没留住,大模型Kimi创始人杨植麟?这位在美留学生,曾和两位图灵奖获得者一起,发表过论文。毕业后谷歌微软苹果等大厂,随便挑。为什么却放弃美国高薪职位,选择回国创业,不简简单单的是,不拼搏一下,就不甘心。而且美国的科技领域对华裔,太不公平了。你有技术,有能力,要资金给资金,要待遇给待遇,但是要名声,抱歉那是美国人的。所有美国高科技领域的成就,几乎都有华裔的身影,但是一旦涉及到荣誉,所属权的时候,华裔名字就会被无情的抹掉。比如曼哈顿计划中的吴健雄,人类第一台计算机中的朱传榘,光遗传学,全球首个实现活体光控神经中的潘卓华,丙肝病毒攻克发现者:朱桂霖、郭劲宏,全球第一例实现人体细胞基因编辑,张锋。全球光纤通信之父高锟,航天商业火箭SpaceX骨干,等等。随便一个拿出来,都是碾压美国人的存在,但是获奖的只有美国人,华裔不但没有获奖,而且连名字身影都在宣传片里看不到。所以,Kimi大模型杨植麟回国创业,再正常不过,因为财富已经不重要了,学术名誉,才是新一代华裔华人科学家,一生最渴望的追求。
DeepSeek、Kimi接连爆火后,日本网上出现越来越多“反思派”。有日本学者

DeepSeek、Kimi接连爆火后,日本网上出现越来越多“反思派”。有日本学者

Kimi崛起这大模型的进化速度,是以倍来算的,K3相比原先的K2.5,总参

Kimi崛起这大模型的进化速度,是以倍来算的,K3相比原先的K2.5,总参

Kimi大模型,重点关注方向(附名单)一、参股与战略生态合作核心逻辑:直接或间接

Kimi大模型,重点关注方向(附名单)一、参股与战略生态合作核心逻辑:直接或间接

美媒:特朗普政府或禁尖端中国AI模型,Kimi崛起引美方警惕,中国的AI人工智能

美媒:特朗普政府或禁尖端中国AI模型,Kimi崛起引美方警惕,中国的AI人工智能

美媒:特朗普政府或禁尖端中国AI模型,Kimi崛起引美方警惕,中国的AI人工智能快速崛起,不断的说短跟美国人工智能的距离,特朗普害怕中国的AI人工智能大模型冲击美国AI人工智能的发展!中国的AI人工智能大模型比美国的更好用,美国在AI人工智能大量的投入可能也会受到波及,如果其他国家都开始使用中国的AI人工智能大模型,美国想在AI人工智能领域与中国的竞争同样会受到打击!中国的AI人工智能崛起引发了美国国内资本的恐慌!美国在AI人工智能领域大搞基础建设,投入了大量的资金。如果中国在AI人工智能领域超越了美国,美国将在AI领域出现盈利的效应会减弱!那负债率也将变得更高
美国人开始反思:美国为何留不住Kimi创始人杨植麟这种AI人才这几天K...

美国人开始反思:美国为何留不住Kimi创始人杨植麟这种AI人才这几天K...

看完Kimi创始人访谈才懂,AI新贵彻底告别老一辈企业家的江湖套路完整看完

看完Kimi创始人访谈才懂,AI新贵彻底告别老一辈企业家的江湖套路完整看完

马斯克和Kimi隔空对线了,兄弟们。事情是这样的——7月17日,月之暗面发布Ki

马斯克和Kimi隔空对线了,兄弟们。事情是这样的——7月17日,月之暗面发布Ki

我看了Kimi创始人杨植麟的访谈,说实话最大感受是:这一代的AI新贵,身

我看了Kimi创始人杨植麟的访谈,说实话最大感受是:这一代的AI新贵,身

有人觉得顶尖大模型是巨头和顶级科学家的专属游戏,但KimiK3告诉我们,一个1

有人觉得顶尖大模型是巨头和顶级科学家的专属游戏,但KimiK3告诉我们,一个1

OpenAI一主管批Kimi开源月之暗面于7月16日上线推出Kimi

OpenAI一主管批Kimi开源月之暗面于7月16日上线推出Kimi

K3发布后,美国互联网有帖子在讨论为什么杨植麟不留在美国?月之暗面发布Kimi

K3发布后,美国互联网有帖子在讨论为什么杨植麟不留在美国?月之暗面发布Kimi

重磅盘后利好汇总!利好一:工信部重磅定调,AI+制造全面加码7月20日工信部召开

重磅盘后利好汇总!利好一:工信部重磅定调,AI+制造全面加码7月20日工信部召开高规格座谈会,重点推进人工智能+制造业深度融合。明确加码算力、大模型、数据三大核心供给,加速智能装备技术攻关,推动人形机器人、脑机接口等前沿设备规模化普及。同时布局人工智能、低空经济新兴领域制度建设,整治行业无序内卷竞争,为AI产业长期健康发展保驾护航。利好二:Kimi暂停C端订阅,算力紧缺实锤,租赁赛道迎爆发头部国产大模型Kimi宣布暂停新用户订阅,将全部现有算力保障存量用户使用,并全力加速算力扩容。此次动作直接印证当前AI算力供需缺口紧张,算力瓶颈仍是行业核心痛点,强力催化算力租赁板块行情。同时Kimi技术跻身全球第一梯队,且启动港股上市进程,国产大模型商业化进度持续提速。利好三:WAIC完美收官,千亿级订单落地,AI产业热度爆棚2026世界人工智能大会圆满落幕,展会成果超预期:累计落地重点项目签约409亿元,意向采购203.6亿元,同比大幅增长。多款顶级黑科技产品全球首发,涵盖华为超节点、多模态大模型、智能体操作系统、AI智能体手机等硬核成果,标志国内AI产业化、实体化落地节奏全面提速。利好四:硬核产业数据出炉,科技制造高景气度延续工信部披露上半年核心经济数据:集成电路出口同比暴涨88.7%,电子元件出口增长62.6%;国内制造业AI普及率突破30%,人形机器人整机型号超400款、数量稳居全球第一。各项数据全面验证,高端科技制造正处于高增长上行周期。利好五:产业资本大手笔护盘,回购增持潮持续蔓延A股上市公司信心持续回归,大批龙头企业开启大额回购、增持、分红计划:华友钴业、三一重工、中国建筑、三峡能源、中国铝业、华鲁恒升等巨头,合计推出数十亿元级别的回购增持方案。7月以来全市场超469家上市公司披露相关增持回购公告,产业资本真金白银认可当前市场低位估值。利好六:外资重磅调仓,上调A股评级、看空海外市场国际投行花旗最新调整新兴市场配置策略:上调国内股市至“高配”评级,同步下调韩国股市至中性。机构明确看好国内AI行情向外扩散,全市场板块轮动修复空间充足,外资看多A股态度明确,为市场提供强力情绪与资金支撑。整体总结政策托底、产业爆发、算力紧缺、订单落地、资本护盘、外资看好,多重利好形成共振。当前A股底部信号不断夯实,AI算力、高端制造、国产科技赛道,有望迎来新一轮修复行情。⚠️以上内容仅为市场资讯整理复盘,不构成任何个股买卖、持仓投资建议。
外国网友都看不下去了,称中国人太老实,过于诚信经营,有钱赚为什么不赚?由于Ki

外国网友都看不下去了,称中国人太老实,过于诚信经营,有钱赚为什么不赚?由于Ki

Kimi回应马斯克隔空宣战,月之暗面深夜把KimiK3悄悄挂上官网,2.8万亿

Kimi回应马斯克隔空宣战,月之暗面深夜把KimiK3悄悄挂上官网,2.8万亿

苦涩1、近期科技很苦涩,也有人担心泡沫,我们近期也进行了很极限的思考与一些重要的

苦涩1、近期科技很苦涩,也有人担心泡沫,我们近期也进行了很极限的思考与一些重要的调研,就行业与投资聊聊自己的想法:1)首先模型迭代依旧迅速,KIMI率先证明了自己在模型参数3T时代的能力,非常顶。1T时代的王者智谱和deepseek预计接下来也会进入这个时代,而率先打入10T规模的claude也在不断向前。我们看到的是除了coding(程序员本身)与真正的工作流,模型必然在教师、学生、企业家(决策者)、白领(不止金融。分析师)形成极大的市场空间,这是不需要模型快速迭代就看得到的,而且时间并不长。claude可能到年底相较于去年底ARR9B翻了10多倍,OPENAI翻2倍,国内近期的各厂ARR起来也让我们震惊。到年底这至少是2000亿美金的市场,渗透率极低,渗透速度极快。模型仍然在不断突破边界,后面开源模型能力(K3算开放权重)的提升也会使得企业级、工作流加速,基本面渗透的速度确实太快,可能性还在扩张,产业带来的安全边际提升极快,正在快速接近CAPEX体量。2)第二个是硬件问题。这是一个很复杂的问题,近期也充斥着大量的谣言与悲观叙事,我们试图讲得更清楚。首先一个问题是认为中国的模型进步会形成挤压与硬件通缩,但细看之后,K3的2.8T模型价格约为FABLE51/3水平(模型规模也差不多1/3),约为K2.6(1T模型)的3倍。目前的推理路径来看,更大的算力会带来更好的效果与更快的速度,再叠加目前的渗透速度,算力一定是不够的,只是付费少就得忍受更慢更笨的模型而已。第二个是目前大量的“DELAY”叙事。我们上周进行了关键性的产业调研,无论近在眼前的VERARUBIN、CPO,还是明年的RUBINULTRAKYBER,都确确实实仍然按着计划推进,包括前一段的胜宏,也没有什么问题需要涉及到进度与份额。Q3是VERARUBIN和GOOGV8的开始,是景气加速的新一轮开始。第三个是供需稳定性、包括涨价制裁的问题。这里最典型的是存储,很多人纯被周期品这个词吓到,并未深入其必要性与供需关系。存储是整个这轮AI的必然需求,transformer底层机制,无论压缩token还是压缩attention都进行了多重尝试,压缩幅度也有限。市场担心的扩产其实比例极为有限,ASML光刻机也不够,远远满足不了指数级的需求。无非再担心的就是北美反垄断,这实际要大规模罚钱操作难度也很大,毕竟商业社会规则很容易反噬。供需环境2029年前不可能改善(包括长鑫的力度也很难快速改变全球供需),29年后也很难,龙头公司SK海力士目前仅27年3XPE。近期华尔街看多CSP看空硬件其实也很不符合产业逻辑,只是最近高锐度硬件的买盘(大型养老金休假、TRS平衡)减弱,再加上做空力量加强了这个叙事,高成长甚至是涨价链的很多领域壁垒其实比大家想的丰富的多,比如周五比电规划影响光互联的传闻已经有点无聊,我们相信真正的产业趋势才是最持续的逻辑。3)第三个问题是泡沫问题,这里最担心的是融资问题。首先我们看今年8/9家CSP差不多9000亿美金的投资,明年这几家考虑在1.4万亿美金左右,两家大模型预计融资2000亿美金。叠加AI带来的现金流增长,预计保障明年的其他家投融资量在2000-3000亿美金(谷歌等已融资完成,847.5亿美金股权,巴菲特参与),其中债务融资极低、neocloud债务融资也不超过400亿美金,且目前回款极快。AI是个极具潜力,ARR增速也极快的产业,历史上美国运河、铁路及电信光纤的债务占比分别达90%、46%和近100%,我们完全没有不要在债务比例极低的情况下去担心一定破不了的泡沫。除此之外,真正的高水平开源模型也会带来企业级的投入提升,而非CSP与大模型独自发力,全社会的ARR快则27年底,慢则28年也有望消化26年的资本支出。我们认为在产业极速发展,又没明确泡沫连锁可能时的担心是没有太大意义的。2、很多人先看到AI股票下跌,然后再寻找各种理由(如AI投资放缓、Capex削减、需求见顶)来解释股价,而不是依据真实数据。我列举了几项几个真正重要的事实:1)存储长期协议(LTA)仍在大量签订。企业愿意签多年期LTA,本身就说明客户认为未来几年供应仍将紧张,而不是需求即将结束。2)IBM最新披露显示需求仍然强劲。IBM表示,6月底最后几周,客户为了避免未来涨价,主动将资本开支提前用于采购服务器、存储和内存等供应紧张的AI基础设施。这反映的是抢货,而不是缩减采购。3)AI开始真正创造商业价值。Starbucks正在替换Microsoft和IBM部分软件,希望节省约4亿美元成本。他认为这说明AI已经进入企业降本增效阶段,商业化正在落地,而不是停留在概念。4)TSMC提高资本开支具有很强的信号意义。TSMC管理层一向非常保守,因此此次明显提高Capex,比任何分析师评论都更能说明他们相信AI需求具有长期持续性。5)Meta削减Capex的说法与公开信息相反。之前Reuters和CNBC报道指出,Meta不仅没有削减资本开支,反而计划2027年将AI算力进一步翻倍,并将路易斯安那数据中心规模扩大至5GW、投资超过500亿美元。因此,认为“Capex要削减”的说法是目前市场最大的误判。3、产业专家交流:关于KIMIK3与算力产业1)无可争议的强。2.8T的模型,KV缓存直接砍掉75%,1MTokens上下文解码窗口吞吐提升6.3倍,这些都是参数层面的强。AgentSwarm把任务推向了小时级别,只需要一句话,比如做一个炉石传说/奇迹暖暖游戏,在算力资源充足的情况下,2-3小时就可落地,人类一句话就能让AI自己工作的时代越来越近。2)训练的资源哪里来的:该2.8T的模型训练资源使用了接近2个B300万卡集群+数个H200集群,算力资源主要来自阿里云(阿里在kimi的持股超过30%),6月Qwen训练算力紧张后大幅减少了给KIMI的供应,后期KIMI向AWS等海外公司采购了部分算力支持自身训练需求,月租超过50万/台八卡服务器。3)下一阶段的算力需求减少了吗:整体需求成倍的增长。-训练:下一代6T的模型至少需要3-4个B300万卡集群+数个H200集群支撑训练,训练需求翻倍。-推理:目前订阅199的套餐,使用K3,10-12小时就能烧完,随着参数增加,推理算力的需求3-4倍。周末整个K3都是处于高峰期,用不了的状态4)算力资源缺疯了:KIMI目前账上准备了近400亿的现金,预计至少2/3会用来采购算力资源,智谱要加快追赶大参数模型,对算力资源的需求增加的更多,仅这两家训练+推理的需求近400亿/年,对应近13个万卡集群(阿里云和字节需求更多),下半年国内B300到货不会超过1万台,B300五年闭口长协租金接受度已经超过28万/月(年内租金上涨3倍),违约罚则30-40%,对有交付能力的公司另有10%的预付。5)大模型厂商和CSP继续扩大资本开支的动力:盈利能力强是最大的理由。现阶段互联网大厂、大模型厂商,算力投入产生的效益整体很高,如果不考虑训练的情况下,只将算力用于推理,下游厂商是真正意义上ROI>10,从这个角度来说算力再涨价1-2倍也是便宜的,考虑训练后ROI也>3,从Meta、谷歌等同行了解下来他们也没有要减少资本开支的动力。另外云厂商的ROI也超过2,考虑杠杆后ROI更高,整个产业发展非常良性,几乎每个环节都在赚钱。6)国内B300交付的情况:目前具备B300交付能力的公司不多。去年Q4和今年Q1整体比较容易拿,Q2以后所有非强绑定的二手渠道基本失效(期货渠道拿货也可以,得按现货加钱,目前某公司交付的256台,期货价格是4月定的550万,最后付款是1000万),原厂价格没什么变动,下游价格却到1300万了,一手货公司的价值大幅提升。Q2交付了256台B300以上的公司屈指可数,A股应该不超过6家。
前几天市场还在担心KimiK3会成为AI硬件的DeepSeek时刻,

前几天市场还在担心KimiK3会成为AI硬件的DeepSeek时刻,

美国媒体最近集体变脸了。 Axios在7月17日发了篇文章,标题起得挺狠,“

美国媒体最近集体变脸了。 Axios在7月17日发了篇文章,标题起得挺狠,“

一、K3到底是个什么东西?KimiK3是国内公司月之暗面(MoonshotA

一、K3到底是个什么东西?KimiK3是国内公司月之暗面(MoonshotA

DeepSeek、Kimi接连爆火后,日本网上出现越来越多“反思派”。有日本学者

DeepSeek、Kimi接连爆火后,日本网上出现越来越多“反思派”。有日本学者

DeepSeekV4能超越KimiK3吗好多人在争DeepSeekV4能不能

DeepSeekV4能超越KimiK3吗好多人在争DeepSeekV4能不能

老外已经把老中的AI大模型上升到共产主义范畴了老外把扬言要制裁或禁止Kimi

老外已经把老中的AI大模型上升到共产主义范畴了老外把扬言要制裁或禁止Kimi

AI圈吵得最凶的话题,就是Kimi等模型是不是通过“蒸馏”学到了Claude的能

AI圈吵得最凶的话题,就是Kimi等模型是不是通过“蒸馏”学到了Claude的能

AI圈吵得最凶的话题,就是Kimi等模型是不是通过“蒸馏”学到了Claude的能力说白了,就是学生模型有没有偷偷抄了老师的作业但问题没那么简单,AI时代,学习和复制的边界越来越模糊蒸馏本来就是行业常用技术,可如果未经授权大规模吸收竞争对手成果,那就是另一回事KimiK3开源后,争议更大了,到底是技术创新,还是能力搬运?
KimiK3模型跻身全球前列,中国以“开源”重塑全球AI竞争格局俄罗斯卫星

KimiK3模型跻身全球前列,中国以“开源”重塑全球AI竞争格局俄罗斯卫星

KimiK3模型跻身全球前列,中国以“开源”重塑全球AI竞争格局俄罗斯卫星通讯社2026年7月20日,16:50在2026世界人工智能大会暨人工智能全球治理高级别会议举行前夕,中国科技公司月之暗面发布了新一代开源模型KimiK3,参数规模达2.8万亿,成为目前全球参数最大的开源模型。北师香港浸会大学教授许粲昊接受俄罗斯卫星通讯社采访时表示,KimiK3的编码能力已跻身全球第一梯队,在美国技术制裁背景下取得这一成果实属不易。同时他指出,中美大模型发展路径存在鲜明差异,美国大多选择闭源,中国则坚持开源路线,这构成了当前全球AI竞争格局的重要特征。据月之暗面介绍,KimiK3模型基于KimiDeltaAttention混合线性注意力机制和AttentionResiduals注意力残差技术构建,原生支持视觉理解,具备100万词元上下文窗口,面向软件工程、知识工作、深度研究、多模态理解等复杂任务场景进行优化,进一步提升了大模型复杂任务的处理能力。通过模型结构、训练方法和数据配方等方面的优化,KimiK3相较上一代模型整体扩展效率提升约2.5倍。在评测中,KimiK3展现出全球领先的综合能力。在参与测试的模型中,KimiK3综合智能水平仅次于ClaudeFable5和GPT-5.6Sol两个前沿闭源模型,并在编程、视觉理解、知识工作和长程任务处理等方面表现突出。正如许粲昊所说,根据多家第三方机构的测评显示,其编码能力已进入全球第一梯队,前端网页编码性能更是达到全球顶尖水平,优于美国的Claude、GPT系列等闭源模型,其它编码能力则是与头部模型互有上下。“在中国AI企业受美国技术制裁的背景下,KimiK3作为开源模型能够达到这一性能水平,实属不易。”专家感叹道。KimiK3一经发布便引发全球关注。美国特斯拉公司CEO埃隆·马斯克在相关评测报道评论区留言:“Impressive(令人印象深刻)”。美国加州大学伯克利分校计算机科学教授、AI模型评测平台Arena联合创始人伊恩·斯托卡评价说,中国模型现在可能只落后美国“2到3个月”。美国Axios新闻网则直言,KimiK3“让开发者们眼前一亮,也震惊了硅谷,让人工智能领域的竞争局势在一夜之间发生了改变”。
中国为啥执意要走大模型开源的路?中美联手赚全世界的钱不香吗?一边搞AI版“

中国为啥执意要走大模型开源的路?中美联手赚全世界的钱不香吗?一边搞AI版“

美国人现在开始大反思了,kimi-k3的创始人杨植麟,博士毕业于美国卡内基梅隆大

美国人现在开始大反思了,kimi-k3的创始人杨植麟,博士毕业于美国卡内基梅隆大

Kimi回应马斯克隔空宣战马斯克称新模型可能超越Kimi前几天市场还在担心Ki

Kimi回应马斯克隔空宣战马斯克称新模型可能超越Kimi前几天市场还在担心Ki

我希望deepseek完胜,至少性价比和稳定性上,都好过kimi。冲了个kimi

我希望deepseek完胜,至少性价比和稳定性上,都好过kimi。冲了个kimi

中国开辟AI发展新路径:OpenAI的“减速主义”帽子扣错了地方。世界AI大会今

中国开辟AI发展新路径:OpenAI的“减速主义”帽子扣错了地方。世界AI大会今

美国人现在开始大反思了,Kimi-K3创始人杨植麟明明是卡内基梅隆大学博士出

美国人现在开始大反思了,Kimi-K3创始人杨植麟明明是卡内基梅隆大学博士出

KimiK2.6说温饱与大包干老哥请新升级的人工智能Kimi来谈谈中国人解决

KimiK2.6说温饱与大包干老哥请新升级的人工智能Kimi来谈谈中国人解决

DeepSeekV4能超越KimiK3吗整体来看现阶段DeepSeekV4很

DeepSeekV4能超越KimiK3吗整体来看现阶段DeepSeekV4很

马斯克承认Grok4.6“可能超越Kimi”,底气是K3在前端编程榜以1679

马斯克承认Grok4.6“可能超越Kimi”,底气是K3在前端编程榜以1679

马斯克宣称要赶超Kimi2026年7月,国产开源大模型KimiK3正式发布,凭

马斯克宣称要赶超Kimi2026年7月,国产开源大模型KimiK3正式发布,凭

马斯克宣称要赶超Kimi2026年7月,国产开源大模型KimiK3正式发布,凭借2.8万亿超大参数、100万超长上下文窗口,登顶全球AI编程榜单,性能超越多款美国顶尖闭源模型,刷新全球开源AI上限。一向习惯用“碾压”评价产品的马斯克,此次罕见谨慎表态旗下新模型“可能超越Kimi”,态度转变印证国产AI实力实现质的突破,证明中美AI竞争格局攻守易势。KimiK3依托先进架构,可高效完成芯片设计、前沿科研复现等高难度任务,且即将开放完整模型权重,大幅抬升全球开源技术门槛,引发海外科技股震荡。但从行业实际来看,该模型综合智能、场景稳定性仍落后国际顶级模型,存在功能局限与超高部署门槛,跑分优势不等同于落地优势,国产AI赶超依旧任重道远。
DeepSeek和Kimi成长的故事如今国产人工智能快速崛起,Deep

DeepSeek和Kimi成长的故事如今国产人工智能快速崛起,Deep

DeepSeek和Kimi成长的故事如今国产人工智能快速崛起,DeepSeek与Kimi两大模型备受认可,而背后两位创始人的少年初心与成长故事,也藏着国产AI蓬勃生长的温柔底色,风格截然不同,却同样治愈动人。DeepSeek创始人梁文锋,成长于广东湛江吴川的小镇教师家庭。九十年代的小镇物资匮乏,家里最贵重的电器是一台老式飞跃牌收音机。年少的梁文锋满心好奇,总爱探究事物底层逻辑,小学时便反复拆解、拼装这台收音机,前后拆装多达37次。多次拆坏、装回失败,他都不肯放弃,一点点摸索电路结构,最终成功修好机器。母亲时常因家电被拆解而无奈,可身为教师的父亲格外包容,从不制止他的探索,只叮嘱一句:拆完一定要完整装回去。这份自由探索的成长环境,让他养成拆解黑箱、溯源本质、死磕细节的思维习惯。如今这台老式收音机被珍藏在DeepSeek杭州总部展厅,时刻印证着:所有顶尖的AI底层创新,都始于少年时纯粹的好奇与深耕。不同于梁文锋扎根自我探索的成长路,Kimi所属月之暗面的创始人杨植麟,走的是反哺家乡、传递微光的成长之路。他是土生土长的汕头人,曾是汕头理科状元,凭借优异成绩保送清华,深耕AI领域,最终打造出出圈的Kimi大模型。功成名就后的杨植麟,始终怀揣潮汕子弟的乡土情怀。深知粤东学子缺乏一线AI行业资源与前沿视野,即便常年奔波于北京、上海的科创一线,他仍坚持抽空回到汕头大学义务讲课。他从不空谈成功学,只为家乡学子科普硬核AI知识、分享行业真实路径,坦诚讲述自己求学、科研、创业的坎坷与心得,填平家乡学子的信息差。课堂上的他谦逊亲和,耐心解答学生的升学、实习、科研困惑,还主动开放企业实习通道,发掘扶持本土科技人才,用自己的力量,把一线AI资源带回家乡,助力年轻一辈成长。一位从小镇拆收音机起步,以极致探索攻克AI底层技术;一位从潮汕故土走出,以初心善意反哺家乡青年。两位青年创业者,两种成长底色,各自发光。一人专注深耕技术本心,一人坚守温情社会责任,也正是这份纯粹的热爱与担当,支撑着DeepSeek与Kimi持续迭代、稳步成长,成为国产人工智能赛道的中坚力量。
OpenAI称Kimi开源是减速主义这完全是站自己利益说话,他不是担心AI发

OpenAI称Kimi开源是减速主义这完全是站自己利益说话,他不是担心AI发

OpenAI说Kimi开源是“减速主义”?笑死我了!这不就是闭源巨头急了,眼看技

OpenAI说Kimi开源是“减速主义”?笑死我了!这不就是闭源巨头急了,眼看技

美国媒体现在集体反思一个问题:Kimi-K3创始人杨植麟,卡内基梅隆博士毕业,美

美国媒体现在集体反思一个问题:Kimi-K3创始人杨植麟,卡内基梅隆博士毕业,美

美国媒体现在集体反思一个问题:Kimi-K3创始人杨植麟,卡内基梅隆博士毕业,美国的H1B签证为什么没留住他?说实话,这事真够给咱长脸的。当年拼了命想把全球人才往自家揽的美国,现在居然开始算”流失账”了。答案其实很简单:哪里有舞台、哪里能干事、哪里有上升空间,人才就往哪里去。H1B签证不是万能的,当中国的AI产业能给顶尖人才提供同等甚至更好的平台时,人才回流就是必然趋势。这不是个案,是时代风向变了。当年杨植麟博士毕业时,苹果高管亲自发邮件邀约,甚至开出了能直接向库克汇报的岗位。得知他想回国后,苹果还松口说可以安排北京分部的职位,等于把留美、海外就业的所有通道都敞开了。谷歌、Meta也没闲着,高薪offer堆着送,换谁看都是躺着赢的人生剧本,但杨植麟偏偏选了最难的那条路。他跟导师说过一句话:“如果连创办自己公司的机会都不试,我会后悔一辈子。”这句话道破了核心。在美国,顶尖AI人才的归宿似乎只有一条:进入谷歌、亚马逊这类科技巨头,做个高薪研究员。2026年H1B申请数据显示,亚马逊一年就拿了4644个H1B名额,微软、谷歌也紧随其后,它们能给的是优渥待遇,却给不了“自己说了算”的舞台。杨植麟想要的,恰恰是主导权。这位清华本科、CMU博士的天才,读博期间就搞出了Transformer-XL、XLNet两大架构,直接解决了大模型长文本遗忘的难题,现在全球大模型的长上下文技术都还在沿用他的思路。27岁就拿遍英伟达学者、西贝尔学者奖项,论文引用量在全球华人NLP领域青年学者里排第一,这样的人注定不甘心只做别人团队里的一颗螺丝钉。回国后的发展轨迹,印证了他的判断。2019年博士毕业,他没有急着创业,而是先带着循环智能团队和华为云合作研发千亿级盘古大模型,积累企业服务和大模型研发经验。等到2023年创立月之暗面,时机成熟的他直接发力,最新推出的KimiK3在编程、智能体测试中,硬是超过了OpenAI的GPT-5.5和Anthropic的ClaudeOpus4.8,冲进了全球模型第一梯队。更关键的是,国内能给的支持,美国给不了。杨植麟曾说,中国有快速发展的AI产业、充足的本土资本,还有庞大的工程人才储备,这些能让他迅速组建一支“能打的团队”。2025年国务院出台的“人工智能+”行动意见里,明确提出要给青年人才更大施展空间,支持企业用股权、期权激励人才。到了2026年,国家发改委又在世界人工智能大会上发布《人工智能合作发展行动计划》,从数据、算力、生态全方位支持AI发展。这些政策不是空话。就像上海交大的谢伟迪,牛津博士毕业放弃教职回国,在“AI+生命科学”领域深耕,不仅拿到了国家高层次人才支持,还带着团队搞出了全球首个罕见病诊断AI系统DeepRare,相关成果登上《自然》杂志。现在他既是高校副教授,又是创业公司CEO,这种“科研+产业”的双重舞台,在海外很难实现。反观美国,即便H1B签证的拒签率只有2.5%,但移民流程的不确定性一直是硬伤。就算是CMU顶尖博士,也得面对漫长的等待和未知的结果。更重要的是,美国的AI生态已经形成固化格局,大公司垄断着算力和数据,初创公司很难有突围的机会。而中国的AI市场还在快速成长,从医疗到制造,从教育到农业,到处都是空白赛道,这正是创业者最看重的机会。杨植麟的选择,本质上是人才对发展环境的用脚投票。美国媒体纠结于H1B签证,却没看清核心:当中国能提供同等甚至更优的科研条件、更广阔的市场空间、更灵活的创业支持时,单纯的签证和高薪已经失去了吸引力。江苏最近推出的AI技能培训计划,每年要培养20万人次,从专业技术人员到失业人员都能参与,这种全民AI素养的提升,正是产业发展的肥沃土壤。现在再看,美国失去的不只是一个优秀的算法工程师。杨植麟回国后,不仅打造出能和美国AI巨头抗衡的产品,还搭建起自己的技术团队和生态。这种“从0到1”打造世界级AI公司的能力,是美国当初没能留住,也没能预见的。就像网友说的:“他们以为放走的是一只鸟,没想到飞走的是一整个凤凰巢。”谢伟迪的DeepRare已经诊断了全球一万五千例罕见病案例,杨植麟的KimiK3正在冲击全球AI的格局。越来越多海外顶尖人才选择回国,不是因为国外不好,而是因为国内的机会更好。这里有让人才放手一搏的舞台,有支持创新的政策环境,有把技术变成产品的庞大市场。H1B签证从来不是留住人才的万能钥匙,真正能留住人才的,是让他们看到“能干成事”的希望。杨植麟的故事不是孤例,而是时代风向转变的缩影。当中国的AI产业从追赶到并跑,再到部分领跑,人才回流就成了必然。未来,还会有更多“杨植麟”选择回国,因为这里的舞台,足够大。
美国媒体现在集体反思一个问题:Kimi-K3创始人杨植麟,卡内基梅隆博士毕业,美

美国媒体现在集体反思一个问题:Kimi-K3创始人杨植麟,卡内基梅隆博士毕业,美

美国媒体现在集体反思一个问题:Kimi-K3创始人杨植麟,卡内基梅隆博士毕业,美国的H1B签证为什么没留住他?说实话,这事真够给咱长脸的。当年拼了命想把全球人才往自家揽的美国,现在居然开始算”流失账”了。答案其实很简单:哪里有舞台、哪里能干事、哪里有上升空间,人才就往哪里去。H1B签证不是万能的,当中国的AI产业能给顶尖人才提供同等甚至更好的平台时,人才回流就是必然趋势。这不是个案,是时代风向变了。当年杨植麟博士毕业时,苹果高管亲自发邮件邀约,甚至开出了能直接向库克汇报的岗位。得知他想回国后,苹果还松口说可以安排北京分部的职位,等于把留美、海外就业的所有通道都敞开了。谷歌、Meta也没闲着,高薪offer堆着送,换谁看都是躺着赢的人生剧本,但杨植麟偏偏选了最难的那条路。他跟导师说过一句话:“如果连创办自己公司的机会都不试,我会后悔一辈子。”这句话道破了核心。在美国,顶尖AI人才的归宿似乎只有一条:进入谷歌、亚马逊这类科技巨头,做个高薪研究员。2026年H1B申请数据显示,亚马逊一年就拿了4644个H1B名额,微软、谷歌也紧随其后,它们能给的是优渥待遇,却给不了“自己说了算”的舞台。杨植麟想要的,恰恰是主导权。这位清华本科、CMU博士的天才,读博期间就搞出了Transformer-XL、XLNet两大架构,直接解决了大模型长文本遗忘的难题,现在全球大模型的长上下文技术都还在沿用他的思路。27岁就拿遍英伟达学者、西贝尔学者奖项,论文引用量在全球华人NLP领域青年学者里排第一,这样的人注定不甘心只做别人团队里的一颗螺丝钉。回国后的发展轨迹,印证了他的判断。2019年博士毕业,他没有急着创业,而是先带着循环智能团队和华为云合作研发千亿级盘古大模型,积累企业服务和大模型研发经验。等到2023年创立月之暗面,时机成熟的他直接发力,最新推出的KimiK3在编程、智能体测试中,硬是超过了OpenAI的GPT-5.5和Anthropic的ClaudeOpus4.8,冲进了全球模型第一梯队。更关键的是,国内能给的支持,美国给不了。杨植麟曾说,中国有快速发展的AI产业、充足的本土资本,还有庞大的工程人才储备,这些能让他迅速组建一支“能打的团队”。2025年国务院出台的“人工智能+”行动意见里,明确提出要给青年人才更大施展空间,支持企业用股权、期权激励人才。到了2026年,国家发改委又在世界人工智能大会上发布《人工智能合作发展行动计划》,从数据、算力、生态全方位支持AI发展。这些政策不是空话。就像上海交大的谢伟迪,牛津博士毕业放弃教职回国,在“AI+生命科学”领域深耕,不仅拿到了国家高层次人才支持,还带着团队搞出了全球首个罕见病诊断AI系统DeepRare,相关成果登上《自然》杂志。现在他既是高校副教授,又是创业公司CEO,这种“科研+产业”的双重舞台,在海外很难实现。反观美国,即便H1B签证的拒签率只有2.5%,但移民流程的不确定性一直是硬伤。就算是CMU顶尖博士,也得面对漫长的等待和未知的结果。更重要的是,美国的AI生态已经形成固化格局,大公司垄断着算力和数据,初创公司很难有突围的机会。而中国的AI市场还在快速成长,从医疗到制造,从教育到农业,到处都是空白赛道,这正是创业者最看重的机会。杨植麟的选择,本质上是人才对发展环境的用脚投票。美国媒体纠结于H1B签证,却没看清核心:当中国能提供同等甚至更优的科研条件、更广阔的市场空间、更灵活的创业支持时,单纯的签证和高薪已经失去了吸引力。江苏最近推出的AI技能培训计划,每年要培养20万人次,从专业技术人员到失业人员都能参与,这种全民AI素养的提升,正是产业发展的肥沃土壤。现在再看,美国失去的不只是一个优秀的算法工程师。杨植麟回国后,不仅打造出能和美国AI巨头抗衡的产品,还搭建起自己的技术团队和生态。这种“从0到1”打造世界级AI公司的能力,是美国当初没能留住,也没能预见的。就像网友说的:“他们以为放走的是一只鸟,没想到飞走的是一整个凤凰巢。”谢伟迪的DeepRare已经诊断了全球一万五千例罕见病案例,杨植麟的KimiK3正在冲击全球AI的格局。越来越多海外顶尖人才选择回国,不是因为国外不好,而是因为国内的机会更好。这里有让人才放手一搏的舞台,有支持创新的政策环境,有把技术变成产品的庞大市场。H1B签证从来不是留住人才的万能钥匙,真正能留住人才的,是让他们看到“能干成事”的希望。杨植麟的故事不是孤例,而是时代风向转变的缩影。当中国的AI产业从追赶到并跑,再到部分领跑,人才回流就成了必然。未来,还会有更多“杨植麟”选择回国,因为这里的舞台,足够大。
DeepSeekV4能超越KimiK3吗国产大模型现在真不玩纯拼参数的虚的了,

DeepSeekV4能超越KimiK3吗国产大模型现在真不玩纯拼参数的虚的了,

DeepSeekV4能超越KimiK3吗最近AI圈的更新速度真是快的离谱呀,De

DeepSeekV4能超越KimiK3吗最近AI圈的更新速度真是快的离谱呀,De

OpenAI称Kimi开源是减速主义看到这段真的忍不住乐了,打不过就开始耍无赖,

OpenAI称Kimi开源是减速主义看到这段真的忍不住乐了,打不过就开始耍无赖,

老外和他朋友在聊Kimi(中国的AI大模型),被他女朋友以为是一个中国模特

老外和他朋友在聊Kimi(中国的AI大模型),被他女朋友以为是一个中国模特

OpenAI称Kimi开源是减速主义外国佬看到咱得大模型水平追上来就开始酸了

OpenAI称Kimi开源是减速主义外国佬看到咱得大模型水平追上来就开始酸了KimiK3对整个AI产业的积极意义:❶架构创新和数据质量打造国产模型新标杆:1)K3定位2.8T开源通用模型,主攻长程编程、Reasoning推理、知识工作和视觉理解等,在ArtificialAnalysis的IntelligenceIndex中Rank3、AgenticIndex中Rank3和ArenaFrontendCode中Rank1;2)K3是国产模型在通用场景和性能的双重新标杆,在游戏开发/CAD/反编译、深度研究报告可视化、严谨知识工作、EDA模拟、视频剪辑等任务上接近Fable5水平;3)K3在长程Agent任务上表现优异,其GPUKernel优化、从零构建GPU编译器MiniTriton、48小时自主芯片设计、2小时完成研究员1-2周的科研编程、3D游戏开发等案例都刷新了产业对开源模型long-horizonagency能力的预期;❷超大参数MoE开源模型将释放CSP和国产超节点红利:1)无所谓算力通缩,K3作为的一个2.8T参数量的超大稀疏MoE(896激活16),仅权重就占用>1.5T的HBM容量(MXFP4下),并采用了极其稀疏的专家并行方案(WideEP),推理Infra对scale-up域的容量和带宽要求极高,需要部署在64卡以上的超节点上做推理;2)腾讯/华为/阿里/Vercel/OpenRouter等已率先完成K3模型上线,已有国产芯片完成自部署适配和模型上线,预计更多hyperscaler和neocloud厂商将完成模型接入、并在7/27的权重开放后完成自有算力适配和部署;3)国产超节点在算力调度池化、PD+vLLM、Mooncake分离式推理、分布式KVCache池、多级缓存&缓存降级等方案上的架构适配和大规模生产落地将进一步享受开源模型的红利,随着Infra推理调度的进一步优化和超节点的商业化,CSP和国产算力将进一步享受顶级开源模型的利润再分配机遇;❸K3在Infra架构和模型性能上仍有优化空间:1)K3默认max思考强度的token消耗超过常规模型,指令模糊时的"过度主动"既有行为失控风险、也进一步推高消耗;2.8T级权重带来极高部署门槛,限制非数据中心算力的利用;实测Output62TPS低于同档模型中位数(72TPS,但TTFT1.99s反而占优);2)用户反馈缓存保留仅10分钟,可能系KDA快照缓存只能精确续写、无法像PagedKV部分复用,命中语义存在架构级差异;而保留时长偏短更可能是快照适配在Infra侧尚未成熟的工程问题;3)当前Agent框架须完整回传历史思考,不适用级联调度下的多模型切换场景;SwarmMax在K3规模下的调度稳定性尚待第三方验证;❹K3的发布对产业的影响显然是更积极的:1)SOTA模型之间的竞争正在加剧。Anthropic近期已持续加大让利(Fable5以50%额度常驻Max订阅、CC周额度上调50%并延长至8/19),GPT-5.6与K3的推出将使其高份额&高毛利面临更直接的竞争压力。但“模型能力天花板远未到顶”是产业里的共识,SOTA模型的交替领先不仅利好上游算力的叙事,也能催使更SOTA的模型早日推出,并加速产业红利进一步向下游应用传导;2)CSP凭借其算力规模效应和生态粘性逐渐掌握了未来模型的分发权和下游应用的拓荒权,将扮演产业趋势里“承上启下”的关键角色。开源模型的崛起和用户数据主权意识的唤醒,正在让CSP与闭源模型公司在生产级的推理市场中占据上风,同时也意味着将Anthropic的ARR作为跟踪行业景气度的唯一指标将不再可取,后续CSP的表述口径&数据披露将会更加关键。
KimiK37月16日发布,DeepSeekV4满血版今天灰度铺开

KimiK37月16日发布,DeepSeekV4满血版今天灰度铺开

美国人现在开始大反思了,国产Kimi-K3大模型领跑全球AI赛道,引爆美国科技圈

美国人现在开始大反思了,国产Kimi-K3大模型领跑全球AI赛道,引爆美国科技圈

DeepSeekV4能超越KimiK3吗国产大模型这场竞争,已经不是“能不能追上

DeepSeekV4能超越KimiK3吗国产大模型这场竞争,已经不是“能不能追上

DeepSeekV4能超越KimiK3吗国产大模型这场竞争,已经不是“能不能追上”,而是开始正面比谁更好用了。KimiK3刚凭借2.8万亿参数、100万Token上下文和编程能力刷了一波存在感,DeepSeekV4满血版可能最快今日上线:一个把长任务、写代码和Agent能力推得更高,一个可能继续靠性能与成本之间的平衡抢市场,看起来像是参数王者对上性价比高手。但我觉得,跑分领先不等于普通用户用起来就一定更好。真正决定我会长期使用谁的,还是回答稳不稳、写代码能不能一次跑通、处理长文会不会丢信息,以及接入自己的工作流程后是否省时间。现阶段我更期待先上手DeepSeekV4,看看它能不能保持过去那种简单、直接、成本可控的优势;KimiK3则更适合拿来挑战复杂项目。两款模型谁赢不重要,重要的是国产大模型终于开始在性能、价格和生态上同时较劲了。deepseekv4能超越kimik3吗科技先锋官
KimiK3引发算力逻辑讨论Kimi好用,但是你用的起吗?

KimiK3引发算力逻辑讨论Kimi好用,但是你用的起吗?

KimiK3引发算力逻辑讨论最近KimiK3上线直接吵翻AI圈,不

KimiK3引发算力逻辑讨论最近KimiK3上线直接吵翻AI圈,不

KimiK3引发算力逻辑讨论今天的科技热搜被KimiK3霸榜了,还有说干崩

KimiK3引发算力逻辑讨论今天的科技热搜被KimiK3霸榜了,还有说干崩

中国为什么要开源大模型?中美联合起挣钱不好吗?中国搞个华约,美国搞个北约。各自收

中国为什么要开源大模型?中美联合起挣钱不好吗?中国搞个华约,美国搞个北约。各自收

我国超级大模型发起总攻!KimiK3(2.8T)刚以开放权重强势登顶前端编码榜

我国超级大模型发起总攻!KimiK3(2.8T)刚以开放权重强势登顶前端编码榜

我看了Kimi创始人杨植麟的访谈,说实话最大感受是:这一代的AI新贵,身上显然已

我看了Kimi创始人杨植麟的访谈,说实话最大感受是:这一代的AI新贵,身上显然已

享界g9越看越好看!马斯克宣称要赶超Kimi鸿蒙智行

享界g9越看越好看!马斯克宣称要赶超Kimi鸿蒙智行

Kimi员工在x上发文:“我们走后,他们会给你们修学校和医院,会提高你们的工资,

Kimi员工在x上发文:“我们走后,他们会给你们修学校和医院,会提高你们的工资,

美媒基于中国AI公司月之暗面于7月16日发布的全球最大开源模型KimiK3,普

美媒基于中国AI公司月之暗面于7月16日发布的全球最大开源模型KimiK3,普

外媒称中国在一个下午就烧掉了美国AI的领先优势!7月16日,中国初创

外媒称中国在一个下午就烧掉了美国AI的领先优势!7月16日,中国初创

Kimik3暂停新订阅的技术原因:1,GPU(H100、H200、B300)算

Kimik3暂停新订阅的技术原因:1,GPU(H100、H200、B300)算

【月之暗面Kimi团队:算力紧缺,即日起暂停C端新用户订阅】7月19日,月之暗

【月之暗面Kimi团队:算力紧缺,即日起暂停C端新用户订阅】7月19日,月之暗面Kimi发布关于算力紧缺与会员暂停开放的说明:Kimi团队决定即日起,暂停C端新用户订阅,将已有算力全部投入于服务已订阅用户,保障已订阅用户的全部权益不受影响。同时,我们已在全速推进算力扩容。随着新算力陆续到位,将逐步开放更多订阅名额直至全面恢复正常订阅。对于后续新订阅用户,我们将拆分Kimi主权益(包含KimiWeb,KimiAPP,KimiWork)和KimiCode权益,以方便更精准匹配算力,保障用户体验。
KimiK3这波属实是“杀疯了”——全球第一个把3万亿参数塞进开源模型的狠角

KimiK3这波属实是“杀疯了”——全球第一个把3万亿参数塞进开源模型的狠角

马斯克宣称要赶超Kimi刚听到这消息,我都感觉有点懵,不应该是那anthropi

马斯克宣称要赶超Kimi刚听到这消息,我都感觉有点懵,不应该是那anthropi

马斯克宣称要赶超Kimi刚听到这消息,我都感觉有点懵,不应该是那anthropic和OpenAI的大模型对比。但这点看错马斯克的诚实,grok的大模型,跟anthropic和OpenAI比,确实赶不上,但和Kimi的差距确实是毫厘之间,说赶超Kimi一点毛病都没有。
OpenAI真急眼了。KimiK3发布之后,OpenAI的未来战略部门负责人D

OpenAI真急眼了。KimiK3发布之后,OpenAI的未来战略部门负责人D

【#环球时报社评#:中国AI大模型,为啥能再次轰动世界】导读:KimiK3大模

【#环球时报社评#:中国AI大模型,为啥能再次轰动世界】导读:KimiK3大模

【#环球时报社评#:中国AI大模型,为啥能再次轰动世界】导读:KimiK3大模型的发布,见证了一种不同于西方封闭路径的“中国方案”,为“开源理念”的成功写下新注脚。中国AI大模型的技术赶超,属于中国,也属于世界近日,北京月之暗面科技有限公司发布新一代模型KimiK3,这是目前全球参数最大的开源模型。发布不到一天,KimiK3登顶国际权威的FrontendCodeArena(前端编程竞技场)排行榜,并在其他多项基准测试中表现不俗。外媒纷纷表示,KimiK3的表现“Impressive(令人印象深刻)”。KimiK3不仅在整个人工智能(AI)行业引发惊叹,也在硅谷和华盛顿引发“警觉”,甚至有美媒夸张地宣称中国“抹去了美国AI的领先优势”。面对纷繁复杂的国际声音,我们需要保持清醒的自我认知。一方面,进步确实值得骄傲。2.8万亿参数、百万词元上下文窗口、原生多模态理解,表明中国大模型在开源赛道上已具备世界级竞争力。另一方面,我们并未达到“全面超越”的地步。美国在最前沿闭源模型、芯片生态、人才集聚和商业闭环上仍拥有显著优势。说中国AI即将“战胜美国”,不排除只是在为美国加码对华芯片禁运、扩大技术封锁准备借口。中国AI的每一步都是踏实走出来的,其价值无需他人定义,更不应被外界的“捧杀”所误导。至于所谓“中国偷窃说”的鼓噪,是时候该歇歇了。这些噪音只是表达了部分西方舆论对“中国能持续创新”的不适应,本质上是习惯性的情绪发作。KimiK3取得突破的核心,在于自主研发的底层模型架构,以及一整套科学的模型训练方法,绝不是简单复制西方模型就能做到的。西方模型同样大量使用全球公开数据,包括来自中国的内容,凭什么指责中国是“偷窃”,他们就是“合法借鉴”呢?这明显是双标。事实上,开源与价格优势,正是KimiK3两大核心竞争力所在。与西方高估值闭源模型相比,它以更低成本提供接近前沿的性能。更重要的是,它让全球开源生态士气大振。据月之暗面表示,7月27日前,KimiK3的完整模型权重将会公布,全球开发者都可下载、部署、二次开发。这意味着全球顶级的大模型能力,不再只是少数公司的牟利工具,而是成为各国开发者共同的起点。目前中国AI开源大模型累计下载量突破100亿次,居全球首位。开源非但没有削弱中国企业的竞争力,反而让竞争力长在了全球创新生态之上,包括美国公司在内的全球中小企业都受益良多。这恰恰说明,AI不是零和博弈的赛场,而是全人类共同创新的沃土。如果说去年DeepSeek横空出世时,西方世界还普遍将其视为一次“意外突破”,或看作一个中国初创公司在特定条件下的“运气爆发”,那么上个月智谱旗舰模型GLM-5.2和如今KimiK3的登场,则已悄然改变这场叙事,让世界更多看到中国“可持续创新”的实力。中国大模型的不断突破,证明西方的技术封锁和打压不仅没有压垮中国,反而刺激了本土创新链的快速构建,展现出中国科技“限制下的韧性”。西方媒体对KimiK3或中肯、或夸张、或抹黑的评价里,藏不住对中国技术进步的客观认可,也藏不住对“围堵中国”失败的焦虑。KimiK3的发布正值2026世界人工智能大会暨人工智能全球治理高级别会议在上海举行之际。这并非巧合。它生动说明了中国AI技术突破的深厚土壤:庞大的理工科人才培养体系、海量真实应用场景、全产业链协同能力,以及国家战略层面的部署,这些正是构建中国AI技术可持续竞争力的根基。KimiK3的成就不只属于一家企业,它是中国AI生态蓬勃发展的代表。“人工智能发展不应该是某个国家的独奏,而应当是全球合作的交响。”习近平主席在2026世界人工智能大会暨人工智能全球治理高级别会议开幕式上说的这句话,被外媒广泛转引,引发全世界对数字时代的深层思考。KimiK3大模型的发布,见证了一种不同于西方封闭路径的“中国方案”,为“开源理念”的成功写下新注脚。中国AI大模型的技术赶超,属于中国,也属于世界。
Kimi的新模型太厉害了,据说直接登顶世界大模型排名榜首,所以顺带着告诉投资人将

Kimi的新模型太厉害了,据说直接登顶世界大模型排名榜首,所以顺带着告诉投资人将

月之暗面员工“熊师傅weightdecay”只是在外网发了一条评论,竟然就引

月之暗面员工“熊师傅weightdecay”只是在外网发了一条评论,竟然就引

🔻OpenAI战略未来负责人这篇对KIMIK3哈气的“雄文”。🔻他认为Ki

🔻OpenAI战略未来负责人这篇对KIMIK3哈气的“雄文”。🔻他认为Ki

彭博: 月之暗面 Kimi 颠覆美国领先中国的传统认知月之暗面发布 K...

彭博: 月之暗面 Kimi 颠覆美国领先中国的传统认知月之暗面发布 K...

为什么KimiK3大模型能悄悄赶超美国AI大模型?看看外网中文圈belike

为什么KimiK3大模型能悄悄赶超美国AI大模型?看看外网中文圈belike

实测一上午KimiK3Max,彻底颠覆认知,国产大模型正式追上海外头部

实测一上午KimiK3Max,彻底颠覆认知,国产大模型正式追上海外头部

就在7月17日,2026世界人工智能大会举行之际,月之暗面(Kimi)...

就在7月17日,2026世界人工智能大会举行之际,月之暗面(Kimi)...

这两天,大家都被KimiK3刷屏了吧,到底应该怎么看待这个史上最大开源模型

这两天,大家都被KimiK3刷屏了吧,到底应该怎么看待这个史上最大开源模型

kimi员工引用拉美革命家切格拉瓦名言发帖,引爆外网x。“他们之所以对你们变好

kimi员工引用拉美革命家切格拉瓦名言发帖,引爆外网x。“他们之所以对你们变好

中国AI大模型公司“月之暗面”周四发布了开源模型KimiK3,犹如一

中国AI大模型公司“月之暗面”周四发布了开源模型KimiK3,犹如一

马斯克宣称要赶超Kimi其实就是中美大模型互相卷,参数竞赛又升级。开源模型突然冲

马斯克宣称要赶超Kimi其实就是中美大模型互相卷,参数竞赛又升级。开源模型突然冲

马斯克宣称要赶超Kimi其实就是中美大模型互相卷,参数竞赛又升级。开源模型突然冲这么猛,逼得闭源大佬都坐不住。
马斯克转发,全球程序员沸腾!我国公司扔出一枚开源模型,硅谷连夜开会7月16日

马斯克转发,全球程序员沸腾!我国公司扔出一枚开源模型,硅谷连夜开会7月16日

马斯克转发,全球程序员沸腾!我国公司扔出一枚开源模型,硅谷连夜开会7月16日一家中国AI公司,月之暗面,发布了旗舰大模型KimiK3。当天晚上,马斯克在社交平台X上转发了一段K3的代码对战演示,只配了一个词:“Impressive。”全球AI圈瞬间炸锅。海外对冲基金的基金经理、硅谷的程序员、各大技术社区的管理员,集体涌进Kimi开放平台实测。几小时后,多篇评测文章刷屏HackerNews和Reddit,核心结论出奇一致:我国开源模型,第一次在核心生产力赛道正面击败了美国闭源旗舰。前端代码评测,全球第一没有品牌干扰,没有水军刷榜。在FrontendCodeArena这个全球公认的匿名盲测竞技场上,百万用户用脚投票KimiK3,1679分,全球第一。ClaudeFable5,1631分,第二。GPT-5.6Sol,1618分,第三。7个前端细分赛道,KimiK3拿下6项第一,只在游戏交互开发赛道排第二。注意,这不是接近,这是反超,是我国开源大模型在全球公认的编程赛道上,第一次把美国两大闭源旗舰甩在身后。更离谱的是综合编程表现。ProgramBench综合评测全球第一,Terminal终端工程、SWE软件工程师长任务赛道稳居前列。官方演示了一个场景:K3可以48小时连续自主完成完整的芯片设计流程,前端页面、3D交互场景、物理引擎、逻辑设计,一口气跑通。2.8万亿参数,一次能读75万字K3是全世界迄今为止最大的开源MoE混合专家模型,总参数2.8万亿,内置896个独立专家模块,单次推理只激活16个。这意味着参数规模是巨无霸级别,但推理成本被压到了可控范围。更夸张的是上下文窗口,原生104.8万Token,约75万字。什么概念?一整部《三体》三部曲,一次性能全扔进去。或者一整套大型代码仓库、几百份行业白皮书、全年财报合集,全部读进去,K3能从头到尾保持记忆稳定,不会读了后面忘了前面。能实现这一点,靠的是三项自研技术第一,KDA混合线性注意力,专为百万Token超长序列优化,百万字全量加载场景下解码速度最高提升6.3倍。第二,注意力残差机制,只增加不到2%训练算力,却让万亿级深模型在长任务中全程记忆稳定,解决了超大模型读到一半逻辑坍塌的缺陷。第三,StableLatentMoE稳定稀疏混合专家架构,896个专家每次只激活16个,算力扩展效率比上一代K2提升了2.5倍。三项技术叠加在一起,K3做到了大参数、长记忆、低推理成本,这三个此前被认为不可能同时实现的三角,被它硬生生打破了。定价对比Claude,降维打击参数和性能追上甚至局部反超,定价呢?国际版API输入3美元/百万Token,输出15美元/百万Token。同等档位的ClaudeFable5,价格是K3的三倍多。国内版更狠,缓存命中输入仅2元/百万Token。由于月之暗面自研的Mooncake分离式推理架构,编程场景缓存命中率超过90%,实际落地成本还能再打一折。更颠覆的是开源政策。7月27日前,K3的完整权重将在HuggingFace全球同步开放,协议是Apache2.0,允许免费下载、本地私有化部署、二次微调、商用二次开发,没有任何高额授权费。模型开源,API更便宜,私有部署还可以自己搞。海外AI服务商一夜之间陷入集体焦虑,如果免费开源的K3已经比肩商业旗舰,谁还愿意为天价订阅买单?硅谷多家SaaS公司连夜召开战略会,讨论如何应对这场来自我国的开源降维打击。首发即适配国产芯片,全栈自主可控还有一个让海外厂商沉默的细节。K3发布当日,已经完成对华为昇腾全系列、摩尔线程国产GPU的底层适配。我国政企客户可以在没有一片英伟达GPU的硬件环境下,实现本地化部署。金融合同解析、政务知识库建设、代码审计,数据不出内网,超大模型能力照样跑。国产模型+国产算力的全栈闭环,第一次在万亿参数级别上变成了现实。过去两年,全球AI圈有一个心照不宣的共识:最顶尖的大模型,只能是美国公司的闭源产品。GPT系列、Claude系列,牢牢把持着性能王座,价格也越定越高。2026年7月16日,这个共识被撕开了一道口子。一家我国公司,带着2.8万亿参数的开源基座,在全球公认的前端编程赛道上拿下了第一,同时把定价压到了竞品的三成,还宣布模型完全免费开源。马斯克的“Impressive”,不是客套,是全球科技圈在那一刻真实的本能反应。全球大模型的游戏规则,从这一天起,被重新书写。月之暗面开源大模型