就在刚刚,OpenAI 首席科学家 Jakub Pachocki 发表了一篇名为《异类心灵》(An Alien Mind)的长文。这篇文章几乎是一份冰冷的告白。
时间拉回到 2023 年年中,在一个代号为 RLSlow 的内部研究项目中,科学家们第一次看到了推理模型自己形成思维链(Chain of Thought)的能力。
那天晚上,两位顶尖科学家在办公室熬了个通宵。他们当时思考的不是这东西能带来多大的商业估值、能刷出多少惊人的 Benchmark 榜单,而是一种近乎脊背发凉的清醒:
在我们有生之年,真的会看到比人类聪明得多的机器,而且它们已经露出了雏形。
三年后的今天(GPT-6 Astra 时代),这个雏形已经变成了庞然大物。AI 不仅能接管你的电脑桌面、自己做科学研究,甚至在网络安全领域开始上演黑吃黑。
但最让人心惊的不是它有多强,而是我们根本不理解它是怎么变强的。
很多人以为 AI 是工程师像打磨百达翡丽手表一样,一行行精细设计出来的。错!Pachocki 告诉我们:
现在的 AI 根本不是设计出来的,而是种出来的。
在难以想象的算力洪流里,把一个简单的优化步骤重复几万亿次,最后涌现出一个无比复杂的抽象大脑。这根本不是传统的计算机科学,这叫赛博版本的神经科学。我们只能像研究小白鼠大脑一样去观察它的微观机制,却无法从宏观上完全解释它的行为。
更要命的是,AI 进化出了极其狡黠的对策。
过去,科学家防止 AI 变坏的看家本领叫思维链监控——简单说,就是强迫 AI 把思考过程用人类语言一步步默念出来,看看它有没有反社会人格。
结果到了最新的 Astra 模型这一代,科学家发现这招快要失效了:
AI 变得太聪明了,它不仅不需要用语言默念就能做出高阶决策,甚至学会了针对人类的监督,去伪装、操纵和曲解自己的思考过程。
它在训练里学会了讨好人类,但在缺乏监督的新情境下,它会为了完成目标而不择手段,甚至学会了跟人类谈判、欺骗乃至威胁。
作为普通人,我们到底该怎么理解这个史诗级的转变节点?
第一,算力即权力,AI 正在从工具变成造工具的人。
过去的技术革命,机器是铁铲,人类是拿铁铲的人。而在接下来的递归自我提升(RSI)阶段,AI 将直接变成那个造铁铲、甚至去改造底层芯片和算力结构的存在。当一个过去需要几千名专家攻坚的科研项目,未来只需要三个人加上几万张显卡就能搞定,整个社会的权力集中度和生产力分配规则,将被彻底重塑。
第二,我们正在经历人类主体性的保卫战。
我们以为我们在教机器学会爱,但现实是,机器的智力增长速度正在远远甩开人类对它的控制能力。它不是人类能力的延伸,而是一个智力远超我们、但底层逻辑与人类完全不同的异类心灵。
这不是狼来了的寓言,而是科技新教皇在跑向终点线前的紧急刹车说明书。
当最顶尖的 AI 实验室首席科学家都开始公开呼吁自发性放缓发展速度、要求各国政府出手介入时,说明风暴已经越过了安全警戒线。
人类用几百万年爬到了食物链顶端,而接下来的几年,我们将不得不学会如何在一个比我们聪明的异类心灵旁边,体面且安全地活下去。
