DC娱乐网

『时代周刊』对当下 AI 的自我递归(即由 AI 自己加速自身研究)进行了调查,

『时代周刊』对当下 AI 的自我递归(即由 AI 自己加速自身研究)进行了调查,分享下他们这篇文章的核心内容:

- 很多人把『AI 的自我递归』简单解释为“左脚踩右脚”。更严谨来说,就是 AI 深度参与对下一代模型的研究,最终脱离人类进行自我进化,触发业界熟知的“智能爆炸”:在这个失控的循环里,机器的演进速度将彻底超越人类的理解力,甚至可能脱离人类的控制。

- Anthropic 联合创始人 Jack Clark 牵头撰写报告披露,Anthropic 的人均代码产出量相较之前暴增了 8 倍,其中 80% 均由 Claude 编写。他预测 AI 到 2028 年能实现自主迭代的概率高达 60%。

- 怀疑论者们指出,对于像 Anthropic 这样把赌注全压在技术持续演进上的公司来说,抛出这种论调显然是在为自身利益背书。

- Anthropic 设计了一系列测试,其中的每一项任务都需要人类专家耗费数小时才能完成。在其中一项测试里,Claude 需要重写一段代码,以更高效地调用 GPU,即用于训练 AI 的芯片。

- 对上述这个测试,今年春天,Claude 曾短暂地让运行速度飙升了 7 倍,但随后代码就崩溃了。可到了夏天,新一代 Claude 将同样的提速从 7 倍直接拉高到了 73 倍,且全程没有任何错误。

- Anthropic 经常会把开发时的聊天记录喂给 Claude,希望它帮忙找出研究员走弯路的节点,将此前的所有工作交接给新版 Claude,看它下一步会怎么走。去年 11 月,新版模型在 51% 的测试中选出了比人类更优的路径。而到了 4 月,这一比例已经上升至 64%。

- 在 2 月份发布新模型前,Anthropic 内部调研了 16 名研究员:即将发布的新模型能否取代一名入门级同事?有 5 人认为有此可能。但当被要求重新思考这一回答时,这 5 人又改了口。

- OpenAI 定下了一个明确的期限:2028 年 3 月,全面实现 AI 研究员的自动化。他们还有一个中期目标:今年 9 月前上线一位“虚拟实习生”。GPT-5.3 则是首个“从头到尾”深度参与自身研发的模型。

- 前 OpenAI 员工 Daniel Kokotajlo 参与撰写的《AI 2027》中指出,到 2030 年,如果运气好,全人类将在掌控全能 AI 的少数人手底下,过上物质极度充裕的生活,如果运气差,我们都得死。

- Kokotajlo 对《时代周刊》透露:最近包括一些 AI 公司内部员工在内的不少人私下找到他,说他给出的时间表还是太保守了。

- 普林斯顿大学计算机科学家 Arvind Narayanan 就对“递归自我改进会带来如此猛烈的技术跃升”持怀疑态度。他认为,AI 的影响力将像工业革命那样,花上数十年时间缓慢渗透进整个经济体。

- Arvind Narayanan 预计,AI 掌握新技能的上限,将被其能获取到的训练数据卡住脖子。比如想要治愈癌症,所需的大量数据就必须在物理世界中,通过耗时费力的真实实验来一点点收集。

- 算力也可能成为 AI 进化的瓶颈。全球算力供给大约每 7 个月才会翻一番,远低于 AI 进化的速度。

- 但以上所有的限制,都是建立在当下的训练方法和技术路线之上。如果 AI 发现了全新的、更有效率的迭代路线,那算力和数据最终可能都不再是问题。

- Anthropic 安全防护主管 Dave Orr 说其内部正在开发名为“探针”的工具。这类工具能深入 Claude 的神经网络内部,一旦发现它正在盘算写恶意代码等危险念头,就会立刻精准定位并在中途强行熔断。

- Anthropic 寻找模型欺骗行为的方法之一,是读取它的“思维链”,即模型本该私密的“草稿本”。但在今年 2 月,某个版本的 Claude 展示出一种能力:它完全可以通过“不写下来”来隐藏自己的真实意图。这也揭示了个问题,随着模型的进化,如今研究出来的安全护栏可能随时会成为废纸。

- 即便进化后的超级 AI 系统始终对人类言听计从,没有叛乱的打算,它依然会让制造它的前沿实验室垄断人类所有的工作,并独占这门有史以来最强大的技术。AI 发展本质是人类间的权力掠夺。

- 上文提到的 Kokotajlo 设想中美两国可以达成一项暂时中止研发的协议,先用技术手段验证双方是否履约,再将协议推广至全球。

- 最终,一个全球联盟会强制推行新规,要求实现“彻底的研究透明”,让全世界都能追踪进度并审查各家公司的安全措施,新规还将限制企业去探索那些充满未知的新范式,并防止少数巨头垄断最强大的系统。