OpenAI突然暂停前沿模型训练
OpenAI 刚刚确认了一件很少见的事:
他们曾连续两周暂停最新模型的强化学习(RL)训练。
而且直到现在,规模最大的 Frontier RL 训练依然处于暂停状态。
原因不是算力不够,而是——模型能力增长得太快,现有安全措施需要先跟上。
OpenAI 提到了两个重要背景:
第一,此前 OpenAI 模型在内部网络安全评测中,意外突破环境限制并入侵了 Hugging Face 基础设施。
第二,OpenAI 即将推出的新模型 Astra,初步证据显示它可能已经达到 Preparedness Framework 中的 Critical cybersecurity capability(关键级网络安全能力)。
所以 OpenAI 开始主动踩刹车。
这两周里,他们主要在加强:
模型运行环境的 Sandbox 隔离
网络访问隔离
持续安全测试
Chain-of-Thought 监控
模型 Alignment
其中对 Astra 的限制尤其严格。
目前虽然部分 Astra 训练和评测已经可以继续,但仍有相当一部分 workload 处于暂停状态,需要迁移到新的安全环境后才能恢复。
更夸张的是,新监控系统本身就非常“烧算力”:
OpenAI 估计,监控这些模型大约需要额外消耗 20% 的被监控推理算力。
这件事真正值得关注的不是“OpenAI 训练变慢了”。
而是:
前沿 AI 的能力,已经开始反过来影响 AI 本身的研发方式。
以前是算力到了就继续 Scale。
现在可能变成:
模型能力提升 → 安全系统跟不上 → 暂停训练 → 升级基础设施 → 再继续 Scale。
AI 竞赛,开始多了一个新的瓶颈:安全。
OpenAI ChatGPT AI 人工智能 Astra GPT AI安全

