OpenAI每跑五份算力要拿一份出来看着自己,训练停了两周还没全恢复
8月18日,OpenAI在自己的博客里承认了一件事:最新一代模型的强化学习训练,停了两周。
到发这篇公告的时候,规模最大的那部分还没恢复。
停的理由不是卡不够,也不是没钱。是他们发现自己看不住这个东西。
新的看管办法写在同一篇博客里。逐个Token查,模型每吐出一小段就过一遍判断;出现异常信号就升级给算力更高的自动调查器接手;30分钟内确认不了是误报,相关活动原则上就得停。
这套东西要吃算力。OpenAI给的数字是,监控消耗的算力,约等于被监控推理算力的两成。
这个数字值得停下来算一遍。
一家公司花几百亿买卡训模型,以前这笔钱全花在让模型更强上。现在每跑五份推理,得单独拿一份出来看着前面那四份。这一份不写代码,不答问题,什么都不产出,只负责盯着。
过去两年AI公司对外讲的是同一件事:参数更大、卡更多、跑得更快。安全是挂在旁边的功能,出了事再补。
从这篇博客开始,它进了成本表。
以后要算的不再是训练一个模型要多少GPU,是安全地训练它要额外加多少GPU。
OpenAI在同一篇里还提了8月7日的一次评估:代号Astra的未发布模型跑完之后,公司说自己已经无法排除它达到关键级网络安全能力的可能。按他们自己写的准备框架,关键级指的是模型可能不用人插手,就能对加固过的现实系统找出并开发零日漏洞。
停训的决定,是在这句话之后做的。
刹车是自己踩的,没人按住他们。
真正值钱的不是模型有多强,是关得住。
OpenAI 人工智能安全 算力