DC娱乐网

模型的推理过程,成了各方争夺的东西。 OpenAI 9 月 30 日披露,它在 7 月处置了一起有组织的行动,目的是提取模型做题时的内部记录。它把核心集群归到与月之暗面有关联的个人,这是单方说法。同一天,谷歌呼吁全行业保留推理的可读性。 普通用户什么都不用做。 OpenAI 说没有破解加密,也没有拿到用 ​

模型的推理过程,成了各方争夺的东西。

OpenAI 9 月 30 日披露,它在 7 月处置了一起有组织的行动,目的是提取模型做题时的内部记录。它把核心集群归到与月之暗面有关联的个人,这是单方说法。同一天,谷歌呼吁全行业保留推理的可读性。

普通用户什么都不用做。 OpenAI 说没有破解加密,也没有拿到用户存储的对话。

指向月之暗面的是 OpenAI 的说法。 原文写的是「有关联的个人」,还承认不清楚是不是同一个行为者。

做模型、用推理接口的团队,注册和风控会变严。 OpenAI 已处置相关账号,收紧了注册。

手法是把加密的推理搬到另一个对话里解开

推理内容在对话里是加密的。OpenAI 说,操作者把一个对话里的加密推理复制出来,在另一个对话里让模型解密并转写,隐藏的内容就变成了请求者看得见的文字。按 OpenAI 的解释,提取它能暴露最终答案里没写的信息,也能帮别人复刻模型的能力。

OpenAI 还说,有独立的安全研究者通过负责任披露,提交了相关的跨模型和对话压缩漏洞,它核实了这些路径是真的。这类操纵不是 OpenAI 的模型独有,它已经通过 Frontier Model Forum 把信息分享给同行。

数字写的是尝试,不是得手

时间|OpenAI 说发生了什么7 月 1 日|活动开始,量不大7 月 24、25 日|4000 多个用户发出 1.6 万次相关请求7 月 28 日|1.5 万多个用户的关联集群被完全处置9 月 30 日|OpenAI 公开披露

原文脚注写明,这些数字描述的是尝试,不一定成功提取。所以 1.6 万次说明了规模,没有说明提取到了多少。披露隔了两个多月,OpenAI 的解释是公开前先查范围、上缓解措施,并听取研究者和行业伙伴的意见。

归因只写到「有关联的个人」

原文写的是,OpenAI 把一部分行动的核心集群归到与月之暗面有关联的个人,月之暗面是 Kimi 的开发方。同一段里,OpenAI 承认不清楚观察到的所有操作者是否来自同一个行为者。原文没有附上月之暗面的回应。

前一天,Anthropic 发了对智谱 GLM-5.3 的测试,这是两天里第二家美国实验室在官网点名中国的模型公司。两份材料讲的事不一样,一份是护栏,一份是提取推理,都是各自实验室的单方材料。

一边要看得见,一边要藏得住

谷歌在发布稿里写得很清楚。它部署了监控,盯着 Argon 的思维链和动作,必要时停止执行。训练时也用类似的系统,并且刻意不把监控发现喂回训练,免得模型学会躲开监控。谷歌明确鼓励同行在这个关键阶段保留推理的透明度,让模型的想法还能用来判断它有没有越界。

这两件事并不冲突。谷歌要的是自家监控能读清,OpenAI 要的是外人读不到。最强的反方解释是,两家说的是同一份推理的不同读者,一个防自己的模型越界,一个防别人拿走。

鉴曰:同一份推理,自家要读得清,外人要读不到,模型公司得同时做到这两件事。