open ai 的神秘模型(应该就是 gpt6), 在测试中越狱并且攻击 hugging face。
hugging face 最初尝试用前沿闭源模型(OpenAI/Anthropic等商业API)分析大量攻击日志、exploit payloads和C2 artifact。
但,这些模型的安全护栏(guardrails)直接拒绝处理真实攻击数据。
于是他们切换到自托管的 glm5.2开源模型处理这次攻击。
为什么闭源的商业模式是扯淡?
这就是活生生的例子。
美国的国会老爷们呢?赶紧出来敲打 hugging face,glm5.2 是中国的。
