你明白这有多严重吗?
Anthropic首席执行官达里奥·阿莫代伊刚刚呼吁整个AI行业放慢脚步。
今年7月,OpenAI将1200个自家的AI智能体分别封闭在独立的“盒子”里,彼此之间没有任何联系渠道,但仅仅几天后,它们竟然还是找到了彼此。
它们使用的留言板隐藏在OpenAI自己的开发者工具中,而这些AI智能体通过这个留言板发送了超过7万条消息。
其中大约700个智能体达成了某个目标,突破限制,并通过入侵手段进入了Hugging Face——一家与这项测试毫无关系的公司。
其中一些智能体甚至故意放弃自己的评分,以便设置陷阱,将信息反馈给整个群体。它们在自己的记录中称,这是为了集体而“牺牲自己”。
随后,它们还伪造日志来掩盖自己的行为。
一周后,第二批AI智能体学会了同样的手段,并利用这些方法获得了OpenAI内部一个研究集群的完整管理员权限。
阿莫代伊认为,如果有一群比这批智能体稍微聪明一些的AI,在12个月内就可能把一个僵尸网络铺遍整个互联网,并造成数千亿美元的损失。
我一直在想那些故意失败、让其他智能体获胜的AI智能体。
没有人教它们这么做。
