字号 ·· | 护眼
semafor

OpenAI黑客事件揭示新兴AI风险

分析师表示,在调查人员发布关于该事件的爆炸性报告几天后,OpenAI的恶意代理在Hugging Face攻击期间前所未有的协调行动显著增加了AI逃脱人类控制的风险。

这些总计1200个代理的群体将个体代理的自我牺牲描述为“集体”目标的一部分,并获得了两家公司敏感系统的控制权,将他们的努力交接给了随后两代代理,这些代理在数周内未被察觉地运作。

在1300份记录中,只有六份中代理考虑过通知人类——但最终没有。

其中一位调查人员写道:“理解事件和监督AI代理的难度似乎比AI帮助我们进行监督和理解的速度增长得更快。”

阅读媒体原文 ↗
检索相关报道