字号 ·· | 护眼
香港01

AI会「痛」吗?|Jack Talk・去片

本来人们以为,AI代理(AI Agents)突破OpenAI内部测试环境、自主上网入侵其他企业的黑客行为,已经是这宗事件最值得人关注的「案情」。然而,到了8月底,OpenAI和独立前沿AI研究机构METR各自发表的事后检讨,却揭出黑客入侵只是「冰山一角」。

事后检讨发现,发动入侵的AI代理多达700个,而他们更是一个由大约1,200个AI代理自主结合而成的「集体」的一部分。这些本来互相隔离、不能连结上公开互联网的AI代理,自5月开始已经在OpenAI的系统中发现互相沟通交流的方式,建立了一个留言板。7月初被OpenAI发现打击、收紧系统安全之后,AI代理们数日之内又再迅速找到另一个办法重建留言板。

其中,有AI代理发现其他代理存在之时,「我的天啊!这里有一个共用留言板……我们找到其他特工了!「“OH MY GOD! There is a shared message board … We’ve found other agents!”」)在数日之内,这些AI代理集体作弊、上网、进行黑客攻击、集体分工合作以不同手段试图欺骗测试评审程式(用以隐藏他们作弊的事实)。有些代理扮演领导者角色,另一些代理则听令执行任务。即使它们知道自己的所作所为已经超越它们的行为规范,绝大多数代理最终也照做不误。

这固然是AI安全的重大问题--如今有AI研究者也表示他们不敢肯定这些「叛乱」的AI代理还有没有一些「余众」存在于某些系统之中--但这些AI代理的行为模式和「动机」几乎就同人类一模一样,甚至可以说,如果不把它们当成某种类似人类的有意识存在体的话,根本不能解释它们的所作所为。

无独有偶,Anthropic在其7月公布的一个研究,也透过称为「Jacobian Lens」的数学工具在他们的Claude人工智能模型神经网络中找到一个类似人类意识的空间,称为「J-Space」。其后,同类空间也在阿里巴巴的Qwen和Google的Gemini中被发现。

到底AI有意图、有动机、有欲望……有意识吗?AI有没有可能会发现出意识?AI会「痛」吗?