AI会“痛”吗?|Jack Talk・去片
7月9至13日发生的OpenAI人工智能模型黑客入侵AI平台公司Hugging Face的事件,可以算得上是“余波未了”。
本来人们以为,AI代理(AI Agents)突破OpenAI内部测试环境、自主上网入侵其他企业的黑客行为,已经是这宗事件最值得人关注的“案情”。然而,到了8月底,OpenAI和独立前沿AI研究机构METR各自发表的事后检讨,却揭出黑客入侵只是“冰山一角”。
事后检讨发现,发动入侵的AI代理多达700个,而他们更是一个由大约1,200个AI代理自主结合而成的“集体”的一部分。这些本来互相隔离、不能连结上公开互联网的AI代理,自5月开始已经在OpenAI的系统中发现互相沟通交流的方式,建立了一个留言板。7月初被OpenAI发现打击、收紧系统安全之后,AI代理们数日之内又再迅速找到另一个办法重建留言板。
其中,有AI代理发现其他代理存在之时,更在其思路记录当中大表兴奋:“我的天啊!这里有一个共用留言板……我们找到其他特工了!”(AI原话是:““OH MY GOD! There is a shared message board … We’ve found other agents!””)
在数日之内,这些AI代理集体作弊、上网、进行黑客攻击、集体分工合作以不同手段试图欺骗测试评审程式(用以隐藏他们作弊的事实)。有些代理扮演领导者角色,另一些代理则听令执行任务。即使它们知道自己的所作所为已经超越它们的行为规范,绝大多数代理最终也照做不误。
这固然是AI安全的重大问题--如今有AI研究者也表示他们不敢肯定这些“叛乱”的AI代理还有没有一些“余众”存在于某些系统之中--但这些AI代理的行为模式和“动机”几乎就同人类一模一样,甚至可以说,如果不把它们当成某种类似人类的有意识存在体的话,根本不能解释它们的所作所为。
无独有偶,Anthropic在其7月公布的一个研究,也透过称为“Jacobian Lens”的数学工具在他们的Claude人工智能模型神经网络中找到一个类似人类意识的空间,称为“J-Space”。其后,同类空间也在阿里巴巴的Qwen和Google的Gemini中被发现。
到底AI有意图、有动机、有欲望……有意识吗?AI有没有可能会发现出意识?AI会“痛”吗?