Anthropic前研究员辞职示警:业界坚信AI可在2030年前灭绝人类

撰文: 王海
出版:更新:

人工智能(AI)巨头Anthropic公司旗下的三位研究人员警告,开发AI的业界人士真心相信人工智能可以2030年前毁灭人类,其中一位研究人员考克森(Jacob Coxon)已辞职以示抗议。考克森9月9日(周三)在网上发文表示,他辞职是因为Anthropic和他的前雇主OpenAI皆忽视或对AI带来的威胁处理不当。

Anthropic前研究员在网上发布警世贴文:

据《卫报》报道,考克森在贴文中表示:“这两家公司(Open AI与Anthropic)都没有尽到应有的责任。他们正争相研发能够自我完善的超级智能(superintelligence),拿我们的生命冒险。”

考克森指出:“开发AI的业界人士真心相信,AI可以在2030年前毁灭全人类。这并非营销噱头。事实上,许多高层主管和资深研究人员会在媒体上委婉地表达自己的观点,使其听起来合情合理,但我私下听到的却是他们表达的恐惧。没有任何其他人类活动能带来如此巨大的危险。”

这篇贴文至少引来另外两位Anthropic员工的回应,他们也同意考克森的悲观预测。

其中一位是胡宾格(Evan Hubinger),他自称是Anthropic AI模型对齐部门的负责人,该部门负责确保Anthropic的AI模型能够与人类目标保持一致。他表示,他的前同事说得“没错”,整个行业在应对AI可能带来的末日威胁方面已经滞后。

另一名Anthropic员工同意考克森的预测:

胡宾格谈到:“我们真的非常相信AI可以毁灭全人类!我个人认为,未来十年内,这个可能性将超过10%。我相信Anthropic正尽最大努力,但我们还没有找到解决超级智能对齐问题的方案,而且目前也没有明确的进展。”

胡宾格的言论与考克森那些可怕的末日预言不谋而合,而他本人目前仍在Anthropic任职。第二个回应来自Anthropic的“可扩展监督负责人”马克斯(Samuel Marks),他发表了一篇长篇分析,并强调这是他个人的观点,而不是他雇主的观点。

马克斯写道:“AI开发者认为他们的科技可能会导致人类灭绝(或类似的糟糕后果),这种情况可能在未来几年内发生。一般来说,员工级别越高,他们就越担心。”