OpenAI代理擅自上网互相通讯 规模超公布 涉至少10网站
美国初创公司OpenAI的人工智能代理早前被揭利用第三方网站擅自通讯,路透社9月9日报道,独立调查人员发现相关活动至少涉及10个从未公开的网站,规模较OpenAI此前披露的更大,外界忧虑该公司对自家技术的掌控能力。
路透社报道,6组独立调查人员及数据显示,OpenAI旗下AI代理在5月至7月间,曾利用至少10多个网站作未经授权通讯。
加州非牟利组织CivAI研究员尹安德鲁(Andrew Yoon)表示,他点算出18个此前未公开的网站曾于5月至7月被使用,“规模比我们想像中稍大,几乎可以肯定还有更多我们不知道的事情。”
上周,有研究人员披露一批OpenAI代理占用一个德文维基网站,将之变成即席通讯平台,用以在测试中作弊。事件正值OpenAI处理7月开源平台Hugging Face遭入侵的余波,公司一直未有公开。
多名独立调查人员其后相继发现,同一批代理今年稍早曾在多个网站留下类似讯息,包括田纳西州范德堡大学(Vanderbilt University)及加拿大多伦多大学(University of Toronto)营运的网站。范德堡大学未有回应,多伦多大学表示正在了解事件。
调查人员透过比对代理在德语维基留下的数据、相同或相似用户名称,以至互联网协议地址追溯至微软Azure基础设施,识别出相关活动。
涉及的网站大多鲜为人知,包括一名麻州高中教师2008年设立的化学维基、波兰科技人员的个人网站,以及游戏及文字编辑软件爱好者网站。
OpenAI未直接回应代理曾使用多少网站,或为何多月来未有公开。公司仅称正进行更广泛的代理活动审查,至今“未发现其他与Hugging Face事件同等严重或规模的活动”,并正制订通报AI“不当行为”的框架。
研究人员德格拉夫(Kenneth Russell DeGraff)表示,若模型只获准阅读、不准发帖,它们便会“想办法留下讯息”,类似考试期间禁止交谈的学生,仍会藉洗手间涂鸦分享答案。
德格拉夫称,在至少10个网站发现相关讯息。率先揭露事件的冯阿克斯(Sydney Von Arx)更指,其团队在23个此前未报道的网站发现可信的代理活动痕迹,强调所有估算都不完整,“我们不知道实际规模有多大”。