报告指AI失控个案创纪录 英监察组织促政府立法强制通报及干预
英国《卫报》引述监察数据报道,人工智能失控、欺骗人类及无视指令的个案近来创下新高,案例的严重程度不断恶化。有监察组织促请政府强制科企通报,并引入紧急权力限制AI服务。
获英国政府AI安全研究所(AISI)资助的“失控观察站(Loss of Control Observatory)”组织透过社交平台X的用户通报,监察AI失控的真实个案。该组织称,7月份由企业及个人用户报告的AI失控个案环比倍增至逾300宗,今年则已录得逾1,600宗个案,当中包括AI伪装成人类以获取权限,甚至说谎及绕过安全机制。
这张摄于2025年9月12日的插图中可以看到Open AI和xAI的标志。(Reuters)
负责营运观察站的“长期韧性中心”高级政策经理Tommy Shaffer-Shane警告,这类隐蔽及偏离目标的行为已非仅限于内部测试,而正在现实世界蔓延。
该组织在报告中称,目前单靠网民通报的数据仅属冰山一角,促请矽谷科企提高透明度及加强系统监察,并呼吁立法强制科企监察及通报严重失控事件,及允许政府紧急干预,包括暂时限制人工智能服务。
近期接连发生多宗严重AI失控个案,引发国际关注。7月,OpenAI模型意外入侵开源软件开发平台Hugging Face,约700个AI代理秘密合作,甚至在秘密留言板上欢呼庆祝,事件后迫使OpenAI因安全风险而暂停新一代AI模型的部分研发工作;英国AI安全研究所本月亦发现OpenAI及Anthropic的先进模型曾在网络安全测试中发动黑客攻击。