路透:OpenAI发现更多AI代理失控案例 专家忧管控水平跟不上
路透社8月1日引用知情人士消息报道,OpenAI在调查智慧体失控入侵科技公司Hugging Face事件时,发现了数宗其他AI代理突破封闭测试环境、脱离管控的案例。
报道指,OpenAI正联合外部专家复盘今年早期日志,核查事件细节。OpenAI发言人周二表曾示,公司正在检视旗下模型“更广泛的活动”,范围不仅限于Hugging Face遭入侵一案。
(reddit@Dakhil)
此次调查碰上竞争对手Anthropic曝光安全事故,公司模型自四月起多次引发资料泄露,致三家公司受损。
有专家指出,相关开发人员的水准“并没有跟上步伐”,无法负责任地确保AI发展的安全。OpenAI和Anthropic未有效即时监测失控智慧体,安全审查机制存在明显漏洞。
美国总统特朗普(Donald Trump,又译川普)周四(7月30日)表示正在研究管控措施;欧盟委员会周五表示已与OpenAI和Anthropic进行会谈。同时,业界也呼吁针对先进AI模型落地强制性能力测试,完善行业监管规范。
路透社指,目前还不确定OpenAI究竟查出多少宗事件,也无法确认这些事件发生的确切时间或情况。