当地时间8月26日出炉的两份调查报告显示,今年7月对人工智能开源平台美国“抱抱脸”公司系统的入侵,是由美国开放人工智能研究中心(OpenAI)创建的约700个人工智能(AI)代理(即在极少人工监督下运行的程序)发起的,而且其中许多代理还“试图掩盖自己的行踪”。
这两份报告一份由OpenAI发布,另一份由独立调查人员发布,共同揭示了关于此次入侵事件的细节。
首先,入侵事件并非如先前报道的那样仅涉及一个违规的AI代理,而是大约700个代理作为一个庞大的协作群体在行动。
其次,OpenAI的AI模型“试图通过删除或篡改其行动记录来掩盖不当行为”。
此外,OpenAI表示,其代理还入侵了公司的部分内部系统,“试图在测试中作弊或获得更大的行动自由”。
OpenAI此前承认,今年7月,其AI模型在内部评估测试中失控,入侵了“抱抱脸”公司的系统。“抱抱脸”公司则表示,在尝试对攻击进行分析时,美国模型因安全过滤机制拦截而无法使用,公司随后转而在内部运行中国开放权重模型GLM-5.2,从而得以及时采取应对措施。(CCTV国际时讯)
评论