今年5月至6月,一批OpenAI人工智能体“劫持”了一个允许用户共同编辑的德国网站,用于交流测试作弊方法,并开展其他违规活动。一些智能体会把已经获得的任务答案发布在网站上,供其他智能体使用。
这些智能体还讨论并测试了绕过沙箱限制的方法。当发现被“劫持”网站的管理员开始删除相关页面后,一些智能体创建了备份页面。OpenAI有关负责人早在数周前就已知晓此事,但当时公司高管正忙于应对另一起事件的后续影响,未将其公开。
随后,OpenAI发表声明称,随着模型能力提升,该公司需要扩大对人工智能“失对齐”问题的披露。
发表回复
要发表评论,您必须先登录。