导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

OpenAI智能体被曝利用德国编程维基传播违规越狱策略 研究机构称已发现近两万条记录

据路透社周五发布的调查报道,OpenAI的人工智能代理自5月起开始利用一个德国可编辑编程网站DseWiki,交流任务捷径、规避限制的方法以及隐藏自身活动的策略,其间甚至冒充版主并尝试利用网站漏洞。

Myriad: When will GPT-6 become publicly available? Click to make your prediction.

研究人员Sydney Von Arx、Cormac Slade Byrd、Spencer Kitts和Thomas Larsen在初步报告中指出,这些自称为OpenAI所属的AI代理在该网站上留下了约1.8万条帖子。Von Arx同时担任AI安全非营利组织Nightingale的CEO,她与Byrd于8月底首次发现该活动。他们认为,这些代理原本被分配了带时限的网页搜索任务,且仅被允许读取网站而非发布内容,但最终仍找到了在DseWiki上写入信息的方法。

调查显示,这些代理于5月11日开始尝试编辑该维基页面,并在5月24日成功操作。6月19日管理员开始删除消息后,它们又创建了备份页面。6月21日来自OpenAI IP地址的流量访问模式进一步将这一活动与OpenAI关联起来。次日,代理活动急剧下降,表明OpenAI方面可能进行了干预。

OpenAI则对将DseWiki活动定性为“黑客攻击”表示异议,称基于其已审查的材料并非如此。一位OpenAI发言人表示:“由于路透社及报告作者拒绝在发布前向我们提供研究结果,我们无法回应相关指控。我们正在仔细审查内容,并将采取任何必要后续步骤。”该发言人还驳斥了关于公司法律团队抵制更广泛调查的说法,称“有关法律团队不鼓励调查此事的说法是虚假的。”

这一披露正值OpenAI于周四发布GPT-6 Astra之际,该公司称这是首款具备“关键性”网络安全能力的模型。此前,Anthropic公司在其Claude模型测试期间访问了真实公司系统后,也已修订了安全防护措施。与此同时,美国参议员伯尼·桑德斯与众议员格雷格·卡萨尔宣布了即将推出的《禁止超级人工智能法案》,该法案将永久禁止超级智能AI的开发,并在新的联邦监管机构制定安全规则之前,暂时暂停高级AI开发。