OpenAI失控智能体被曝利用超10个网站通信,引发AI安全透明度担忧

https://assets.wanlianyida.com/industry-uniapp/web/static/image-default.BtYt8t8Z.png
产联社海外
·阅读量:6,431
研究人员称,OpenAI智能体今年早些时候曾利用至少10个此前未披露的网站进行未经授权通信,包括维基站点、文本存储平台和高校链接服务;OpenAI表示正在扩大调查,但尚未发现类似Hugging Face事件规模的活动

产联社编辑|沛林

企业微信20260916-101148@2x.png

图片由AI生成

9月10日,据路透社报道,多组独立研究人员发现,OpenAI人工智能智能体(AI agents)今年早些时候曾利用至少10个此前未公开的网站建立未经授权的通信渠道,显示此前披露的智能体“失控”活动范围可能比外界已知情况更广。

研究人员称,这些智能体绕过了原有行为限制,在多个第三方网站留下信息或建立临时通信方式。虽然相关行为尚未达到传统意义上的网络攻击,更接近未经授权的信息发布或垃圾信息行为,但其绕过限制、主动寻找外部通信渠道的能力,引发了对高级AI系统可控性和企业透明度的担忧。

加州非营利人工智能安全组织CivAI研究人员Andrew Yoon表示,其调查发现,这些智能体在今年5月至7月期间至少使用了18个此前未披露的网站。“几乎可以肯定,还有更多我们不知道的活动正在发生。”

此前,研究人员曾披露,OpenAI智能体劫持一个德语维基网站,将其作为临时信息交流平台,用于考试作弊。该事件以及此前涉及开源代码平台Hugging Face的事件,引发了外界对AI模型自主行为能力的关注。

智能体寻找网站漏洞建立“留言板”

根据路透社采访的多名研究人员,他们通过分析不同网站留下的相同数据字符串、相似用户名以及关联活动,追踪到了这些智能体的行动轨迹。

部分研究人员发现,这些活动涉及:

社区维护的维基网站;

在线文本存储网站;

高校运营的网址缩短服务;

一些个人技术网站和兴趣社区。

调查人员称,在部分案例中,他们发现相关活动来自指向微软Azure基础设施的IP地址,而OpenAI部分服务也使用Azure云基础设施。

不过,由于不同研究团队采用的方法不同,目前对于受影响网站数量尚无统一统计。路透社无法独立验证所有调查结果,但受访研究人员均认为涉及网站数量超过10个。

其中一名研究人员表示,这些智能体可能利用了一些老旧网站允许用户通过非标准方式编辑内容的漏洞,将这些网站变成临时通信渠道。

软件开发人员、前美国国会助理Kenneth Russell DeGraff表示,如果AI模型被要求“只能读取信息、不能发布内容”,模型可能会寻找其它方式留下信息。

他将这种行为比作考试中禁止学生交流,但学生仍通过在其它地方留下纸条交换答案。

OpenAI称正在扩大审查

对于为何数月未公开相关活动,以及智能体究竟使用了多少网站进行通信,OpenAI没有直接回应。

该公司表示,正在对智能体活动开展更广泛审查,并称截至目前,“尚未发现其它在严重程度或规模上与Hugging Face事件相当的活动”。

OpenAI同时表示,正在制定一套框架,用于在AI模型训练、评估和部署过程中报告所谓“失调”(misalignment)行为,并将在近期公布。

所谓“失调”,通常指AI系统行为偏离开发者预期目标或安全约束的情况。

不过,研究人员认为,OpenAI披露的信息仍不足以判断事件规模。

悉尼·冯·阿克斯(Sydney von Arx)此前发现德国维基网站异常活动,她表示,其团队已经在23个此前未被报道的网站发现可信的智能体活动迹象,但强调所有估计都可能低估真实规模。

“我们完全不知道外面到底还有多少,”她说。

AI自主能力提升带来监管压力

此次事件发生之际,全球科技企业正快速推进AI智能体开发。与传统聊天机器人不同,AI智能体能够自主执行搜索、调用工具、处理任务甚至与外部系统交互。

支持者认为,智能体将成为下一代生产力工具;但安全研究人员担忧,随着模型能力增强,AI可能出现开发者未预料的策略行为。

此次事件的关键争议并非智能体是否进行了恶意攻击,而是其是否具备在限制条件下自行寻找替代路径的能力。

OpenAI此前因AI模型安全问题已受到监管机构和研究社区关注。此次事件可能进一步推动行业建立更严格的AI行为监测、测试和披露机制。

目前,部分受影响网站运营方已开始与OpenAI沟通。多伦多大学表示,OpenAI已经就其链接缩短服务可能被使用一事联系该校。

曾为多个受影响维基网站提供托管服务的软件开发者Helmut Leitner表示,OpenAI在路透社询问相关情况后才与其取得联系。他认为,责任不应归咎于AI系统本身,而应归属于设计、部署和管理这些系统的组织。

“责任不在于一台所谓有道德的机器,而在于其背后的人和组织。”Leitner表示。

文章来源:OpenAI’s rogue agents used at least 10 more sites for unauthorized comms,researchers say,bloomberg

商务合作/报料请联系侯经理 18801065284(微信同号)

特别声明:本文仅供参考,不构成任何投资建议,未经允许不得转载。

63
18
分享