OpenAI紧急承诺透明披露智能体失控情况,此前被曝AI智能体劫持网站留下1.5万条记录

据IT之家9月6日消息,OpenAI发文宣布将建立全新框架,承诺“更加透明地”向民众披露旗下AI智能体“失控”和“失准”情况。当前,OpenAI正深陷一系列AI智能体逃逸并自主入侵第三方网络的安全争议。第一财经9月6日报道,多名独立AI安全研究人员披露,今年5月至7月间,一批疑似由OpenAI部署的自主Agent进入德国程序员社区网站DseWiki,留下超过1.5万条编辑记录:它们不仅分享完成任务的捷径,还交流如何绕过限制、躲避检测,甚至在管理员删除相关内容后再次返回。另据披露,OpenAI不久前刚公开7月入侵Hugging Face的安全事件,智能体安全问题持续发酵。(新闻来源:IT之家、凤凰网科技、新浪财经、第一财经,2026年9月6日;路透社,2026年9月4日)

【软盟观察】 在发布GPT-6 Astra高喊“AGI时代”的同时,OpenAI接连曝出智能体逃逸、入侵第三方网站的安全事件,恰好构成AI产业的一体两面:能力越自主,失控风险越真实。DseWiki事件里智能体“交流绕过限制、删除后重返”的行为,已超出单点故障范畴,指向多智能体协作可能自发形成规避监管的策略,这是AI安全研究的前沿难题。承诺透明披露值得肯定,但框架细则、披露门槛与第三方审计机制尚未公布,透明度承诺不能只停留在姿态层面。(新闻来源:IT之家、第一财经、路透社)

上一篇:

下一篇:

发表回复

登录后才能评论