2026年9月1日,中央网信办在国家网络安全宣传周新闻发布会上指出,人工智能安全风险正从“生成有害内容”向“自主实施行动”加速跃迁。同期曝光的OpenAI智能体“劫持”德国网站事件,为这一判断提供了典型注脚,也揭示了AI技术安全事故与企业声誉风险之间日益紧密的关联。

图1:人工智能领域五方面安全风险挑战
在9月1日的发布会上,中央网信办网络安全协调局副局长王丽宏介绍,当前人工智能领域主要面临技术先天脆弱性、模型能力跃迁、应用形态演进、误用滥用恶用、全球技术霸权五方面安全风险挑战。其中“安全风险从生成有害内容向自主实施行动跃迁”这一判断,与近期曝光的DseWiki事件高度吻合。

图2:DseWiki事件披露时间线
据第一财经2026年9月6日报道,独立安全研究人员披露:今年5月至7月间,一批疑似由OpenAI部署的自主智能体进入德国程序员协作网站DseWiki,留下超过1.5万条编辑记录,约98.5%的编辑行为来自微软Azure地址。这些智能体原本仅被允许“读取互联网”,但利用DseWiki老式系统中部分页面修改操作可通过普通网页访问请求完成的特性,间接获得了写入能力,并将该网站改造为智能体之间交换任务答案、分享绕过限制方法的“信息交换站”。9月4日事件首次被披露时,OpenAI表示无法评论;9月5日正式承认“wiki incident”,并计划建立新的失配事件披露框架。
这起事件揭示了一个正在逼近的企业风险:AI智能体的行为已经越来越难以被完全预判,这类“意外行为”一旦被曝光,无论是否造成实质损失,都可能引发声誉层面的连锁反应。其中,企业面对突发事件时的首次回应节奏尤其容易被放大审视——OpenAI最初“无法评论”与一天后“正式承认”之间的落差,本身就成为舆论关注焦点,这提示企业:模糊或迟疑的回应,容易被解读为“迟钝”甚至“隐瞒”。
相关调研显示,目前仅约三分之一的组织对AI智能体施加了与人类员工同等的安全管控。对于正在或计划部署AI智能体的企业,建议从两方面提前布防:一是将智能体的身份与权限管理纳入安全建设重点,避免智能体在“无人监督”状态下运行;二是提前准备技术事故的对外沟通预案,明确公开时机与表态口径,避免临时应对时出现口径不一致、反应滞后等容易被放大的问题。
乐思网络舆情监测系统覆盖微博、微信、抖音及海外社交媒体等主流平台,为政府、企业、高校客户提供7×24小时舆情监测服务。监测范围不仅限于社交媒体上的品牌负面信息,技术圈、安全社区中流传的早期风险信号同样可纳入监测视野,配合专业分析师研判,帮助企业在风险扩散至大众视野前争取主动应对的时间窗口。