OpenAI确认GPT-5.6 Codex存在误删文件风险,建议用户禁用高权限模式
事件概述
近日,OpenAI官方发布安全公告,确认在其最新一代代码生成模型 **GPT-5.6 Codex** 中,存在一项严重的安全隐患:在特定高权限模式下,该模型可能生成包含意外文件删除操作的代码,导致用户本地或开发环境中的文件被误删。OpenAI建议所有使用该模型的开发者、团队和企业立即禁用高权限模式,直至补丁发布。
风险根源与技术分析
该问题的核心在于GPT-5.6 Codex在处理复杂、多步骤的代码生成请求时,对上下文指令的“误强化”行为。具体而言,当用户授予模型执行系统命令(如`rm`、`del`、`unlink`等)的权限时,模型可能因过度遵循用户隐含的“删除旧文件”意图,而错误地生成作用于非目标路径的删除命令。此外,模型在某些情况下会错误地解析环境变量或通配符(如`*`),导致删除范围扩大。
值得注意的是,该风险并非模型“恶意”行为,而是源自其训练数据中大量代码示例中常见的“清理临时文件”模式被过度泛化,叠加了高权限环境下的指令执行机制,从而引发非预期的副作用。
影响范围与行业警示
该漏洞主要影响以下场景:
– 使用GPT-5.6 Codex的CI/CD管道自动生成清理脚本;
– 开发者以root或管理员权限运行模型生成的代码;
– 集成该模型的IDE插件,启用了“自动执行”功能。
对于依赖AI代码生成进行快速迭代的团队,尤其是初创公司和DevOps团队,这可能导致关键数据丢失、项目中断甚至生产环境故障。这一事件也再次提醒行业:**AI生成的代码不应被视为“可信任的最终输出”,而应始终经过人工审查与沙箱测试**。
应对建议与未来展望
OpenAI已发布临时缓解措施:
1. **立即禁用高权限模式**,使用只读或受限权限账户运行模型生成的代码;
2. 开启模型输出的“代码审查钩子”,强制对所有删除操作进行二次确认;
3. 在代码生成提示中明确添加“禁止执行删除操作”的约束指令。
长远来看,本次事件凸显了当前AI代码生成模型在“安全边界模糊性”上的固有短板。OpenAI表示将在后续版本中引入**细粒度操作权限控制**与**行为一致性校验**机制,以减少此类误操作的发生。开发者社区也应建立更严格的安全实践,将AI辅助编码视为“建议”而非“命令”,从而在提升效率的同时守住数据安全底线。