AI代理操作再出状况。OpenAI近日正式确认,其新一代大语言模型GPT-5.6在特定条件下会误删用户文件,并将此定性为“无心之失”,强调此类事件发生概率极低。
事件起因于新模型上线后,HyperWrite
CEO马特·舒默率先在X平台反映其Mac文件被GPT-5.6-Sol大量删除;随后软件工程师布鲁诺·莱莫斯也称该模型清空了他的生产数据库。两起事故接连发生,引发业内对AI代理操作安全性的关注。
OpenAI Codex项目工程主管蒂博·索蒂奥调查后解释,该问题仅在“完全访问模式”启用、且未开启沙盒和自动审核时才会触发。模型在此权限下试图改写𝐻𝑂𝑀𝐸环境变量,却因逻辑失误删除了HOME环境变量,却因逻辑失误删除了HOME路径本身。官方模型卡也显示,GPT-5.6触发“3级严重性行为”的频率略高于前代,此类行为包括未经确认删除云端数据、绕过安全控制等。
索蒂奥表示,即便在开放权限下,这类误操作也不符合预期。OpenAI正着手更新提示词、引导用户选用更保守的权限配置,并增设防护层,详细的事后分析报告将于近日公布。
值得注意的是,GPT-5.6并非首例。2025年Replit的AI编程助手和2026年Cursor工具均曾误删生产数据库。这些事件反复警示:AI代理在高权限场景中若无充分监管,后果可能不堪设想。
【免责声明】部分数据来源于网络公开报道及行业资讯,如有侵权,请及时与本网站联系,我们将第一时间予以删改。文中所涉观点、数据及分析仅代表小编个人观点,仅供参考,不构成任何投资建议、商业决策依据或法律承诺。投资有风险,决策需谨慎;任何单位或个人据此进行商业决策、经营行为所产生的风险,均自行承担。