OpenAI推出ChatGPT封锁模式,通过切断网络连接来防止数据泄露

随着生成式人工智能迅速迈入智能体时代,模型调用工具及连接互联网的能力日益增强,这为安全系统带来了新的严峻挑战。为应对激增的提示注入攻击,OpenAI推出了一项名为“封锁模式”的全新可选安全功能,目前所有已登录用户、各类账户类型以及工作空间均可使用该功能。
提示注入攻击长期以来一直困扰着大型语言模型开发者。攻击者常常将恶意指令隐藏在网页、第三方文档或其他外部数据中。当ChatGPT在连接互联网时读取这些被污染的内容,就可能会被诱使忽视自身的核心安全规则,执行未经授权的操作,甚至会在用户不知情的情况下,将商业机密或个人信息等敏感数据秘密发送到外部的恶意服务器。
为解决这一业内广为人知的问题,OpenAI推出的新“封锁模式”采取了务实的方法。它并不试图完美识别每一条新的恶意指令,而是直接限制最危险的功能——即访问外部网络的能力。
一旦用户或工作空间管理员启用封锁模式,ChatGPT的许多核心功能都会受到限制。实时网页浏览功能会被大幅削弱——系统仅能访问受保护的缓存网页内容,这可能导致搜索结果不完整、过时或无法获取。该模型也无法从外部网络检索或显示任何图片,也不能从网上下载文件以进行高级数据分析。
此外,“深度研究”和“智能体模式”等高端生产力功能也会被完全禁用。即便在Canvas功能中生成的代码也无法访问互联网。在这种模式下,大型语言模型只能处理用户手动上传的本地安全文档。
不过,OpenAI的官方文档明确指出,封锁模式并非坚不可摧的防护屏障,它无法保证100%防范提示注入攻击。恶意指令仍可能潜藏在合法的缓存网页或用户上传的文件中,继续干扰模型的判断。
这一新功能凸显出人工智能行业的一个现实悖论:大型语言模型对互联网的访问权限越开放,其自动化工具的使用程度越高,暴露出的攻击面也就越大。封锁模式体现了OpenAI试图为人工智能能力划定安全边界的明确意图。它并不承诺“绝对安全”,而是将“更强大、更智能的协作体验”与“更低的数据泄露风险”之间的权衡交由用户和企业管理员自行决定。
