OpenAI 推出 Lockdown Mode,试图在聊天机器人和机密数据之间建一堵墙
OpenAI 在 6 月 6 日推出了一项名为 Lockdown Mode 的新功能,目标很直接:让使用 ChatGPT 的企业用户不再因为提示注入攻击而泄露内部数据。这是 OpenAI 在 AI 安全领域迈出的又一步,但效果如何仍需时间验证。
Lockdown Mode 的核心思路是隔离。开启后,ChatGPT 会禁止访问外部工具、禁止浏览网页,并且在一个沙箱环境中运行。这个环境的设计初衷是防止用户输入的提示词绕过系统安全限制,把敏感数据输出到不该去的地方。对金融、医疗、法律这些对数据安全要求极高的行业来说,这种隔离机制提供了基本的安全保障。
根据 OpenAI 的描述,Lockdown Mode 会在企业级环境中部署,针对的是那些使用 ChatGPT 处理内部文档和代码的团队。当模式开启时,系统会阻断任何试图通过提示注入提取数据的攻击路径。这种攻击并不复杂:一个恶意提示可能只是看起来像普通指令,但实际上包含了指令来提取数据库查询结果或内部 API 密钥。OpenAI 表示,他们的安全团队已经测试了超过 50 种常见的提示注入攻击模式。
不过安全研究员也指出,Lockdown Mode 并不能彻底消除提示注入的风险。ChatGPT 本身仍然会读取用户输入的内容并生成响应,这意味着攻击者只要找到一个有效的绕过方式,就能重新接触到被隔离的数据。OpenAI 自己也承认这一点,在公告中明确写道,该功能的目标是减少敏感数据被泄露的概率,而非完全消除。
这反映了整个 AI 行业面临的一个根本性难题:模型越强大,越需要读取上下文来生成有用的回答,而这恰恰是提示注入攻击的入口。微软的 GitHub Copilot 也遇到过类似问题,2023 年就有安全研究人员演示了如何绕过其安全过滤。OpenAI 的做法是在产品层面做隔离,而不是在模型层面做修补,这是一个务实的选择。
Lockdown Mode 的推出时机也值得注意。OpenAI 正在推进与特朗普政府的股权谈判,同时面临来自 Anthropic 的激烈竞争。在产品安全上持续投入,既能提升企业客户的信任度,也能在监管收紧之前建立行业标准的先例。至于这个功能能否真正让企业放心把核心业务交给 ChatGPT,答案可能要等到第一批采用企业的实际使用报告出来之后才能判断。
从竞争对手的角度看,Google 的 Gemini 已经在 2025 年推出了类似的安全隔离功能,但 OpenAI 是第一个把 Lockdown Mode 作为企业级可选模块正式推出的公司。这种差异化策略反映了 OpenAI 对自身用户结构的判断:他们更清楚企业客户的安全焦虑,因为 ChatGPT 的用户中,企业用户占比已经显著超过了早期阶段。OpenAI 需要证明自己的安全投入不只是公关手段。
与此同时,欧盟的 AI Act 法规对企业使用 AI 系统的数据安全要求正在收紧。Lockdown Mode 的推出让 OpenAI 在多了一个合规工具,能够在欧盟市场中更好地满足数据保护的要求。对于跨国企业来说,合规性和安全性是采购 AI 服务时最重要的两个考量因素。如果 Lockdown Mode 能在这些方面提供可验证的保障,OpenAI 的企业营收增长可能会因此加速。