AI 快讯 编译自 the_decoder #功能更新#安全#ChatGPT

ChatGPT 推出 Lockdown Mode:禁用联网与 Agent 模式,防御提示注入攻击

OpenAI 为 ChatGPT 新增 Lockdown Mode,可禁用联网、Deep Research 和 Agent 模式,防止敏感数据通过提示注入被窃取。该模式并非完全免疫,但能阻断数据外泄的最后一步。了解其原理、局限性及对中文用户的影响。

编译发布 2026/06/07 原文发布 2026/06/07

一句话看懂

OpenAI 为 ChatGPT 推出 Lockdown Mode,禁用联网、Deep Research 和 Agent 模式,阻断提示注入攻击的数据外泄路径。

详细发生了什么

OpenAI 为 ChatGPT 引入了一项新安全功能——Lockdown Mode。该模式旨在降低提示注入(prompt injection)攻击的风险,这种攻击通过恶意指令诱导模型泄露敏感数据或执行非授权操作。

启用 Lockdown Mode 后,ChatGPT 会自动禁用以下功能:

  • 联网搜索(web access)
  • Deep Research(深度研究)
  • Agent Mode(代理模式)

这些功能原本可能被攻击者利用作为数据外泄的通道。例如,攻击者可通过提示注入让模型调用联网功能,将窃取的数据发送到外部服务器。Lockdown Mode 通过切断这些出口,使攻击者无法完成数据外泄的最后一步。

不过,OpenAI 也明确指出,该模式并未从根本上解决提示注入问题——它只是阻止了数据被发送出去。模型仍然可能被诱导输出敏感信息,只是无法通过联网或 Agent 功能自动外传。提示注入本身仍是一个未解决的难题。

Lockdown Mode 目前已在 ChatGPT 的 API 和 Web 端可用,用户可在设置中开启。对于企业客户,该模式可结合自定义指令和内容过滤策略,形成多层防护。

中文圈视角

对中文用户而言,Lockdown Mode 的实际意义取决于使用场景。

1. 国内用户用得上吗? ChatGPT 在国内需要特殊网络环境才能访问,因此 Lockdown Mode 对大多数普通用户来说并非直接可用。但对于通过 API 接入 ChatGPT 的国内开发者或企业,该功能是重要的安全增强——尤其是处理用户输入可能包含恶意指令的客服、内容生成等场景。

2. 国产平替的现状 国内大模型如 DeepSeek、Kimi、智谱 GLM 等目前尚未推出类似 Lockdown Mode 的专用安全模式。它们通常依赖内容过滤和敏感词库来应对注入攻击,但缺乏对联网/Agent 功能的精细控制。对于需要高安全性的企业应用,ChatGPT 的 Lockdown Mode 提供了一个可参考的范式。

3. 对中文用户的具体场景影响

  • 编程辅助:若使用 ChatGPT 处理包含第三方代码的 prompt,Lockdown Mode 可防止模型意外执行恶意指令。
  • 办公自动化:在 Agent 模式下处理文档或邮件时,Lockdown Mode 能降低数据外泄风险。
  • 学习研究:禁用 Deep Research 可能影响需要联网搜索的深度分析,但普通问答不受影响。

4. 中文圈尚未讨论的盲点 Lockdown Mode 的局限性在于它只防外泄,不防模型本身输出敏感信息。对于中文用户,如果模型被诱导输出内部知识库中的隐私数据(如企业文档),Lockdown Mode 无能为力。这提示我们,安全需要从输入过滤、输出审查和功能控制多个层面入手。

几条值得记住的细节

  • Lockdown Mode 仅禁用联网、Deep Research 和 Agent 模式,不影响普通对话和文件上传。
  • 该模式不阻止模型输出敏感信息,只阻止通过联网或 Agent 自动外传。
  • 提示注入攻击本身仍是未解决问题,Lockdown Mode 是缓解措施而非根治方案。
  • 企业用户可结合自定义指令和内容过滤策略,构建多层防护。
  • 该功能已在 ChatGPT Web 端和 API 中可用,用户可在设置中手动开启。

一句话总结

Lockdown Mode 是 ChatGPT 安全性的重要补丁,但提示注入的根除仍需更根本的解决方案。