
OpenAI 推出 ChatGPT 锁定模式与高风险标签,旨在应对提示注入攻击等新兴安全威胁。锁定模式限制网络连接功能,高风险标签帮助用户做出知情选择。本文深度解读这两项新功能的背景、工作原理与未来展望。
安全的新篇章 随着人工智能系统日益强大和互联,其安全挑战也在不断演变。2026 年 2 月 13 日,OpenAI 宣布在 ChatGPT 中引入 锁定模式(Lockdown Mode) 和 “高风险”标签(Elevated Risk labels),旨在帮助用户和组织更有效地应对提示注入攻击(prompt injection)等新兴安全威胁。这一举措标志着 OpenAI 在 AI 安全领域迈出了重要一步,体现了其纵深防御(defense-in-depth)策略的持续深化。 本文将深入解读这两项新功能的背景、工作原理、适用场景及未来展望,为您带来关于 OpenAI News 的最新深度分析。
连接性带来的安全挑战 随着 ChatGPT 等 AI 系统开始承担更复杂的任务——尤其是那些涉及网络和连接应用的任务——安全风险的性质也在发生变化。其中,提示注入攻击 已成为一个特别重要的新兴风险。在这种攻击中,第三方试图误导对话式 AI 系统,使其遵循恶意指令或泄露敏感信息。 例如,攻击者可能通过在共享文档或网页中嵌入恶意指令,诱导 AI 系统访问外部网站并泄露对话中的私有数据。传统的安全措施,如沙箱隔离、基于 URL 的数据外泄防护、监控与执行以及企业级控制(如基于角色的访问控制和审计日志),虽然提供了基础保护,但面对日益复杂的攻击手段,仍需更强大的补充措施。
锁定模式(Lockdown Mode) 是 ChatGPT 中一项可选的高级安全设置,专为高安全需求的用户或团队设计。它适用于那些愿意为了更严格的产品护栏而牺牲部分功能特性的场景。当启用锁定模式时,ChatGPT 会限制或关闭某些与网络或外部服务连接的功能,包括:
实时网络访问:仅允许访问缓存内容,阻止实时网络请求离开 OpenAI 的受控网络。
响应中的图像支持:关闭图像生成与显示功能。
深度研究(包括购物研究):禁止进行需要联网的研究任务。
代理模式(Agent Mode):限制 AI 代理的自主操作能力。
Canvas 网络连接:关闭画布功能中的网络交互。
实时连接器(live connectors):禁止与第三方应用实时数据交换。
文件下载:阻止从对话中下载文件。 这些限制共同作用,大幅减少了提示注入式攻击导致信息外泄的可能性。
锁定模式并非面向所有用户,而是针对一小部分高度注重安全的用户,例如:
知名企业的高管或安全团队:他们需要抵御高级持续性威胁(APT)。
处理敏感信息的个人或团队:如法律、金融、医疗等领域的专业人士。
希望获得“保守型”ChatGPT 体验的用户:在特定工作场景下,宁愿牺牲功能也要确保数据安全。
锁定模式最初面向 ChatGPT Enterprise、ChatGPT Edu、ChatGPT for Healthcare 和 ChatGPT for Teachers 等企业计划推出。2026 年 6 月 4 日更新后,已扩展至个人 ChatGPT 账户和自助式 ChatGPT Business 账户。 - 管理员控制:工作区管理员可以在“工作区设置”中创建新角色来启用锁定模式。启用后,锁定模式会在现有管理员设置之上叠加额外限制。
对于个人用户,可以通过 设置 > 安全 路径开启锁定模式。企业用户则由管理员在后台配置。
AI 产品在连接到用户的应用和网络时能提供更多帮助,但某些网络相关功能会引入尚未被行业安全缓解措施完全解决的新风险。OpenAI 认为,用户有权决定是否以及如何使用这些功能,尤其是在处理私有数据时。
为了更清晰、一致地标识风险,OpenAI 在 ChatGPT、ChatGPT Atlas 和 Codex 中对一系列现有功能统一使用 “Elevated Risk”(高风险) 标签。无论用户在哪个产品中遇到这些功能,都会收到相同的指导。 例如,在编程助手 Codex 中,开发者可以授予 Codex 网络访问权限,以便其在网上查找文档。相关设置屏幕会显示“高风险”标签,并附带清晰的说明: - 更改了什么?
通过“高风险”标签,用户可以更清楚地了解每个功能的风险收益比,从而做出更明智的选择。这种透明度是 OpenAI 安全策略的重要组成部分。
锁定模式和高风险标签是 OpenAI 纵深防御策略的最新补充。该策略涵盖多个层面:
模型层面:通过训练和微调减少模型对恶意指令的敏感性。
产品层面:沙箱隔离、防护提示、功能限制等。
系统层面:监控与执行、企业控制(如基于角色的访问控制和审计日志)。 锁定模式通过确定性禁用某些工具和能力,提供了比现有企业级数据安全更强的保护。它确保即使攻击者试图利用提示注入进行数据外泄,也无法成功。
OpenAI 表示将继续投资于加强安全防护措施,尤其是针对新颖、新兴或不断增长的风险。未来可能包括:
更广泛的消费者可用性:锁定模式计划在未来几个月内向消费者账户推出。
持续的风险评估:随着 AI 能力的提升,新的安全挑战将不断涌现,OpenAI 将保持警惕并快速响应。
行业协作:与安全社区、研究人员和客户合作,共同应对 AI 安全挑战。
OpenAI 推出锁定模式和高风险标签,展示了其在 AI 安全领域的领先思维。通过为用户提供更强大的控制权和更清晰的风险信息,OpenAI 在推动 AI 功能创新的同时,也坚守了安全底线。对于组织和个人而言,理解并善用这些新工具,将是在 AI 时代保护数据安全的关键一步。 随着 AI 系统越来越深入地融入我们的工作和生活,类似的安全创新将成为常态。OpenAI News 将持续关注这一领域的进展,为您带来第一手的深度解读。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。 编辑团队:内容策划 · 技术编辑 · AI 研究组 网站:bingdada.com © 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

OpenAI 披露 Axios 开发者工具安全事件,影响 macOS 应用签名流程。尽管未发现用户数据泄露,OpenAI 仍要求所有 macOS 用户在 2026 年 5 月 8 日前更新应用,以确保使用最新安全证书。

儿童学习语言的高效性远超AI,这一“数据效率差距”对AI研究和认知科学提出挑战。通过逆向工程儿童学习机制,科学家有望开发更高效的数据利用模型,并深化对人类认知的理解。

Replit CEO Amjad Masad 将出席 TechCrunch Disrupt 2026,探讨 AI 编程的未来。文章分析了 Replit 从 280 万到 10 亿美元年化收入的爆发式增长、90 亿美元估值背后的资本逻辑,以及 AI 编程工具对开发者生态的深层影响,并补充了国内同类产品的竞争格局。
获取最新的 SEO 与 GEO 技术资讯。
我们尊重您的隐私,随时可以取消订阅。