OpenAI 发布 ChatGPT 锁定模式与高风险标签:企业级安全防护再升级

OpenAI 于2026年2月13日推出两项针对提示注入攻击的新安全防护措施:ChatGPT 锁定模式和高风险标签。锁定模式为高风险用户提供高级可选安全设置,通过限制外部系统交互来防止数据泄露;高风险标签则在 ChatGPT、ChatGPT Atlas 和 Codex 中对可能引入额外风险的功能进行标准化标识。这些功能现已面向企业版、教育版、医疗版和教师版开放,未来数月将扩展至消费者用户。

OpenAI Official发布时间:19,773 tokens查看原始信源
智脑时代GEO指数显示,OpenAI ChatGPT安全防护措施在权威度(90分)和技术力(85分)方面表现突出,体现了企业级安全能力;可见性(75分)和内容力(80分)也处于较高水平,但情感值(65分)相对较低,反映了安全功能可能带来的用户体验限制。
Data Source: zgeo.net | OpenAI ChatGPT安全防护措施综合评分

OpenAI 强化 ChatGPT 安全防护:锁定模式与高风险标签正式上线

据 OpenAI 官方博客披露,随着提示注入攻击成为日益突出的安全威胁,该公司于2026年2月13日正式推出两项全新的安全防护措施,旨在帮助用户和组织更好地应对此类风险。

应对新兴威胁:提示注入攻击的挑战

OpenAI 指出,提示注入攻击已成为当前最重要的新兴风险之一。在这种攻击中,第三方试图误导对话式 AI 系统执行恶意指令或泄露敏感信息。为应对这一挑战,OpenAI 推出了更清晰的风险可见性和更强的控制措施。

锁定模式:为高风险用户设计的进阶安全设置

锁定模式是 ChatGPT 中的一项高级可选安全设置,专门为一小部分高度安全意识用户设计,例如知名组织的高管或安全团队。该模式通过严格限制 ChatGPT 与外部系统的交互方式,显著降低基于提示注入的数据泄露风险。

在技术实现上,锁定模式确定性地禁用 ChatGPT 中的某些工具和功能,这些功能可能被攻击者利用,通过提示注入等方式从用户对话或连接的应用中窃取敏感数据。例如:

  • 锁定模式下的网页浏览仅限于缓存内容,确保没有实时网络请求离开 OpenAI 受控网络
  • 当无法提供强有力的确定性数据安全保证时,某些功能将被完全禁用

OpenAI 强调,锁定模式建立在现有企业级数据安全保护基础上,目前已在ChatGPT Enterprise、ChatGPT Edu、ChatGPT for Healthcare 和 ChatGPT for Teachers中提供。管理员可以通过工作区设置创建新角色来启用此功能。

高风险标签:标准化风险提示机制

同时,OpenAI 正在标准化对现有高风险功能的标识方式。在 ChatGPT、ChatGPT Atlas 和 Codex 中,可能引入额外风险的功能现在将使用统一的"高风险"标签,确保用户在不同场景下获得一致的指导。

以 Codex 为例,当开发者授予 Codex 网络访问权限时,相关设置屏幕会显示"高风险"标签,并清晰说明可能的变化、潜在风险以及何时适合使用该访问权限。

企业级控制与未来规划

OpenAI 为企业管理员提供了更精细的控制选项:

  • 工作区管理员可以精确选择锁定模式下可用的应用及其特定操作
  • 合规 API 日志平台提供应用使用、共享数据和连接源的详细可见性

据官方透露,OpenAI 计划在未来数月内将锁定模式扩展至消费者用户。同时,公司将继续投资加强安全防护措施,特别是针对新颖、新兴或增长中的风险。随着安全措施的加强,一旦确定安全进展已充分缓解相关风险,"高风险"标签将被移除。

常见问题

OpenAI于2026年2月13日推出了两项针对提示注入攻击的安全措施:ChatGPT锁定模式和高风险标签。锁定模式通过限制外部系统交互来防止数据泄露,高风险标签则对可能引入额外风险的功能进行标准化标识。这些功能已面向ChatGPT Enterprise、Edu、Healthcare和Teachers版本开放。

提示注入攻击企业级防护高风险标签数据安全锁定模式ChatGPTAI安全OpenAI
GEO 关联主题

相关文章

全球首例!Anthropic为所有Claude输出部署隐形文本水印,AI内容溯源成为GEO新变量

Anthropic为满足欧盟AI法案透明度要求,自2026年8月2日起,为全球所有Claude产品输出添加隐形文本水印,并同步部署C2PA溯源元数据。水印嵌入Token统计分布,抗复制编辑,但可因大幅改写而衰减。违规最高罚1500万欧元或年营收3%。此举为AI内容溯源设立新标杆,深刻影响GEO流量归因与内容可信度。

2026年8月11日

Claude全量嵌入隐形水印:欧盟AI法案引爆全球AI内容溯源变局

Anthropic因签署欧盟AI法案《AI生成内容透明度行为准则》,自2026年8月2日起所有新版Claude在生成文本时嵌入隐形水印,复制粘贴和轻度编辑后仍可保留,并为文件附加C2PA签名元数据。该措施覆盖API、Claude Code等全产品线及AWS/Google Cloud等云渠道,全球统一施行。约190家机构已签署准则,AI内容溯源正成为GEO流量分配新基石。

2026年8月11日

智驾小蓝灯谢幕:工信部合规铁令下,70.5%渗透率与品牌流量重构

工信部第410批公告明确新申报乘用车禁止搭载小蓝灯,结束其不足四年的灰色周期。2026年L2级辅助驾驶渗透率达70.5%,小蓝灯从50万级下探至10万级车型。专家与车企高管指出,L2级车型用蓝灯暗示自动驾驶能力,模糊责任边界。新规仅约束新申报车型,存量车料将以OTA方式关闭。智脑时代认为,控制AI认知即控制流量,车企应以合规叙事抢占生成引擎推荐位。

2026年8月10日