首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >第 12 篇:安全防护体系 —— 三层 Guardrails 与权限分离原则

第 12 篇:安全防护体系 —— 三层 Guardrails 与权限分离原则

作者头像
宋振华
修改2026-08-07 12:00:03
修改2026-08-07 12:00:03
1150
举报
概述
2025 年 6 月,安全研究人员披露了 EchoLeak 漏洞(CVE-2025-32711,CVSS 9.3)——这是首个在生产环境 LLM 系统中被武器化、造成实际数据泄露的 Prompt Injection 攻击。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一、场景切入:一封邮件偷走了你的机密
  • 二、三层 Guardrails 架构
    • 2.1 输入防护层(Input Guardrails)
    • 2.2 工具防护层(Tool Guardrails)
    • 2.3 输出防护层(Output Guardrails)
    • 三层对比
  • 三、Tripwire 机制:并行 vs 阻塞
    • 并行模式(默认)
    • 阻塞模式
    • 选型决策
  • 四、权限与推理分离原则
    • 4.1 核心问题:为什么不能让模型自己管权限?
    • 4.2 Google DeepMind 的 CaMeL 架构
    • 4.3 权限分离的实现原则
  • 五、Claude Code 的权限模型
    • 5.1 三阶段权限流程
    • 5.2 Auto Mode 的双层防御
    • 5.3 OS 级沙箱
  • 六、Prompt Injection 防御策略
    • 6.1 Spotlighting 技术
    • 6.2 防御最佳实践
  • 七、后端视角映射
  • 八、代码实战:三层 Guardrails 中间件
    • 代码设计要点
  • 九、总结与下篇预告
    • 本文核心要点
    • 下篇预告
  • 参考文献
相关产品与服务
渗透测试服务
腾讯云渗透测试服务(Penetration Test Service, PTS),是一种专业的安全评估服务。其核心是以攻击者思维,模拟真实黑客的技术手段,对客户的Web应用、移动APP、微信小程序等目标进行黑盒安全测试。安全服务专家主动挖掘正常业务流程中隐藏的安全缺陷与漏洞,并深入评估这些漏洞可能造成的实际业务影响,为客户提供明确的修复建议。服务覆盖安全漏洞的全生命周期,包括发现、利用、验证修复,从而将主动防御深度融入您的产品研发、应用上线与定期安全自检计划中,系统化地提升应用的整体安全水位与对抗能力。
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档