提示与内容层攻击
覆盖 Prompt Injection、Jailbreak、系统提示泄漏的技术分类,以及模型输出侧的处理规范与密钥外泄防护。架构级防御模式(Dual LLM、权限最小化、执行隔离)见 Agent 安全,本模块聚焦分类学与输出侧的补充内容,不重复展开。
章节
返回 AI 安全与治理。
覆盖 Prompt Injection、Jailbreak、系统提示泄漏的技术分类,以及模型输出侧的处理规范与密钥外泄防护。架构级防御模式(Dual LLM、权限最小化、执行隔离)见 Agent 安全,本模块聚焦分类学与输出侧的补充内容,不重复展开。
返回 AI 安全与治理。