1详细对比直接提示注入 (Direct Injection) 与间接提示注入 (Indirect Injection) 的攻击路径与危害面差异?
2Dual-LLM 架构(Quarantine LLM 处理外部不可信数据并提取事实,Privileged LLM 仅接收纯结构化数据执行决策)的安全设计?
3对抗性前缀攻击 (Adversarial Suffix / GCG 梯度搜索攻击: 如追加乱码字符破坏安全对齐) 的成因与输入困惑度检测防御?
4如何使用随机 Nonce / 签名令牌 (Cryptographic Nonce Token) 封装输入边界以防攻击者伪造 XML 闭合标签?
5在 Agent 工具调用阶段,如何通过要求用户在终端显式审批确认 (Human-in-the-Loop Approval) 阻断高危写操作?