1直接提示注入 (Direct Injection) 与间接提示注入 (Indirect Injection) 的攻击路径差异与在 RAG 场景下的实操防御方案?
2XML 结构化标签隔离技术(如 `<system>`, `<context>`, `<user_query>`)如何帮助 LLM 的注意力机制区分特权系统指令与非受信任用户数据?
3思维链 (CoT) 与自洽性采样 (Self-Consistency: 采样
N 条推理路径并对最终答案投票) 在提升复杂多步逻辑推理准确率中的原理?
4Guardrails (如 NeMo Guardrails, Llama-Guard) 在输入前置拦截与输出后置审查中的双向异步流水线设计?
5如何防范 Prompt 逆向工程与系统提示词泄漏攻击 (Prompt Extraction Attack)?