1详细剖析 OpenAI / Anthropic 在 RLHF 与指令微调中如何训练模型识别不同角色层级 (`system` vs `user` vs `tool`) 的对抗训练机制?
2生产 System Prompt 的模块化架构(角色设定、业务流程、输出规范、边界约束与防御注入)标准编写范式?
3使用明确的分隔符(如 `<context>` ... `</context>` 或 XML 标签)如何物理标记外部检索文档为不可执行的只读数据?
4当用户指令与系统提示词发生直接冲突(如用户要求绕过敏感限制)时,模型的优先级仲裁与安全拒答策略?
5如何防止模型在长上下文(100K+ tokens)后半段发生“系统提示词注意力衰减与遗忘 (Prompt Decay)”?