1详细梳理 Llama Guard 3 的 Harm Taxonomy 核心分类体系(S1 至 S13 类安全危害标准)?
2如何通过修改系统提示词中的危害策略定义 (Safety Policy Customization),使 Llama Guard 支持企业自定义私有违规分类?
3输入审核 (Input Moderation) 与输出审核 (Output Moderation) 的 Prompt 结构与角色标记差异?
4在流式响应 (Streaming Output) 场景下,如何结合滑动窗口对实时 Token 流进行分块安全审核以避免延迟阻断?
5Llama Guard 3 1B 轻量化边缘版 vs 8B 版在分类准确率 (F1-score) 与端到端推理延迟上的实测基准?