跳到正文
原文
Hugging Face Blog·· 2025-12-23AI 評分52

AprielGuard 為現代 LLM 系統檢測安全風險與對抗攻擊

AprielGuard: A Guardrail for Safety and Adversarial Robustness in Modern LLM Systems

AI 導讀

ServiceNow AI 發佈 AprielGuard,一款 8B 參數的安全防護模型,可分類 16 類安全風險並檢測多種對抗攻擊。模型支援單獨提示詞、多輪對話及包含工具呼叫、推理軌跡和記憶的智能體工作流,並提供可輸出結構化解釋的推理模式和僅分類的快速模式。

來源:Hugging Face Blog · huggingface.co