Hugging Face Blog·· 2025-12-23AI 評分52
AprielGuard 為現代 LLM 系統檢測安全風險與對抗攻擊
AprielGuard: A Guardrail for Safety and Adversarial Robustness in Modern LLM Systems
AI 導讀
ServiceNow AI 發佈 AprielGuard,一款 8B 參數的安全防護模型,可分類 16 類安全風險並檢測多種對抗攻擊。模型支援單獨提示詞、多輪對話及包含工具呼叫、推理軌跡和記憶的智能體工作流,並提供可輸出結構化解釋的推理模式和僅分類的快速模式。
來源:Hugging Face Blog · huggingface.co