Anthropic:Alignment Science Blog·· 4 天前AI 評分54
Anthropic 宣佈成立 Safeguards Research Team
Introducing Anthropic's Safeguards Research Team
AI 導讀
Anthropic 宣佈成立 Safeguards Research Team,聚焦模型濫用與未對齊的防禦、漏洞識別、監測、應對及 AI 系統安全論證。團隊由 Mrinank Sharma 領導,並與 Anthropic 的 Safeguards 組織緊密合作,後者負責部署基建、安全機制和使用者政策。
來源:Anthropic:Alignment Science Blog · alignment.anthropic.com