跳到正文
熱點事件歷史事件

Anthropic 成立 Safeguards Research Team

1 篇報道1 個報道來源4 天前更新

先了解這件事

AI 綜述

2026年10月3日,Anthropic 宣佈成立 Safeguards Research Team。團隊聚焦防範模型遭濫用及未對齊情況,並負責漏洞識別、監測與應對,以及 AI 系統安全論證。團隊由 Mrinank Sharma 領導,並與 Anthropic 的 Safeguards 組織緊密合作。報道指出,Safeguards 組織負責部署基建、安全機制和使用者政策;Safeguards Research Team 則專注於模型安全相關研究工作。

AI 根據報道生成 · 4 天前更新

報道時間線

沿着報道,瞭解事件的不同側面。

10月3日
  1. Anthropic:Alignment Science Blog
    Anthropic 宣佈成立 Safeguards Research Team

    Anthropic 宣佈成立 Safeguards Research Team,聚焦模型濫用與未對齊的防禦、漏洞識別、監測、應對及 AI 系統安全論證。團隊由 Mrinank Sharma 領導,並與 Anthropic 的 Safeguards 組織緊密合作,後者負責部署基建、安全機制和使用者政策。