Anthropic 擴大網絡核驗計劃,讓更多安全團隊在較少安全防護限制下測試 Claude 模型
已挖出十几万漏洞,Anthropic 向更多安全团队开放其最强 Claude 模型
Anthropic 正擴大網絡核驗計劃,讓經審核的網絡安全專業人員在較少安全防護限制下測試 Claude 模型。合作方於 4 月至 7 月至少確認 129000 個漏洞,Anthropic 的開源掃描於 4 月至 10 月另發現 5500 個;目前逾 33000 個漏洞被評為嚴重或高危,Anthropic 表示數據可能有漏計,實際影響至少是現有數據的五倍。
計劃把模型測試權限分為防禦、紅隊和專項三層,並配合不同資格審核及安全管控,具體呈現開放測試的範圍和限制。
IT之家 10 月 7 日消息,據路透社報道,Anthropic 正在擴大一項計劃,允許經過審核的網絡安全專業人員在更少安全防護的情況下測試其最強大的人工智能模型,此前該公司的“玻璃翼計劃(Project Glasswing)”今年已幫助發現了超過 10 萬個軟件漏洞。

據IT之家瞭解,玻璃翼計劃旨在保障全球關鍵軟件的安全。該計劃的合作方在 4 月至 7 月期間,至少找到了 129000 個已經核實的漏洞。而 Anthropic 自身開展的開源掃描工作,在 4 月到 10 月之間又額外發現了 5500 個漏洞。
到目前為止,已有超過 33000 個漏洞被評定為嚴重或者高危等級。
Anthropic 表示這些數據很可能存在統計遺漏,且實際影響至少是目前數據的五倍,因為該數據來自對有限數量合作方的調查。
新版網絡核驗計劃(Cyber Verification Program,簡稱 CVP)於當地時間週二正式對外公佈,整合了 Anthropic 過去半年運行的兩套項目。
第一個就是玻璃翼計劃,它為負責關鍵軟件安全防護的機構開放了 Claude Mythos 的使用權限,這是 Anthropic 旗下網絡安全能力最強的模型系列。第二個是舊版的網絡核驗計劃,它向經過資質審核的安全團隊開放防護限制下調後的 Claude Opus 以及 Claude Sonnet 模型。
該公司在 4 月發佈 Claude Mythos Preview 的時候,曾引發擔憂:人工智能或許會在軟件完成安全加固之前就對其發起黑客攻擊。
新設立的項目一共分為三個層級,每一層級都設置了對應的資質審核要求與安全管控措施。全部三個層級都可以使用 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 以及後續推出的新模型。
防禦層級適用於事件應急響應、惡意軟件分析這類工作。安全團隊、關鍵基礎設施運營方、開源項目維護人員以及擁有漏洞上報履歷的研究人員都可以提交申請。
紅隊層級在此基礎上增加了授權滲透測試與紅隊攻防演練權限,但僅接受機構申請。
專項層級的約束最少,僅面向一小部分機構開放;這些機構獲得許可,可以對電網、航空飛行系統、銀行跨行轉賬基礎設施這類事關安全的關鍵系統開展測試。
Anthropic 會同美國政府一同審核每一名參與成員的資質,原本玻璃翼計劃的現有成員將會歸入這一專項層級。
來源:IT之家 · ithome.com