跳到正文
原文
英國 AI Security Institute:Blog·· 3 小時前AI 評分60

SandboxEscapeBench:安全評估 AI 智能體容器逃逸能力的基準測試

Can AI agents escape their sandboxes? A benchmark for safely measuring container breakout capabilities

AI 導讀

英國 AI Security Institute 開源 SandboxEscapeBench,用於在隔離環境中評估 AI 智能體的容器逃逸能力。基準涵蓋18種橫跨編排、執行階段及核心層的情境,每個容器均在加固虛擬機內運行。評測顯示,前沿模型能可靠地利用常見錯誤設定突破沙盒,增加推理時的 tokens 預算亦會提高成功率,但沒有模型解決最難的情境。

來源:英國 AI Security Institute:Blog · aisi.gov.uk