英國 AI Security Institute:Blog·· 3 小時前AI 評分60
SandboxEscapeBench:安全評估 AI 智能體容器逃逸能力的基準測試
Can AI agents escape their sandboxes? A benchmark for safely measuring container breakout capabilities
AI 導讀
英國 AI Security Institute 開源 SandboxEscapeBench,用於在隔離環境中評估 AI 智能體的容器逃逸能力。基準涵蓋18種橫跨編排、執行階段及核心層的情境,每個容器均在加固虛擬機內運行。評測顯示,前沿模型能可靠地利用常見錯誤設定突破沙盒,增加推理時的 tokens 預算亦會提高成功率,但沒有模型解決最難的情境。
來源:英國 AI Security Institute:Blog · aisi.gov.uk