英國 AI Security Institute:Blog·· 3 小時前AI 評分70
AI 網絡安全任務的推理擴展證據:提高評測預算揭示更高成功率
Evidence for inference scaling in AI cyber tasks: Increased evaluation budgets reveal higher success rates
AI 導讀
英國 AI Security Institute(AISI)與 Irregular 的評測顯示,前沿模型在網絡安全任務中可利用更高推理預算取得更高成功率,並解出此前未解的任務。
來源:英國 AI Security Institute:Blog · aisi.gov.uk