熱點事件持續更新
研究提出 AI 自主複製能力評測基準
1 篇報道1 個報道來源3 小時前更新
先了解這件事
AI 綜述
2026年10月6日,英國 AI Security Institute 的研究提出 RepliBench,作為評估 AI 系統自主複製能力的基準。該基準透過 20 項 LLM 智能體評測衡量相關能力,研究並測試了 7 個前沿模型。結果顯示,表現最佳的模型在 20 個任務系列中的 15 個取得高於 50% 的 pass@10;在最難的變體中,則有 9 個任務系列達到同一水平。研究指出,沒有任何受測模型能完成自主複製所需的全部組成任務。
AI 根據報道生成 · 3 小時前更新
最新進展10月6日 12:46
研究提出 RepliBench;測試顯示,沒有受測模型能完成自主複製所需的全部組成任務。報道時間線
沿着報道,瞭解事件的不同側面。
10月6日
- 英國 AI Security Institute:BlogRepliBench:評估 AI 系統自主複製能力的基準
UK AI Security Institute 的研究提出 RepliBench,透過 20 項 LLM 智能體評測衡量 AI 系統的自主複製能力。研究測試 7 個前沿模型,最佳模型在 15/20 個任務系列取得 >50% pass@10,在最難變體的 9/20 個任務系列達到此水平;沒有模型能完成自主複製所需的全部組成任務。
本事件熱度走勢
還沒有足夠的連續觀測數據,暫不繪製趨勢。