跳到正文
熱點事件持續更新

研究提出 AI 自主複製能力評測基準

1 篇報道1 個報道來源3 小時前更新

先了解這件事

AI 綜述

2026年10月6日,英國 AI Security Institute 的研究提出 RepliBench,作為評估 AI 系統自主複製能力的基準。該基準透過 20 項 LLM 智能體評測衡量相關能力,研究並測試了 7 個前沿模型。結果顯示,表現最佳的模型在 20 個任務系列中的 15 個取得高於 50% 的 pass@10;在最難的變體中,則有 9 個任務系列達到同一水平。研究指出,沒有任何受測模型能完成自主複製所需的全部組成任務。

AI 根據報道生成 · 3 小時前更新

報道時間線

沿着報道,瞭解事件的不同側面。

10月6日
  1. 英國 AI Security Institute:Blog
    RepliBench:評估 AI 系統自主複製能力的基準

    UK AI Security Institute 的研究提出 RepliBench,透過 20 項 LLM 智能體評測衡量 AI 系統的自主複製能力。研究測試 7 個前沿模型,最佳模型在 15/20 個任務系列取得 >50% pass@10,在最難變體的 9/20 個任務系列達到此水平;沒有模型能完成自主複製所需的全部組成任務。

本事件熱度走勢

還沒有足夠的連續觀測數據,暫不繪製趨勢。