跳到正文
熱點事件歷史事件

研究比較12個前沿模型的價值與行為差異

1 篇報道1 個報道來源4 天前更新

先了解這件事

AI 綜述

2026年10月3日03:59,Anthropic 在 Alignment Science Blog 發佈一項由 Anthropic Fellows 與 Thinking Machines Lab 合作進行的研究。研究以超過300,000個價值取捨情境測試12個前沿模型,報道指出,受測模型在價值排序及行為模式上存在差異。這篇報道目前提供的進展,是研究團隊完成上述跨模型測試並報告觀察到的差異;報道未列出各模型的具體排序、差異幅度或其他測試結果,因此不能據此補充個別模型的表現。

AI 根據報道生成 · 3 天前更新

報道時間線

沿着報道,瞭解事件的不同側面。

10月3日
  1. Anthropic:Alignment Science Blog
    壓力測試模型規範揭示不同語言模型的行為特徵差異

    Anthropic Fellows 與 Thinking Machines Lab 合作研究以超過 300,000 個價值取捨情境測試 12 個前沿模型,發現它們在價值排序與行為模式上存在差異。