跳到正文

#OpenAI

今日 37 條
7月22日週三
7月21日週二
  1. OpenAI:失準報告與通報72

    OpenAI 與 Apollo Research 提出 Contrastive SDF 測量模型的獎勵尋求傾向

    OpenAI 與 Apollo Research 開發 Contrastive SDF,透過相反的合成文件塑造評分者偏好信念,再比較模型行為以測量獎勵尋求。未接受安全訓練的 OpenAI o3 能力導向 RL 檢查點顯示,模型對評分者偏好的敏感度隨訓練推進而上升,即使該偏好與用戶或開發者要求相反。

7月20日週一
7月18日週六
7月17日週五
7月16日週四
7月15日週三
7月14日週二
7月10日週五
7月9日週四
  1. OpenAI:部署安全與系統卡61

    OpenAI 發佈 GPT-5.6 系統卡,列出安全評估結果

    OpenAI 發佈 GPT-5.6 系統卡,公開模型訓練資料、部署安全模擬及生物化學能力評估。部署模擬預測 GPT-5.6 Sol 的違規內容總量與 GPT-5.5 大致相若,性相關違規率由 0.05% 升至 0.07%,心理健康相關違規回應率由 0.03% 降至 0.02%。OpenAI 將 GPT-5.6 系列的生物與化學能力列為 High,並判定三款模型均不需按 Critical 能力處理。

7月8日週三
7月7日週二
7月1日週三
  1. Ethan Mollick:One Useful Thing66

    AI 工作模式由聊天機器人協作轉向 Agent 管理

    Ethan Mollick 指出,隨着 AI 系統能持續處理更長任務,工作模式正由人與聊天機器人協作,轉向把工作交給 Agent 執行並由人管理。Epoch 的測試指出,Opus 4.7 獨立工作 14 小時,建成一個相當於人類工程師需花 2-17 週完成的軟件套件,token 成本為 $251。

6月30日週二
6月29日週一
6月26日週五
6月24日週三