跳到正文

#OpenAI

今日 37 條
3月28日週六
  1. OpenAI:失準報告與通報51

    OpenAI 研究:對齊中訓練能泛化多遠?

    OpenAI 研究人員測試對齊中訓練在類似 o4-mini 的模型上能否泛化;模型經過推理後訓練後,這種訓練效果未能穩定延伸至較貼近現實的聊天及智能體評測。他們分別以 230k 份文件(約 340M tokens)進行對齊或失準中訓練,並與不加額外中訓練的基線比較;接近訓練分佈的問答評測呈現預期排序。聊天評測中,兩種中訓練結果大多相近;智能體評測未能明確區分三組模型,整體分數沒有顯著差異。

3月25日週三
3月24日週二
3月23日週一
3月19日週四
3月17日週二
3月16日週一
3月11日週三
3月10日週二
3月9日週一
3月6日週五
3月5日週四
3月4日週三
2月28日週六
  1. OpenAI News62

    OpenAI 説明與 Department of War 的合約安排

    OpenAI 説明與 Department of War 的合約安排,涵蓋安全紅線、法律保障,以及 AI 系統在機密環境中的部署方式。

    推薦理由:內容從安全紅線、法律保障和機密環境部署三方面呈現合約安排,提供理解政府機密場景中 AI 系統部署的具體切入點。

2月27日週五
2月26日週四
2月25日週三
2月24日週二
  1. AI as Normal Technology64

    新論文《Towards a Science of AI Agent Reliability》分析 AI 智能體可靠性

    新論文評估 14 個模型,發現近 18 個月模型能力提升明顯,AI 智能體可靠性僅小幅改善。研究把可靠性拆分為一致性、穩健性、可預測性和安全性四個維度,以 12 項指標測試 GAIA 與 TauBench;可預測性是整體最弱的一環。作者建議在準確率之外同步報告可靠性各維度表現,並計劃推出 AI agent reliability index。

2月23日週一