OpenAI News·· 2025-08-27AI 評分44
OpenAI 與 Anthropic 分享聯合安全評估結果
OpenAI and Anthropic share findings from a joint safety evaluation
AI 導讀
OpenAI 與 Anthropic 分享首個同類聯合安全評估的結果,雙方互相測試對方的模型。評估涵蓋對齊失準、指令遵循、模型幻覺與越獄等,並呈現相關進展、挑戰及跨實驗室合作的價值。
來源:OpenAI News · openai.com