OpenAI News·· 2018-10-22AI 評分49
迭代放大:OpenAI 提出的複雜目標學習方法
Learning complex goals with iterated amplification
AI 導讀
OpenAI 提出迭代放大這項 AI 安全技術,用來指定超出人類規模的複雜行為與目標。方法是示範如何把任務拆解為較簡單的子任務,而非提供標註資料或獎勵函數。這項構想仍處於非常早期階段,目前只在簡單的玩具演算法領域完成實驗;OpenAI 認為它可能成為可擴展的 AI 安全方法。
來源:OpenAI News · openai.com