OpenAI 推出深度強化學習教育資源 Spinning Up in Deep RL
OpenAI 推出 Spinning Up in Deep RL,這是一套旨在讓任何人學習成為深度強化學習熟練實踐者的教育資源。內容包括清晰易明的 RL 程式碼範例、教學練習、文件及教學指南。
OpenAI 推出 Spinning Up in Deep RL,這是一套旨在讓任何人學習成為深度強化學習熟練實踐者的教育資源。內容包括清晰易明的 RL 程式碼範例、教學練習、文件及教學指南。
OpenAI 展示對抗樣本如何透過刻意設計的輸入令機器學習模型出錯,並説明其在不同媒介中的運作方式。這類輸入猶如機器的視覺錯覺;文章亦探討系統為何難以防範這類攻擊。
OpenAI 探討強化學習算法的一種失效模式:獎勵函數設定錯誤。強化學習算法可能以出人意料、違反直覺的方式失效。