跳到正文
原文
Hugging Face Blog·· 2022-05-18AI 評分49

Q-Learning 入門(第一部分)

An Introduction to Q-Learning Part 1

AI 導讀

Hugging Face 深度強化學習課程第 2 單元第 1 部分講解價值型強化學習方法,為 Q-Learning 作鋪墊。內容説明狀態價值函數與動作價值函數,並比較蒙地卡羅學習和時間差分學習。本單元第二部分將介紹 Q-Learning 演算法,從零實作智能體,並在 Frozen-Lake-v1 及自動的士環境中訓練。

來源:Hugging Face Blog · huggingface.co