跳到正文
北京时间
原文
Hugging Face:Blog(RSS)·· 2022-05-20精选AI 评分60

Hugging Face 深度强化学习课程 Unit 2 第二部分:Q-Learning 原理与从零实现

An Introduction to Q-Learning Part 2/2

AI 导读

Hugging Face 深度强化学习课程发布 Unit 2 第二部分,讲解 Q-Learning 算法、Q-Function 与 Q-Table,以及 Epsilon Greedy 策略和 TD 更新,并区分 off-policy 与 on-policy。

推荐理由

课程官方教程用迷宫示例逐步拆解 Q-Learning 算法和 Q 表更新,读者可跟着 Colab 从零实现第一个 RL 智能体。

来源:Hugging Face:Blog(RSS) · huggingface.co