Hugging Face Blog·· 2022-05-18AI 评分49
Q-Learning 入门(第一部分):Hugging Face 深度强化学习课程 Unit 2
An Introduction to Q-Learning Part 1
AI 导读
Hugging Face 深度强化学习课程 Unit 2 第一部分讲解基于价值的方法,涵盖 State-Value 函数、Action-Value 函数、Bellman 方程,以及 Monte Carlo 与 Temporal Difference Learning 的区别。
来源:Hugging Face Blog · huggingface.co