跳到正文
原文
Hugging Face Blog·· 2022-05-18AI 评分49

Q-Learning 入门(第一部分):Hugging Face 深度强化学习课程 Unit 2

An Introduction to Q-Learning Part 1

AI 导读

Hugging Face 深度强化学习课程 Unit 2 第一部分讲解基于价值的方法,涵盖 State-Value 函数、Action-Value 函数、Bellman 方程,以及 Monte Carlo 与 Temporal Difference Learning 的区别。

来源:Hugging Face Blog · huggingface.co