跳到正文
原文
Hugging Face Blog·· 2022-05-18AI 评分23

Hugging Face 深度强化学习课程:Q-Learning 入门第一部分

An Introduction to Q-Learning Part 1

AI 导读

Hugging Face 发布深度强化学习课程第二部分,聚焦基于价值的方法与 Q-Learning。内容涵盖状态-动作值函数、Bellman 方程及蒙特卡洛与时序差分学习的区别。该教程旨在帮助初学者从零实现 Q-Learning 智能体,为后续 Deep Q-Learning 打下基础。

来源:Hugging Face Blog · huggingface.co