阅读时间约 2 分钟

HuggingFace_深度强化学习

Hugging Face Deep RL Course 学习索引

Posted by LuckyE on June 26, 2025
强化学习 HuggingFace

HuggingFace_深度强化学习

Welcome to the 🤗 Deep Reinforcement Learning Course - Hugging Face Deep RL Course

https://github.com/huggingface/deep-rl-class

第 1 单元—深度强化学习简介

奖励—单元1.HUGGY 深度强化学习简介

第2单元—对Q-Learning的介绍

第3单元—用雅达利游戏进行深度Q学习

奖励—单元 2.使用 Optuna 自动调整超参数

第4单元—使用PyTorch的策略梯度

第5单元—UNITY 多智能体

第6单元—多机器人环境中的AC

第7单元—对多智能体MARL的介绍&&AI vs AI

第8单元—PART 1—Proximal Policy Optimization (PPO)

第8单元—PART 2—Proximal Policy Optimization (PPO) With Doom

奖励—单元 3.RL中的高级话题



Testimonials

What readers say

先看读者反馈,再直接在当前页面继续讨论。公共留言需要 Waline 服务端;配置后访客只填昵称即可发布。

这类长文如果结构清楚,我会一路读到底。这里最好的地方是把概念、公式和代码示例放在同一篇里。

L
Lin 算法读者

数据库和工程文档的风格很实用,截图、SQL 和说明都能直接拿去复盘项目。

M
Mia 工程笔记党

强化学习相关文章密度很高,但排版如果更清楚,回看体验会更好。这个新版方向是对的。

R
Ryo 深夜学习者

我更喜欢能快速扫到标签、修改时间和文章重点的首页,现在这种卡片视图会比纯列表更容易选读。

C
Chen 知识整理控

代码块只要语言标识和层级做好,技术博客的专业感会立刻上来。

A
Ava 前端同行

评论区不用社交账号强绑定会更愿意留言,尤其是这种偏学习记录的网站。

N
Noah 匿名访客

Quick Identity

Pick a preset and leave a note

留言方式:先选择一个预设身份,再在下方输入评论。当前若显示“需要配置 Waline”,说明站点还缺少可写评论后端。

当前未选择预设身份

Live Discussion Waline 配置完成后,真实评论会加载在下方,移动端和主题切换会同步处理。
WALINE
Loading comments…