HuggingFace_深度强化学习 Welcome to the 🤗 Deep Reinforcement Learning Course - Hugging Face Deep RL Course https://github.com/huggingface/deep-rl-class 第 1 单元—深度强化学习简介 奖励—单元1.HUGGY 深度强化学习简介 第2单元—对Q-Learning的介绍 第3单元—用雅达利游戏进行深度Q学习 奖励—单元 2.使用 Optuna 自动调整超参数 第4单元—使用PyTorch的策略梯度 第5单元—UNITY 多智能体 第6单元—多机器人环境中的AC 第7单元—对多智能体MARL的介绍&&AI vs AI 第8单元—PART 1—Proximal Policy Optimization (PPO) 第8单元—PART 2—Proximal Policy Optimization (PPO) With Doom 奖励—单元 3.RL中的高级话题 Previous 深度强化学习10篇经典文章 Next NumPy Testimonials What readers say 先看读者反馈,再直接在当前页面继续讨论。公共留言需要 Waline 服务端;配置后访客只填昵称即可发布。 这类长文如果结构清楚,我会一路读到底。这里最好的地方是把概念、公式和代码示例放在同一篇里。 L Lin 算法读者 数据库和工程文档的风格很实用,截图、SQL 和说明都能直接拿去复盘项目。 M Mia 工程笔记党 强化学习相关文章密度很高,但排版如果更清楚,回看体验会更好。这个新版方向是对的。 R Ryo 深夜学习者 我更喜欢能快速扫到标签、修改时间和文章重点的首页,现在这种卡片视图会比纯列表更容易选读。 C Chen 知识整理控 代码块只要语言标识和层级做好,技术博客的专业感会立刻上来。 A Ava 前端同行 评论区不用社交账号强绑定会更愿意留言,尤其是这种偏学习记录的网站。 N Noah 匿名访客 Quick Identity Pick a preset and leave a note 留言方式:先选择一个预设身份,再在下方输入评论。当前若显示“需要配置 Waline”,说明站点还缺少可写评论后端。 Current Thread HuggingFace_深度强化学习 算法读者 工程笔记党 深夜学习者 当前未选择预设身份 Live Discussion Waline 配置完成后,真实评论会加载在下方,移动端和主题切换会同步处理。 WALINE Jun 26, 2025 Loading comments… Please enable JavaScript to view and submit comments. CATALOG FEATURED TAGS 25 posts Java 10 强化学习 7 Python 3 PPO 2 GRPO 1 HuggingFace 1 Jekyll 1 Matplotlib 1
What readers say
先看读者反馈,再直接在当前页面继续讨论。公共留言需要 Waline 服务端;配置后访客只填昵称即可发布。
这类长文如果结构清楚,我会一路读到底。这里最好的地方是把概念、公式和代码示例放在同一篇里。
数据库和工程文档的风格很实用,截图、SQL 和说明都能直接拿去复盘项目。
强化学习相关文章密度很高,但排版如果更清楚,回看体验会更好。这个新版方向是对的。
我更喜欢能快速扫到标签、修改时间和文章重点的首页,现在这种卡片视图会比纯列表更容易选读。
代码块只要语言标识和层级做好,技术博客的专业感会立刻上来。
评论区不用社交账号强绑定会更愿意留言,尤其是这种偏学习记录的网站。
Quick Identity
Pick a preset and leave a note
留言方式:先选择一个预设身份,再在下方输入评论。当前若显示“需要配置 Waline”,说明站点还缺少可写评论后端。
当前未选择预设身份