汇总了本人学习 RL 过程所做的笔记,前面几篇还是古法炮制,但是越往后就越依赖 AI 辅助(比我手打 Latex 快多了),所以后续的笔记可能会有点“奇怪” 😼
笔记目录
- Value Based Methods
- Policy Based Methods 这里缺了 DPG 的部分
- Deep RL Algorithms
- Offline Reinforcement Learning
下面是多智能体部分的简单汇总
汇总了本人学习 RL 过程所做的笔记,前面几篇还是古法炮制,但是越往后就越依赖 AI 辅助(比我手打 Latex 快多了),所以后续的笔记可能会有点“奇怪” 😼
下面是多智能体部分的简单汇总