跳转到内容

第十卷 · 分层、目标与元学习

让一个策略解决很多任务、或让技能可以复用,需要在时间与任务两个维度上引入结构。本卷讲分层、目标条件与元学习三条路。

  • 第一部分 · 分层与目标:选项框架与技能发现、目标条件 RL 与 HER。
  • 第二部分 · 元学习与泛化:元强化学习、泛化、过拟合与 Sim-to-Real。

第四卷。