引用本概念的论文(2)
- 基于深度强化学习的大气再入航天器姿态控制 Deep Reinforcement Learning for Spacecraft Attitude Control During Atmospheric Re-Entry arXiv 2606.31291
- 基于数据高效无监督强化学习的可泛化技能策略学习 Learning Generalizable Skill Policy with Data-Efficient Unsupervised RL arXiv 2607.00392