引用本概念的论文(2)
- Robo-ValueRL:面向离在线强化学习的可靠价值估计 Robo-ValueRL: Reliable Value Estimation for Offline-to-Online Reinforcement Learning arXiv 2607.09866
- CoDiMAD:基于扩散模型的无通信多机器人协调特权蒸馏 CoDiMAD: Diffusion-Based Privileged Distillation for Communication-Free Multi-Robot Coordination arXiv 2607.09587