引用本概念的论文(3)
- 扩散引导的不确定性感知延迟策略优化 Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization arXiv 2607.05064
- 基于分层混合物理信息深度强化学习的异构多机器人系统高精度编队控制 High-Precision Formation Control for Heterogeneous Multi-Robot Systems via Hierarchical Hybrid Physics-Informed Deep Reinforcement Learning arXiv 2607.03512
- 面向交互式游戏的可指导智能体 Coachable agents for interactive gameplay arXiv 2607.00642