引用本概念的论文(3)
- 鲁棒的峰值成本约束强化学习 Robust Peak-cost Constrained Reinforcement Learning arXiv 2607.15457
- 安全强化学习中用于高效探索的方向性约束 Directional Constraints for Efficient Exploration in Safe Reinforcement Learning arXiv 2607.12784
- 通过平滑安全结构化策略组合实现安全在线学习 Safe Online Learning via Smooth Safety-Structured Policy Composition arXiv 2606.31320