引用本概念的论文(2)
- 作为对手的世界模型:用于鲁棒运动规划的多智能体自博弈微调 World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning arXiv 2607.10630
- 通过世界模型从人类偏好与理由中学习安全的智能体行为 Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models arXiv 2607.13172