引用本概念的论文(2)
- 利用视觉语言模型引导实现基于势能的奖励塑造自动化 Automating Potential-based Reward Shaping with Vision Language Model Guidance arXiv 2606.27180
- 基于体制条件的大语言模型增强型合作多智能体强化学习的稳定化方法 Regime-Conditional Stabilisation of LLM-Augmented Cooperative Multi-Agent Reinforcement Learning arXiv 2607.04470