← 返回概念图谱 引用本概念的论文(7)
- VLM-AR3L:强化学习中用于绝对奖励与相对奖励的视觉-语言模型 VLM-AR3L: Vision-Language Models for Absolute and Relative Rewards in Reinforcement Learning arXiv 2607.00483
- 利用视觉语言模型引导实现基于势能的奖励塑造自动化 Automating Potential-based Reward Shaping with Vision Language Model Guidance arXiv 2606.27180
- 超越静态评估:为可扩展的智能体强化学习构建仿真环境 Beyond Static Evaluation: Building Simulation Environments for Scalable Agentic Reinforcement Learning arXiv 2607.05773
- TRACE:基于信用估计的回合级奖励分配用于长程智能体 TRACE: Turn-level Reward Assignment via Credit Estimation for Long-Horizon Agents arXiv 2607.13988
- CRRL:一种基于因果关系的强化学习框架,用于自主系统恢复 CRRL: A Causality-Based Reinforcement Learning Framework for Autonomous System Recovery arXiv 2607.03177
- HyPOLE:超属性引导的部分可观测多智能体强化学习 HyPOLE: Hyperproperty-Guided Multi-Agent Reinforcement Learning under Partial Observation arXiv 2606.30966
- 星际争霸微操中基于影响力图与聚类脚本的分层强化学习 Hierarchical Reinforcement Learning in StarCraft Micromanagement with Influence Maps and Cluster-based Scripts arXiv 2606.30092
共现相关概念
在引用本概念的论文中,与下列概念同时出现的次数(降序)。