引用本概念的论文(3)
- StarBench:面向智能体多模态决策与信息寻求的回合制 RPG 基准 StarBench: A Turn-Based RPG Benchmark for Agentic Multimodal Decision-Making and Information Seeking arXiv 2510.18483
- VLM-AR3L:强化学习中用于绝对奖励与相对奖励的视觉-语言模型 VLM-AR3L: Vision-Language Models for Absolute and Relative Rewards in Reinforcement Learning arXiv 2607.00483
- 利用视觉语言模型引导实现基于势能的奖励塑造自动化 Automating Potential-based Reward Shaping with Vision Language Model Guidance arXiv 2606.27180