引用本概念的论文(1) 通过心理学奠基的推理与角色感知策略优化改进通用角色扮演智能体 Improving General Role-Playing Agents via Psychology-Grounded Reasoning and Role-Aware Policy Optimization arXiv 2606.27025
共现相关概念 在引用本概念的论文中,与下列概念同时出现的次数(降序)。 Chain-of-Thought Reasoning method · 共现 1 Character Fidelity metric · 共现 1 Policy Optimization method · 共现 1 Reinforcement Learning method · 共现 1 Reward Hacking problem · 共现 1 Role-Playing Agents problem · 共现 1