引用本概念的论文(2)
- 通过心理学奠基的推理与角色感知策略优化改进通用角色扮演智能体 Improving General Role-Playing Agents via Psychology-Grounded Reasoning and Role-Aware Policy Optimization arXiv 2606.27025
- Oyster-II:面向大语言模型建设性安全对齐的强化学习方法 Oyster-II: Reinforcement Learning for Constructive Safety Alignment in Large Language Models arXiv 2607.02914