引用本概念的论文(2)
- 关于偏好对齐生成中引导向量局限性的研究 On the Limits of Steering Vectors for Preference-Aligned Generation arXiv 2607.01802
- CoRe:结合视觉-语言模型反馈的组合奖励用于偏好对齐的强化学习 CoRe: Combined Rewards with Vision-Language Model Feedback for Preference-Aligned Reinforcement Learning arXiv 2607.01721