引用本概念的论文(2)
- 通过拉格朗日奖励增强实现安全的推理时对齐 Safe Inference-Time Alignment via Lagrangian Reward Augmentation arXiv 2607.02781
- 鲁棒的峰值成本约束强化学习 Robust Peak-cost Constrained Reinforcement Learning arXiv 2607.15457
slug: lagrangian-duality
在引用本概念的论文中,与下列概念同时出现的次数(降序)。