引用本概念的论文(2)
- RoAd-RL:面向鲁棒对抗强化学习的统一库与基准 RoAd-RL: A Unified Library and Benchmark for Robust Adversarial Reinforcement Learning arXiv 2606.29867
- 当潜在智能体说谎:多智能体LLM协作中的KV-Cache完整性 When Latent Agents Lie: KV-Cache Integrity in Multi-Agent LLM Collaboration arXiv 2606.28958