arXiv cs.AI· Shihab Ahmed, Debamita Ghosh, David Tang, Yudan Wang, Alvaro Velasquez, Yue Wang·· 10 小时前AI 评分42
Robust Nash Alignment 如何对齐不确定的偏好
Robust Nash Alignment under Preference Uncertainty
AI 摘要
Robust Nash Alignment 提出博弈论框架以对齐不确定的成对偏好,通过四玩家原始 - 对偶代理游戏和单循环乐观镜像下降上升算法实现优化。该方法在受控表格游戏及 LLM 对齐实验中验证了收敛理论,并展现出优于名义基线的性能。
来源:arXiv cs.AI · arxiv.org