大语言模型 × 推荐排序
Exploiting Large Language Models for Recommendation
共同第一作者 · 2025.07—2026.02
主导提出 R2Rank 推荐排序框架,将大语言模型的链式推理与排序目标直接对齐。 通过 Plackett–Luce 列表分布、基于 NDCG 的强化学习与 self-check SFT, 缓解位置偏差并稳定端到端训练。
- Chain-of-Thought
- Listwise Ranking
- Reinforcement Learning
- Self-check SFT