The Efficiency vs. Accuracy Trade-off: Optimizing RAG-Enhanced LLM Recommender Systems Using Multi-Head Early Exit
- Huixue Zhou
- , Hengrui Gu
- , Zaifu Zhan
- , Xi Liu
- , Kaixiong Zhou
- , Mingfu Liang
- , Yongkang Xiao
- , Srinivas Govindan
- , Piyush Chawla
- , Jiyan Yang
- , Xiangfei Meng
- , Huayu Li
- , Buyun Zhang
- , Liang Luo
- , Wen Yen Chen
- , Yiping Han
- , Bo Long
- , Rui Zhang
- , Tianlong Chen
Research output: Chapter in Book/Report/Conference proceeding › Conference contribution
6
Link opens in a new tab
Scopus
citations