Skip to main navigation Skip to search Skip to main content

The Efficiency vs. Accuracy Trade-off: Optimizing RAG-Enhanced LLM Recommender Systems Using Multi-Head Early Exit

  • Huixue Zhou
  • , Hengrui Gu
  • , Zaifu Zhan
  • , Xi Liu
  • , Kaixiong Zhou
  • , Mingfu Liang
  • , Yongkang Xiao
  • , Srinivas Govindan
  • , Piyush Chawla
  • , Jiyan Yang
  • , Xiangfei Meng
  • , Huayu Li
  • , Buyun Zhang
  • , Liang Luo
  • , Wen Yen Chen
  • , Yiping Han
  • , Bo Long
  • , Rui Zhang
  • , Tianlong Chen

Research output: Chapter in Book/Report/Conference proceedingConference contribution

Fingerprint

Dive into the research topics of 'The Efficiency vs. Accuracy Trade-off: Optimizing RAG-Enhanced LLM Recommender Systems Using Multi-Head Early Exit'. Together they form a unique fingerprint.
Sort by

Computer Science

Keyphrases