๐ About Me
Hi! I am a Ph.D. student in Tsinghua University, advised by Prof. Bowen Zhou. I received my bachelorโs degree with honors from Tsinghua University in June 2024. My research interests include LLM post-training (especially reinforcement learning), agents, and model architecture design.
๐ News
- 2026.05: ย ๐ฅ ZEDA released at arXiv [GitHub]
- 2025.09: ย ๐ฅ UPGE / HPT released at arXiv [GitHub]
- 2025.03: ย ๐ฅ SSM Survey released at arXiv
- 2024.11: ย ๐ Low-dimensional Projected Attention accepted by EMNLP 2024 [GitHub]
- 2023.12: ย ๐ Sparse LoRA accepted by EMNLP 2023 [GitHub]
- 2023.07: ย ๐ Parameter-efficient Weight Ensembling Facilitates Task-level Knowledge Transfer accepted by ACL 2023 [GitHub]
๐ Highlight Publications
(* denotes equal contribution)
- Post-Trained MoE Can Skip Half Experts via Self-Distillation
Xingtai Lv*, Li Sheng*, Kaiyan Zhang*, Yichen You, Siyan Gao, Xueheng Luo, Yuxin Zuo, Yuchen Fan, Junlin Yang, Ganqu Cui, Bingning Wang, Fan Yang, Youbang Sun, Ning Ding, Bowen Zhou
Preprint [GitHub] - Towards a Unified View of Large Language Model Post-Training
Xingtai Lv*, Yuxin Zuo*, Youbang Sun, Hongyi Liu, Yuntian Wei, Zhekai Chen, Xuekai Zhu, Kaiyan Zhang, Bingning Wang, Ning Ding, Bowen Zhou
Preprint [GitHub] - A Survey of Reinforcement Learning for Large Reasoning Models
Kaiyan Zhang*, Yuxin Zuo*, Bingxiang He*, Youbang Sun*, Runze Liu*, Che Jiang*, Yuchen Fan*, Kai Tian*, Guoli Jia*, Pengfei Li*, Yu Fu*, Xingtai Lv*, Yuchen Zhang*, Sihang Zeng*, Shang Qu*, Haozhan Li*, Shijie Wang*, Yuru Wang*, Xinwei Long, Fangfu Liu, Xiang Xu, Jiaze Ma, Xuekai Zhu, Ermo Hua, Yihao Liu, Zonglin Li, Huayu Chen, Xiaoye Qu, Yafu Li, Weize Chen, Zhenzhao Yuan, Junqi Gao, Dong Li, Zhiyuan Ma, Ganqu Cui, Zhiyuan Liu, Biqing Qi, Ning Ding, Bowen Zhou
Preprint [GitHub] - Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
Xingtai Lv*, Youbang Sun*, Kaiyan Zhang*, Shang Qu, Xuekai Zhu, Yuchen Fan, Yi Wu, Ermo Hua, Xinwei Long, Ning Ding, Bowen Zhou
Preprint - Process Reinforcement through Implicit Rewards
Ganqu Cui*, Lifan Yuan*, Zefan Wang*, Hanbin Wang*, Yuchen Zhang, Jiacheng Chen, Wendi Li*, Bingxiang He*, Yuchen Fan*, Tianyu Yu*, Qixin Xu*, Weize Chen, Jiarui Yuan, Huayu Chen, Kaiyan Zhang, Xingtai Lv, Shuo Wang, Yuan Yao, Xu Han, Hao Peng, Yu Cheng, Zhiyuan Liu, Maosong Sun, Bowen Zhou, Ning Ding
Preprint [GitHub] - Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
Xingtai Lv, Ning Ding, Kaiyan Zhang, Ermo Hua, Ganqu Cui, Bowen Zhou
EMNLP 2024 [GitHub] - Sparse Low-rank Adaptation of Pre-trained Language Models
Ning Ding*, Xingtai Lv*, Qiaosen Wang, Yulin Chen, Bowen Zhou, Zhiyuan Liu, Maosong Sun
EMNLP 2023 [GitHub] - Parameter-efficient Weight Ensembling Facilitates Task-level Knowledge Transfer
Xingtai Lv*, Ning Ding*, Yujia Qin, Zhiyuan Liu, Maosong Sun
ACL 2023 [GitHub]
๐ Educations
- 2024.09 - now, Tsinghua University Ph.D. in Electrical Engineering (THUC3I)
- 2020.09 - 2024.06, Tsinghua University B.S. in Electrical Engineering, ranked 1st/251
๐ Honors and Awards
- Outstanding Graduate Award, Tsinghua University. 2024.06
- Outstanding Graduate Award, Beijing Municipal Education Commission. 2024.06
- Outstanding Paper Award for Diploma Project, Tsinghua University. 2024.06
- National Scholarship, Ministry of Education of the Peopleโs Republic of China. 2023.12
- Comprehensive Merit Scholarship, Tsinghua University. 2023.12
- Samsung Scholarship, Samsung Electronics China. 2023.06
- Second Prize in Freshmen Scholarship, Tsinghua University. 2020.09
๐ฌ Invited Talks
- 2025 QingKeAI Carnival - Reinforcement Learning Track. QingKeAI. 2025.12
- Towards a Unified View of Large Language Model Post-Training. QingKeAI. 2025.10
๐ ๏ธ Services
- Conference Reviewer: NeurIPS (2026), ICLR (2025 - 2026), ICML (2026), ACL ARR (2023 - 2025)