Publications
RAGEN-2: Reasoning Collapse in Agentic RL
Zihan Wang†*, Chi Gui†, Xing Jin†, Qineng Wang†,
Licheng Liu†, Kangrui Wang, Shiqi Chen, Linjie Li, Zhengyuan Yang, Pingyue Zhang,
Yiping Lu, Jiajun Wu, Li Fei-Fei, Lijuan Wang, Yejin Choi, Manling Li
ICML 2026
Oral
top 0.7% of 23,918
BibTeX
@inproceedings{ragen2,
title={RAGEN-2: Reasoning Collapse in Agentic RL},
author={Zihan Wang and Chi Gui and Xing Jin and Qineng Wang and Licheng Liu and
Kangrui Wang and Shiqi Chen and Linjie Li and Zhengyuan Yang and Pingyue Zhang and
Yiping Lu and Jiajun Wu and Li Fei-Fei and Lijuan Wang and Yejin Choi and Manling Li},
booktitle={Forty-Third International Conference on Machine Learning (ICML)},
year={2026},
note={Oral, top 0.7% of 23,918}
}
† Core contributors. * Project lead.
Online Prediction with Limited Selectivity
Licheng Liu, Mingda Qiao
NeurIPS 2025
Spotlight
top 3.2% of 21,575
BibTeX
@inproceedings{PLS,
title={Online Prediction with Limited Selectivity},
author={Licheng Liu and Mingda Qiao},
booktitle={Thirty-Ninth Annual Conference on Neural Information Processing Systems (NeurIPS)},
year={2025},
note={Spotlight, top 3.2% of 21,575}
}
Let's Try Again: Eliciting Multi-Turn Reasoning in Language Models via Simplistic Feedback
Licheng Liu, Zihan Wang, Linjie Li, Chenwei Xu, Yiping Lu, Han Liu, Avirup Sil, Manling Li
AI4Math@ICML 2025
multi-turn RL from minimal feedback
BibTeX
@misc{ufo,
title={Let's Try Again: Eliciting Multi-Turn Reasoning in Language Models via Simplistic Feedback},
author={Licheng Liu and Zihan Wang and Linjie Li and Chenwei Xu and Yiping Lu and
Han Liu and Avirup Sil and Manling Li},
year={2025},
eprint={2507.14295},
archivePrefix={arXiv},
primaryClass={cs.LG}
}
CocoaBench: An Evaluation Framework for General Agents with Compositional Cognitive Abilities
CocoaBench Team, Shibo Hao, Zhining Zhang, Zhiqi Liang, Tianyang Liu, Yuheng Zha, Qiyue Gao, Jixuan Chen,
Zilong Wang, Zhoujun Cheng, Haoxiang Zhang, Junli Wang, Hexi Jin, Boyuan Zheng, Kun Zhou, Yu Wang, Feng Yao,
Licheng Liu, Yijiang Li, Zhifei Li, Zhengtao Han, Pracha Promthaw, Tommaso Cerruti, Xiaohan Fu,
Ziqiao Ma, Jingbo Shang, Lianhui Qin, Julian McAuley, Eric P. Xing, Zhengzhong Liu, Rupesh Kumar Srivastava,
Zhiting Hu
Preprint
benchmark for general agents
RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning
Zihan Wang, Kangrui Wang, Qineng Wang, Pingyue Zhang, Linjie Li, Zhengyuan Yang, Xing Jin, Kefan Yu,
Minh Nhat Nguyen, Licheng Liu, Eli Gottlieb, Yiping Lu, Kyunghyun Cho, Jiajun Wu, Li Fei-Fei,
Lijuan Wang, Yejin Choi, Manling Li
Preprint
multi-turn RL training framework