Junwei (Jaden) Liao
jwliao dot ai at {gmail dot com, sjtu dot edu dot cn}

I am a 2nd-year PhD student at Shanghai Jiao Tong University under the supervision of Weinan Zhang. I work very closely with Muning Wen. I received my B.E. in Artificial Intelligence from Xi'an Jiaotong University and was a visiting student at University of California, Berkeley in Fall 2023.

I am interested in Multi-Agent Reinforcement Fine-Tuning, Reinforcement Learning, Large Decision Models, specifically LLM-based Agents and unleashing the full potential of Agents through RL and other advanced techniques.

Email  /  Google Scholar  /  GitHub

profile photo
Education
Publications

MARFT: Multi-Agent Reinforcement Fine-Tuning
Junwei Liao, Muning Wen, Jun Wang, Weinan Zhang
The Eighth International Conference on Distributed Artificial Intelligence (DAI), 2026 (Oral)
arXiv / code

Position: Agentic AI Is a Foreseeable Pathway to AGI
Junwei Liao, Shuai Li, Muning Wen, Jun Wang, Weinan Zhang
The Forty-Third International Conference on Machine Learning (ICML), 2026, Position Paper
OpenReview / BibTeX

Robust Function-Calling for On-Device Language Model via Function Masking
Qiqiang Lin*, Muning Wen*, Qiuying Peng*, Guanyu Nie, Junwei Liao, Jun Wang, Xiaoyun Mo, Jiamu Zhou, Cheng Cheng, Yin Zhao, Jun Wang, Weinan Zhang
The Thirteenth International Conference on Learning Representations (ICLR), 2025 (Spotlight)
OpenReview / arXiv / code / html / dataset and models / BibTeX

Preprints

MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs
Junwei Liao*, Haoting Shi*, Ruiwen Zhou, Jiaqian Wang, Shengtao Zhang, Wei Zhang, Ying Wen, Zhiyu Li, Feiyu Xiong, Bo Tang, Weinan Zhang, Muning Wen
arXiv, 2026
arXiv / code / BibTeX

MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory
Shengtao Zhang*, Jiaqian Wang*, Ruiwen Zhou, Junwei Liao, Yuchen Feng, Weinan Zhang, Ying Wen, Zhiyu Li, Feiyu Xiong, Yutao Qi, Bo Tang, Muning Wen
arXiv / code / BibTeX

A Survey of AI Agent Protocols
Yingxuan Yang, Huacan Chai, Yuanyi Song, Siyuan Qi, Muning Wen, Ning Li, Junwei Liao, Haoyi Hu, Jianghao Lin, Gaowei Chang, Weiwen Liu, Ying Wen, Yong Yu, Weinan Zhang
arXiv / code / BibTeX

Agentic IR: Agentic Information Retrieval
Weinan Zhang, Junwei Liao, Ning Li, Kounianhua Du, Jianghao Lin
arXiv / html / BibTeX

Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
Muning Wen*, Junwei Liao*, Cheng Deng, Jun Wang, Weinan Zhang, Ying Wen
arXiv / code / html / BibTeX

Intern Experience

MemTensor

Shanghai, China

Research Intern

May 2026 - Present

Research focus

Lead RL post-training for foundation models toward general abilities, including mobile use and computer use.

OPPO

Shanghai, China

Research Intern

Jun - Aug 2024
Mar - Sep 2025

Research focus

Focus on LLM Agents, Multi-Agent Systems, and Reinforcement Learning.

SJTU

Shanghai, China

Research Assistant

May 2024 - Sep 2025

Advised by Weinan Zhang

Research focus

Focus on Multi-Agent Reinforcement Fine-Tuning, Deep Reinforcement Learning, Large Decision/Action Models, and Agent Technology.

Tsinghua University

Beijing, China

Research Assistant Intern

Sep 2023 - Mar 2024

Advised by Ju Ren

Research focus

Focus on Deep Reinforcement Learning and RLHF/RLAIF.


Last Updated: Sep. 20, 2026

This guy makes a nice webpage.