UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing.
Xinming Wei,
Chao Jin,
Tuo Dai,
Yinmin Zhong,
Shan Yu,
Chengxu Yang,
Bingyang Wu,
Zili Zhang,
Jing Mai,
Qianchao Zhu,
Zhouyang Li,
Yuliang Liu,
Guojie Luo
In Preprint.
Optimizing RLHF Training for Large Language Models with Stage Fusion.
Yinmin Zhong,
Zili Zhang,
Bingyang Wu,
Shengyu Liu,
Yukun Chen,
Changyi Wan,
Hanpeng Hu,
Lei Xia,
Ranchen Ming,
Yibo Zhu,
Xin Jin
In NSDI 2025.
StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation.
Yinmin Zhong,
Zili Zhang,
Xiaoniu Song,
Hanpeng Hu,
Chao Jin,
Bingyang Wu,
Nuo Chen,
Yukun Chen,
Yu Zhou,
Changyi Wan,
Hongyu Zhou,
Yimin Jiang,
Yibo Zhu,
Daxin Jiang
In Preprint.
A Survey of Resource-efficient LLM and Multimodal Foundation Models.
Mengwei Xu,
Wangsong Yin,
Dongqi Cai,
Rongjie Yi,
Daliang Xu,
Qipeng Wang,
Bingyang Wu,
Yihao Zhao,
Chen Yang,
Shihe Wang,
Qiyang Zhang,
Zhenyan Lu,
Li Zhang,
Shangguang Wang,
Yuanchun Li,
Yunxin Liu,
Xin Jin,
Xuanzhe Liu
In Preprint.
XRON: A Hybrid Elastic Cloud Overlay Network for Video Conferencing at Planetary Scale.
Bingyang Wu,
Kun Qian,
Bo Li,
Yunfei Ma,
Qi Zhang,
Zhigang Jiang,
Jiayu Zhao,
Dennis Cai,
Ennan Zhai,
Xuanzhe Liu,
Xin Jin
In SIGCOMM 2023.