How can physical agents keep improving reliably on real robots?
Evaluation, post-training, and stable RL for continual improvement on hardware.
-
R. Yang, Z. Han, H. Li, H. Wang, Z. Wu, R. Zhang, Z. Zhang, Z. Chen, X. Yan, C. Liu, Y. Chen, W. Shan, M. Yao
-
R. Yang, H. Wang, C. Liu, X. Yan, Y. Wang, X. Du, S. Yue, Y. Liu, C. Zhang, et al.