论文

张蒲石的论文:具身智能、视觉-语言-动作模型与强化学习。

* 同等贡献。完整列表也可在 Google Scholar 查看。

2026

  1. Report
    Wall-OSS-0.5 Technical Report
    Ryan Yu, Pushi Zhang, Starrick Liu, et al. 等 Ryan Yu, Pushi Zhang, Starrick Liu, Brae Liu, Miracle Kang, Shalfun Li, Lights Shi, Ellie Ma, Ping Yang, Chris Pan, Jerry Chen, Dongxiu Liu, Rain Sun, Miles Guo, Byron Zhang, Hugo Zhou, Zach Xu, Vincent Chen, Harrison Huang, James Wang, Dance Kuzi, Andy Zhai, Hang Su, Roy Gan, Lucy Liang, Hao Wang, and Qian Wang
    Technical report, arXiv:2605.30877, 2026
  2. Preprint
    X-Tokenizer: A Multimodal Action Tokenizer for Vision-Language-Action Pretraining
    Miracle Kang*, Lights Shi*, Lucy Liang, …, Pushi Zhang, et al. 等 Miracle Kang*, Lights Shi*, Lucy Liang, Roy Gan, Dongxiu Liu, Pushi Zhang, Sylas Chen, Shawn Qin, Yinan Zheng, Jinliang Zheng, Hao Wang, Xianyuan Zhan, and Hang Su
    Preprint, arXiv:2606.14752, 2026
  3. Report
    WALL-WM: Carving World Action Modeling at the Event Joints
    Shalfun Li, Victor Yao, Charles Yang, …, Pushi Zhang, et al. 等 Shalfun Li, Victor Yao, Charles Yang, Truth Qu, Regis Cheng, Ryan Yu, Howard Lu, Newton Von, Vincent Chen, Yohann Tang, Maeve Zhang, Ellie Ma, Gody Li, Starrick Liu, Sage Yang, Lorien Shu, J. W. Gao, Ethan Chen, Colin Ye, Yu Sun, Elise Mon, Pushi Zhang, Neo Li, Lily Li, James Wang, Ping Yang, Chris Pan, Lucy Liang, Hang Su, Roy Gan, Hao Wang, and Qian Wang
    Technical report, arXiv:2606.01955, 2026
    Early version at ECCV 2026 Workshop (STEAI), Oral
  4. Report
    WALL-SS: Scaling Long-horizon World Models via Next-Scale Autoregression
    Maeve Zhang, Rain Sun, Xiang Wang, …, Pushi Zhang, et al. 等 Maeve Zhang, Rain Sun, Xiang Wang, Cyril Zhang, Shalfun Li, Meng Cao, Howard Lu, Ethan Chen, Harry Jhou, KZ Zheng, Lights Shi, Regis Cheng, Lorenzin, Robert Wang, Victor Yao, Gody Li, Elise Mon, Yohann Tang, Ryan Yu, Pushi Zhang, Vincent Chen, Hang Su, Roy Gan, Hao Wang, and Qian Wang
    Technical report, arXiv:2608.26239, 2026
  5. ICLR
    villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models
    Xiaoyu Chen*, Hangxing Wei*, Pushi Zhang*, et al. 等 Xiaoyu Chen*, Hangxing Wei*, Pushi Zhang*, Chuheng Zhang*, Kaixin Wang*, Yanjiang Guo, Rushuai Yang, Yucen Wang, Xinquan Xiao, Li Zhao*, Jianyu Chen, and Jiang Bian
    In International Conference on Learning Representations (ICLR), 2026

2025

  1. NeurIPS
    What Do Latent Action Models Actually Learn?
    Chuheng Zhang*, Tim Pearce*, Pushi Zhang, Kaixin Wang, Xiaoyu Chen, Wei Shen, Li Zhao, and Jiang Bian
    In Advances in Neural Information Processing Systems (NeurIPS), 2025
  2. Preprint
    PIG-Nav: Key Insights for Pretrained Image Goal Navigation Models
    Jiansong Wan, Chengming Zhou, Jinkua Liu, …, Pushi Zhang, et al. 等 Jiansong Wan, Chengming Zhou, Jinkua Liu, Xiangge Huang, Xiaoyu Chen, Xiaohan Yi, Qisen Yang, Baiting Zhu, Xin-Qiang Cai, Lixing Liu, Rushuai Yang, Chuheng Zhang, Sherif Abdelfattah, Hayong Shin, Pushi Zhang, Li Zhao, and Jiang Bian
    Preprint, arXiv:2507.17220, 2025
  3. Preprint
    UC-MOA: Utility-Conditioned Multi-Objective Alignment for Distributional Pareto-Optimality
    Zelei Cheng*, Xin-Qiang Cai*, Yuting Tang, Pushi Zhang, Boming Yang, Masashi Sugiyama, and Xinyu Xing
    Preprint, arXiv:2503.10669, 2025

2024

  1. Preprint
    IGOR: Image-GOal Representations are the Atomic Control Units for Foundation Models in Embodied AI
    Xiaoyu Chen*, Junliang Guo*, Tianyu He*, Chuheng Zhang*, Pushi Zhang, Derek Cathera Yang, Li Zhao*, and Jiang Bian
    Preprint, arXiv:2411.00785, 2024

2023

  1. NeurIPS
    Distributional Pareto-Optimal Multi-Objective Reinforcement Learning
    Xin-Qiang Cai*, Pushi Zhang*, Li Zhao, Jiang Bian, Masashi Sugiyama, and Ashley J. Llorens
    In Advances in Neural Information Processing Systems (NeurIPS), 2023
  2. NeurIPS-W
    IG-Net: Image-Goal Network for Offline Visual Navigation on A Large-Scale Game Map
    Pushi Zhang*, Baiting Zhu*, Xin-Qiang Cai*, Li Zhao, Masashi Sugiyama, and Jiang Bian
    In NeurIPS 2023 Workshop on Robot Learning, 2023
  3. CoG
    Preference-conditioned Pixel-based AI Agent For Game Testing
    Sherif Abdelfattah, Adrian Brown, and Pushi Zhang
    In IEEE Conference on Games (CoG), 2023
  4. Preprint
    Asking Before Acting: Gather Information in Embodied Decision Making with Language Models
    Xiaoyu Chen, Shenao Zhang, Pushi Zhang, Li Zhao, and Jianyu Chen
    Preprint, arXiv:2305.15695, 2023

2022

  1. NeurIPS
    An Adaptive Deep RL Method for Non-Stationary Environments with Piecewise Stable Context
    Xiaoyu Chen*, Xiangming Zhu*, Yufeng Zheng, Pushi Zhang, et al. 等 Xiaoyu Chen*, Xiangming Zhu*, Yufeng Zheng, Pushi Zhang, Li Zhao, Wenxue Cheng, Peng Cheng, Yongqiang Xiong, Tao Qin, Jianyu Chen, and Tie-Yan Liu
    In Advances in Neural Information Processing Systems (NeurIPS), 2022

2021

  1. NeurIPS
    Distributional Reinforcement Learning for Multi-Dimensional Reward Functions
    Pushi Zhang*, Xiaoyu Chen*, Li Zhao, Wei Xiong, Tao Qin, and Tie-Yan Liu
    In Advances in Neural Information Processing Systems (NeurIPS), 2021
  2. IJCAI
    Independence-aware Advantage Estimation
    Pushi Zhang, Li Zhao, Guoqing Liu, Jiang Bian, Minlie Huang, Tao Qin, and Tie-Yan Liu
    In Proceedings of the Thirtieth International Joint Conference on Artificial Intelligence (IJCAI), 2021
  3. Neurocomp.
    Demonstration Actor Critic
    Guoqing Liu, Li Zhao, Pushi Zhang, Jiang Bian, Tao Qin, Nenghai Yu, and Tie-Yan Liu
    Neurocomputing, 2021