CV
Biography
My research focuses on Real2Sim and Sim2Real for embodied agents.
In Real2Sim, I aim to leverage spatial intelligence models with affordable sensing systems to address generalizable human and scene understanding, enabling the acquisition of high-quality, simulation-ready data without tele-operation.
In Sim2Real, I am interested in developing behavior foundation models for robust motor control, while using world models for long-horizon planning and environment modeling, toward more general intelligence for humanoid robots.
Education
- Ph.D. in Computer Science2023-01 - 2026-09 (expected)The University of Hong Kong, Hong Kong SAR, China
- M.E. in Mechanical Engineering2016-09 - 2019-05Tongji University, Shanghai, China
- B.E. in Aircraft Design2012-09 - 2016-06Nanjing University of Aeronautics and Astronautics, Nanjing, China
Work Experience
- Research Intern2026-02 - PresentNoitom Robotics, Shenzhen, China
- Research Intern2025-06 - 2026-01Seele AI, Shenzhen, China
- Research Intern2022-09 - 2023-07Shanghai AI Laboratory, Shanghai, China
- Senior Algorithm Researcher2022-03 - 2022-08Tencent Technology, Shanghai, China
- Algorithm Researcher2021-03 - 2022-03SenseTime, Shenzhen, China
- Research Intern2019-09 - 2021-02SenseTime, Beijing / Shenzhen, China
- Intern2019-05 - 2019-09Beijing Xianjian Technology, Beijing, China
Publications
- EmbodMocap: In-the-Wild 4D Human-Scene Reconstruction for Embodied Agents2026CVPRWenjia Wang#, Liang Pan#, Huaijin Pi, Yuke Lou, Xuqian Ren, Yifan Wu, Zhouyingcheng Liao, Lei Yang, Rishabh Dabral, Christian Theobalt, Taku Komura✉.
- SIMS: Simulating Stylized Human-Scene Interactions with Retrieval-Augmented Script Generation2025ICCVWenjia Wang, Liang Pan, Zhiyang Dou, Jidong Mei, Zhouyingcheng Liao, Yuke Lou, Yifan Wu, Lei Yang, Jingbo Wang†, Taku Komura†.
- TokenHSI: Unified Synthesis of Physical Human-Scene Interactions through Task Tokenization2025CVPR OralLiang Pan, Zeshi Yang, Zhiyang Dou, Wenjia Wang, Buzhen Huang, Bo Dai, Taku Komura, Jingbo Wang✉.
- 3D Human Reconstruction in the Wild with Synthetic Data Using Generative Models2025TPAMIYongtao Ge, Wenjia Wang, Yongfan Chen, Fanzhou Wang, Lei Yang, Hao Chen, Chunhua Shen.
- EMDM: Efficient Motion Diffusion Model for Fast, High-Quality Human Motion Generation2024ECCVWenyang Zhou, Zhiyang Dou†, Zeyu Cao, Zhouyingcheng Liao, Jingbo Wang, Wenjia Wang, Yuan Liu, Taku Komura, Wenping Wang, Lingjie Liu.
- AiOS: All-in-One-Stage Expressive Human Pose and Shape Estimation2024CVPRQingping Sun, Yanjun Wang, Ailing Zeng, Wanqi Yin, Chen Wei, Wenjia Wang, Haiyi Mei, Chi Sing Leung, Ziwei Liu, Lei Yang, Zhongang Cai.
- Zolly: Zoom Focal Length Correctly for Perspective-Distorted Human Mesh Reconstruction2023ICCV OralWenjia Wang, Yongtao Ge, Haiyi Mei, Zhongang Cai, Qingping Sun, Yanjun Wang, Chunhua Shen, Lei Yang✉, Taku Komura.
- HuMMan: Multi-Modal 4D Human Dataset for Versatile Sensing and Modeling2022ECCV OralZhongang Cai*, Daxuan Ren*, Ailing Zeng*, Zhengyu Lin*, Tao Yu*, Wenjia Wang*, Xiangyu Fan, Yang Gao, Yifan Yu, Liang Pan, Fangzhou Hong, Mingyuan Zhang, Chen Change Loy, Lei Yang✉, Ziwei Liu✉.
- Scene Text Image Super-Resolution in the Wild2020ECCVWenjia Wang, Enze Xie, Xuebo Liu, Wenhai Wang, Ding Liang, Chunhua Shen, Xiang Bai.
Academic Service
Conference Reviewer: TIP 2022, ICLR 2023, ICCV 2023, ICLR 2024, ACCV 2024, SIGGRAPH Asia 2024, 3DV 2025, ICLR 2025, CVPR 2026, SIGGRAPH 2026, ECCV 2026
Journal Reviewer: TIP 2022