Research Profile

AI researcher and engineer working across MLLM Understanding and Diffusion Models, 3D Representation and Agentic World Generation, and Adaptive Reasoning and Self-Improving Agents. My work connects controllable media synthesis, editable 3D worlds, and feedback-driven decision making.

Education

Jan 2024 - Present (Expected completion: mid-2027)

Ph.D. Candidature in Engineering

Australian National University, Australia.

Research in multimodal generative AI, 3D world models, and adaptive agent systems.

Supervisors: Prof. Daoyi Dong, Dr. Dong Gong, and Prof. Yuerui Lu.

Sep 2014 - Jun 2017

Master in Optical Engineering

Nanjing University, China.

Sep 2010 - Jun 2014

Bachelor in Information Engineering

Nanjing University, China.

Research Internships

Jul 2025 - Jun 2026

Vertex Lab, V2FUN 3D Startup

Shanghai, China (remote). Research on 3D foundation models and image-to-3D generation, including compact 3D mesh tokenization and reconstruction.

Jul 2024 - Jun 2025

Tencent XR Vision Lab and LightSpeed Studio

Canberra, Australia. Research on controllable text-to-image generation, instance control, and attention modulation.

Employment History

Aug 2022 - Jun 2026

Part-time Research Engineer

University of New South Wales (UNSW), Australia.

Generative AI, 3D world models, and AI for scientific systems.

Mar 2020 - Jul 2022

Senior Algorithm Engineer

Damo Academy, Alibaba Group, China.

Machine Learning on Computer Vision.

Aug 2018 - Mar 2020

Algorithm Engineer

Tuya Information Technology Co., Ltd, China.

Machine learning on Image/Video Compression.