Hao Tan 「谭昊」
I am a Senior Research Scientist at
Adobe Research .
I work on generative models for virtual worlds and the real world,
spanning long-context memory, 3D and video generation, and multimodal learning.
I received my Ph.D. from UNC Chapel Hill, advised by
Mohit Bansal ,
and my B.S. from Shanghai Jiao Tong University's ACM Honors Class.
Email /
CV /
Google Scholar /
GitHub /
X
Selected Publications
For a complete publication list, see
Google Scholar.
Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers
Chongjian Ge * ,
Hanwen Jiang * ,
Tianyu Wang * ,
Jiuxiang Gu ,
Yiran Xu ,
Ziwen Chen ,
Shaoteng Liu ,
Jing Shi ,
Yicong Hong ,
Zefan Cai ,
Hailin Jin ,
Hao Tan
arXiv, 2026
Hybrid KDA-MLA diffusion Transformers with sparse MoE layers and HeteroP scaling laws for efficient long-context image and video generation.
RELIC: Interactive Video World Model with Long-Horizon Memory
Yicong Hong * ,
Yiqun Mei * ,
Chongjian Ge * ,
Yiran Xu ,
Yang Zhou ,
Sai Bi ,
Yannick Hold-Geoffroy ,
Mike Roberts ,
Matthew Fisher ,
Eli Shechtman ,
Kalyan Sunkavalli ,
Feng Liu ,
Zhengqi Li ,
Hao Tan
Tech report, 2025
Real-time interactive video generation with compact, camera-aware long-horizon memory.
RayZer: A Self-Supervised Large View Synthesis Model
Hanwen Jiang ,
Hao Tan ,
Peng Wang ,
Haian Jin ,
Yue Zhao ,
Sai Bi ,
Kai Zhang ,
Fujun Luan ,
Kalyan Sunkavalli ,
Qixing Huang ,
Georgios Pavlakos
ICCV, 2025
Self-supervised large-scale view synthesis from unposed image collections.
DMV3D: Denoising Multi-View Diffusion Using 3D Large Reconstruction Model
Yinghao Xu ,
Hao Tan ,
Fujun Luan ,
Sai Bi ,
Peng Wang ,
Jiahao Li ,
Zifan Shi ,
Kalyan Sunkavalli ,
Gordon Wetzstein ,
Zexiang Xu ,
Kai Zhang
ICLR, 2024
A 3D large reconstruction model inside a multi-view diffusion denoiser.