Xintao Wang
Active 2016–2026
- 252
- Papers
- 24,544
- Citations
- 62
- h-index
- 159
- i10-index
Citations
Citation sources
Countries
Institutions
Fields
- Computer Science76%
- Engineering11%
- Medicine3%
- Biochemistry, Genetics and Molecular Biology1.9%
- Physics and Astronomy1.1%
- Neuroscience1%
- Other6%
Topics
- Advanced Image Processing Techniques12.5%
- Generative Adversarial Networks and Image Synthesis8.8%
- Advanced Vision and Imaging8%
- Image and Signal Denoising Methods5.9%
- Image Processing Techniques and Applications4.2%
- Multimodal Machine Learning Applications3.3%
- Other57.3%
Coauthors
- Ying Shan72
- Pengfei Wan58
- Chao Dong31
- Menghan Xia29
- Yanghua Xiao28
- Kun Gai27
- Di Zhang26
- Yong Zhang21
- Xiaodong Cun20
- Chen Change Loy18
- Jiaqing Liang18
- Quande Liu18
- Ziyang Yuan16
- Rui Xu15
- Jiangjie Chen14
- Liangbin Xie14
- Haoxin Chen13
- Ke Yu12
- Qifeng Chen12
- Siyu Yuan12
- Yingqing He12
- Kelvin C. K. Chan11
- Qiulin Wang11
- Jianhong Bai10
All papers
- ESRGAN: Enhanced Super-Resolution Generative Adversarial Networks
Authors: Xintao Wang, Ke Yu, Shixiang Wu, Jinjin Gu, Yihao Liu, Chao Dong, Yu Qiao, Chen Change Loy - Lecture notes in computer science, ECCV Workshops (5) 2018 cited by 3,911
- T2I-Adapter: Learning Adapters to Dig Out More Controllable Ability for Text-to-Image Diffusion Models
Authors: Chong Mou, Xintao Wang, Liangbin Xie, Yanze Wu, Jian Zhang, Zhongang Qi, Ying Shan - AAAI Conference on Artificial Intelligence 2024 cited by 801
- VideoCrafter1: Open Diffusion Models for High-Quality Video Generation
Authors: Haoxin Chen, Menghan Xia, Yingqing He, Yong Zhang, Xiaodong Cun, Shaoshu Yang, Jinbo Xing, Yaofang Liu, Qifeng Chen, Xintao Wang, Chao Weng, Ying Shan - arXiv (Cornell University), CoRR 2023 cited by 485
- T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models
Authors: Chong Mou, Xintao Wang, Liangbin Xie, Wu, Yanze, Jian Zhang, Zhongang Qi, Ying Shan, Xiaohu Qie - arXiv (Cornell University), CoRR 2023 cited by 559
- ESRGAN: Enhanced Super-Resolution Generative Adversarial Networks
Authors: Xintao Wang, Ke Yu, Shixiang Wu, Jinjin Gu, Yihao Liu, Chao Dong, Chen Change Loy, Yu Qiao, Xiaoou Tang - arXiv (Cornell University), CoRR 2018 cited by 1,142
- InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models
Authors: Jiale Xu, Weihao Cheng, Yiming Gao, Xintao Wang, Shenghua Gao, Ying Shan - arXiv (Cornell University), CoRR 2024 cited by 380
- Flow-GRPO: Training Flow Matching Models via Online RL
Authors: Jie Liu, Gongye Liu, Jiajun Liang, Yangguang Li, Jiaheng Liu, Xintao Wang, Pengfei Wan, Di Zhang, Wanli Ouyang - NeurIPS 2025 cited by 373
- NTIRE 2017 Challenge on Single Image Super-Resolution: Methods and Results
Authors: Radu Timofte, Eirikur Agustsson, Luc Van Gool, Ming-Hsuan Yang, Lei Zhang, Bee Lim, Sanghyun Son, Heewon Kim, Seungjun Nah, Kyoung Mu Lee, Xintao Wang, Yapeng Tian, Ke Yu, Yulun Zhang, Shixiang Wu, Chao Dong, Liang Lin, Yu Qiao, Chen Change Loy, Woong Bae, Jaejun Yoo, Yoseob Han, Jong Chul Ye, Jae-Seok Choi, Munchurl Kim, Yuchen Fan, Jiahui Yu, Wei Han, Ding Liu, Haichao Yu, Zhangyang Wang, Honghui Shi, Xinchao Wang, Thomas S. Huang, Yunjin Chen, Kai Zhang, Wangmeng Zuo, Zhimin Tang, Linkai Luo, Shaohui Li, Min Fu, Lei Cao, Wen Heng, Giang Bui, Truc Le, Ye Duan, Dacheng Tao, Ruxin Wang, Xu Lin, Jianxin Pang, Jinchang Xu, Yu Zhao, Xiangyu Xu, Jin-shan Pan, Deqing Sun, Yujin Zhang, Xibin Song, Yuchao Dai, Xueying Qin, Xuan-Phung Huynh, Tiantong Guo, Hojjat Seyed Mousavi, Tiep Huu Vu, Vishal Monga, Cristóvão Cruz, Karen O. Egiazarian, Vladimir Katkovnik, Rakesh Mehta, Arnav Kumar Jain, Abhinav Agarwalla, Ch V. Sai Praveen, Ruofan Zhou, Hongdiao Wen, Che Zhu, Zhiqiang Xia, Zhengtao Wang, Qi Guo - IEEE Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), CVPR Workshops 2017 cited by 1,493
- Improving Video Generation with Human Feedback
Authors: Jie Liu, Gongye Liu, Jiajun Liang, Ziyang Yuan, Xiaokun Liu, Mingwu Zheng, Xiele Wu, Qiulin Wang, Wenyu Qin, Menghan Xia, Xintao Wang, Xiaohong Liu, Fei Yang, Pengfei Wan, Di Zhang, Kun Gai, Yujiu Yang, Wanli Ouyang - NeurIPS 2025 cited by 226
- From Persona to Personalization: A Survey on Role-Playing Language Agents
Authors: Jiangjie Chen, Xintao Wang, Rui Xu, Siyu Yuan, Yikai Zhang, Wei Shi, Jian Xie, Shuang Li, Ruihan Yang, Tinghui Zhu, Aili Chen, Nianqi Li, Lida Chen, Caiyu Hu, Siye Wu, Scott Ren, Ziquan Fu, Yanghua Xiao - Trans. Mach. Learn. Res. 2024 cited by 168
- DynamiCrafter: Animating Open-domain Images with Video Diffusion Priors
Authors: Jinbo Xing, Menghan Xia, Yong Zhang, Haoxin Chen, Yu, Wangbo, Liu, Hanyuan, Xintao Wang, Tien‐Tsin Wong, Ying Shan - arXiv (Cornell University), CoRR 2023 cited by 149
- FateZero: Fusing Attentions for Zero-shot Text-based Video Editing
Authors: Chenyang Qi, Xiaodong Cun, Yong Zhang, Chenyang Lei, Xintao Wang, Ying Shan, Qifeng Chen - IEEE/CVF International Conference on Computer Vision (ICCV) 2023 cited by 184
- Making LLaMA SEE and Draw with SEED Tokenizer
Authors: Yuying Ge, Sijie Zhao, Ziyun Zeng, Yixiao Ge, Chen Li, Xintao Wang, Ying Shan - ICLR 2024 cited by 216
- DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models
Authors: Chong Mou, Xintao Wang, Jiechong Song, Ying Shan, Jian Zhang - ICLR 2024 cited by 232
- ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
Authors: Jianhong Bai, Menghan Xia, Xiao Fu, Xintao Wang, Lianrui Mu, Jinwen Cao, Zuozhu Liu, Haoji Hu, Xiang Bai, Pengfei Wan, Di Zhang - IEEE/CVF International Conference on Computer Vision (ICCV) 2025 cited by 125
- MasaCtrl: Tuning-Free Mutual Self-Attention Control for Consistent Image Synthesis and Editing
Authors: Mingdeng Cao, Xintao Wang, Zhongang Qi, Ying Shan, Xiaohu Qie, Yinqiang Zheng - IEEE/CVF International Conference on Computer Vision (ICCV) 2023 cited by 334
- Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation
Authors: Jay Zhangjie Wu, Yixiao Ge, Xintao Wang, Stan Weixian Lei, Yuchao Gu, Yufei Shi, Wynne Hsu, Ying Shan, Xiaohu Qie, Mike Zheng Shou - IEEE/CVF International Conference on Computer Vision (ICCV) 2023 cited by 480
- VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
Authors: Haoxin Chen, Yong Zhang, Xiaodong Cun, Menghan Xia, Xintao Wang, Chao Weng, Ying Shan - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024 cited by 169
- Planting a SEED of Vision in Large Language Model
Authors: Yuying Ge, Yixiao Ge, Ziyun Zeng, Xintao Wang, Ying Shan - arXiv (Cornell University), CoRR 2023 cited by 124
- FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
Authors: Haonan Qiu, Menghan Xia, Yong Zhang, Yingqing He, Xintao Wang, Ying Shan, Ziwei Liu - ICLR 2024 cited by 190
- Follow Your Pose: Pose-Guided Text-to-Video Generation Using Pose-Free Videos
Authors: Yue Ma, Yingqing He, Xiaodong Cun, Xintao Wang, Siran Chen, Xiu Li, Qifeng Chen - AAAI Conference on Artificial Intelligence 2024 cited by 101
- Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation
Authors: Yingqing He, Menghan Xia, Haoxin Chen, Xiaodong Cun, Yuan Gong, Jinbo Xing, Yong Zhang, Xintao Wang, Chao Weng, Ying Shan, Qifeng Chen - arXiv (Cornell University), CoRR 2023 cited by 86
- Does Role-Playing Chatbots Capture the Character Personalities? Assessing Personality Traits for Role-Playing Chatbots
Authors: Xintao Wang, Yunze Xiao, Jen-tse Huang, Siyu Yuan, Rui Xu, Haoran Guo, Quan Tu, Yaying Fei, Ziang Leng, Wei Wang, Jiangjie Chen, Cheng Li, Yanghua Xiao - Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), ACL (1) 2024 cited by 82
- MotionCtrl: A Unified and Flexible Motion Controller for Video Generation
Authors: Zhouxia Wang, Ziyang Yuan, Xintao Wang, Yaowei Li, Tianshui Chen, Menghan Xia, Ping Luo, Ying Shan - Special Interest Group on Computer Graphics and Interactive Techniques Conference Conference Papers 24, SIGGRAPH (Conference Paper Track) 2024 cited by 81
