Ying Shan
Active 2000–2026
- 432
- Papers
- 25,954
- Citations
- 78
- h-index
- 284
- i10-index
Citations
Citation sources
Countries
Institutions
- Tsinghua University1.6%
- Chinese Academy of Sciences1.3%
- Zhejiang University1.3%
- Tencent (China)1.1%
- University of Hong Kong1.1%
- Peking University1%
- Other92.6%
Fields
- Computer Science67.2%
- Biochemistry, Genetics and Molecular Biology10.5%
- Engineering9%
- Medicine5.4%
- Agricultural and Biological Sciences1.1%
- Social Sciences1.1%
- Other5.7%
Topics
- Generative Adversarial Networks and Image Synthesis8.2%
- Multimodal Machine Learning Applications6.9%
- Advanced Vision and Imaging4.2%
- Computer Graphics and Visualization Techniques3.3%
- 3D Shape Modeling and Analysis2.9%
- Advanced Image and Video Retrieval Techniques2.8%
- Other71.7%
Coauthors
All papers
- SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension
Authors: Bohao Li, Rui Wang, Guangzhi Wang, Yuying Ge, Yixiao Ge, Ying Shan - arXiv (Cornell University), CoRR 2023 cited by 820
- T2I-Adapter: Learning Adapters to Dig Out More Controllable Ability for Text-to-Image Diffusion Models
Authors: Chong Mou, Xintao Wang, Liangbin Xie, Yanze Wu, Jian Zhang, Zhongang Qi, Ying Shan - AAAI Conference on Artificial Intelligence 2024 cited by 801
- VideoCrafter1: Open Diffusion Models for High-Quality Video Generation
Authors: Haoxin Chen, Menghan Xia, Yingqing He, Yong Zhang, Xiaodong Cun, Shaoshu Yang, Jinbo Xing, Yaofang Liu, Qifeng Chen, Xintao Wang, Chao Weng, Ying Shan - arXiv (Cornell University), CoRR 2023 cited by 485
- Latent Video Diffusion Models for High-Fidelity Video Generation with Arbitrary Lengths
Authors: Yingqing He, Tianyu Yang, Yong Zhang, Ying Shan, Qifeng Chen - arXiv (Cornell University), CoRR 2022 cited by 500
- T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models
Authors: Chong Mou, Xintao Wang, Liangbin Xie, Wu, Yanze, Jian Zhang, Zhongang Qi, Ying Shan, Xiaohu Qie - arXiv (Cornell University), CoRR 2023 cited by 559
- InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models
Authors: Jiale Xu, Weihao Cheng, Yiming Gao, Xintao Wang, Shenghua Gao, Ying Shan - arXiv (Cornell University), CoRR 2024 cited by 380
- SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation
Authors: Yuying Ge, Sijie Zhao, Jinguo Zhu, Yixiao Ge, Kun Yi, Lin Song, Chen Li, Xiaohan Ding, Ying Shan - arXiv (Cornell University), CoRR 2024 cited by 296
- ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis
Authors: Wangbo Yu, Jinbo Xing, Li Yuan, Wenbo Hu, Xiaoyu Li, Zhipeng Huang, Xiangjun Gao, Tien-Tsin Wong, Ying Shan, Yonghong Tian - IEEE Transactions on Pattern Analysis and Machine Intelligence 2025 cited by 295
- DynamiCrafter: Animating Open-domain Images with Video Diffusion Priors
Authors: Jinbo Xing, Menghan Xia, Yong Zhang, Haoxin Chen, Yu, Wangbo, Liu, Hanyuan, Xintao Wang, Tien‐Tsin Wong, Ying Shan - arXiv (Cornell University), CoRR 2023 cited by 149
- FateZero: Fusing Attentions for Zero-shot Text-based Video Editing
Authors: Chenyang Qi, Xiaodong Cun, Yong Zhang, Chenyang Lei, Xintao Wang, Ying Shan, Qifeng Chen - IEEE/CVF International Conference on Computer Vision (ICCV) 2023 cited by 184
- Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation
Authors: Zhuoyan Luo, Fengyuan Shi, Yixiao Ge, Yujiu Yang, Limin Wang, Ying Shan - arXiv (Cornell University), CoRR 2024 cited by 139
- Making LLaMA SEE and Draw with SEED Tokenizer
Authors: Yuying Ge, Sijie Zhao, Ziyun Zeng, Yixiao Ge, Chen Li, Xintao Wang, Ying Shan - ICLR 2024 cited by 216
- Taming Rectified Flow for Inversion and Editing
Authors: Jiangshan Wang, Junfu Pu, Zhongang Qi, Jiayi Guo, Yue Ma, Nisha Huang, Yuxin Chen, Xiu Li, Ying Shan - ICML 2025 cited by 207
- DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models
Authors: Chong Mou, Xintao Wang, Jiechong Song, Ying Shan, Jian Zhang - ICLR 2024 cited by 232
- SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension
Authors: Bohao Li, Yuying Ge, Yi Chen, Yixiao Ge, Ruimao Zhang, Ying Shan - arXiv (Cornell University), CoRR 2024 cited by 126
- MasaCtrl: Tuning-Free Mutual Self-Attention Control for Consistent Image Synthesis and Editing
Authors: Mingdeng Cao, Xintao Wang, Zhongang Qi, Ying Shan, Xiaohu Qie, Yinqiang Zheng - IEEE/CVF International Conference on Computer Vision (ICCV) 2023 cited by 334
- Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation
Authors: Jay Zhangjie Wu, Yixiao Ge, Xintao Wang, Stan Weixian Lei, Yuchao Gu, Yufei Shi, Wynne Hsu, Ying Shan, Xiaohu Qie, Mike Zheng Shou - IEEE/CVF International Conference on Computer Vision (ICCV) 2023 cited by 480
- VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
Authors: Haoxin Chen, Yong Zhang, Xiaodong Cun, Menghan Xia, Xintao Wang, Chao Weng, Ying Shan - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024 cited by 169
- Planting a SEED of Vision in Large Language Model
Authors: Yuying Ge, Yixiao Ge, Ziyun Zeng, Xintao Wang, Ying Shan - arXiv (Cornell University), CoRR 2023 cited by 124
- DepthCrafter: Generating Consistent Long Depth Sequences for Open-world Videos
Authors: Wenbo Hu, Xiangjun Gao, Xiaoyu Li, Sijie Zhao, Xiaodong Cun, Yong Zhang, Long Quan, Ying Shan - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025 cited by 101
- Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
Authors: Kunhao Liu, Wenbo Hu, Jiale Xu, Ying Shan, Shijian Lu - ArXiv.org, CoRR 2025 cited by 100
- FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
Authors: Haonan Qiu, Menghan Xia, Yong Zhang, Yingqing He, Xintao Wang, Ying Shan, Ziwei Liu - ICLR 2024 cited by 190
- SEED-Bench: Benchmarking Multimodal Large Language Models
Authors: Bohao Li, Yuying Ge, Yixiao Ge, Guangzhi Wang, Rui Wang, Ruimao Zhang, Ying Shan - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024 cited by 104
- All in One: Exploring Unified Video-Language Pre-Training
Authors: Jinpeng Wang, Yixiao Ge, Rui Yan, Yuying Ge, Kevin Qinghong Lin, Satoshi Tsutsui, Xudong Lin, Guanyu Cai, Jianping Wu, Ying Shan, Xiaohu Qie, Mike Zheng Shou - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2023 cited by 135
