Nan Duan
Active 2008–2026
- 332
- Papers
- 25,034
- Citations
- 68
- h-index
- 194
- i10-index
Citations
Citation sources
Countries
Institutions
Fields
- Computer Science83.2%
- Biochemistry, Genetics and Molecular Biology3.4%
- Engineering3.1%
- Social Sciences3%
- Medicine1.6%
- Neuroscience1.1%
- Other4.6%
Topics
- Topic Modeling14.1%
- Natural Language Processing Techniques9.3%
- Multimodal Machine Learning Applications8.7%
- Software Engineering Research4.5%
- Domain Adaptation and Few-Shot Learning2.9%
- Advanced Image and Video Retrieval Techniques2.5%
- Other58%
Coauthors
All papers
- CodeBERT: A Pre-Trained Model for Programming and Natural Languages
Authors: Zhangyin Feng, Daya Guo, Duyu Tang, Nan Duan, Xiaocheng Feng, Ming Gong, Linjun Shou, Bing Qin, Ting Liu, Daxin Jiang, Ming Zhou - Findings of the Association for Computational Linguistics: EMNLP 2020, EMNLP (Findings) 2020 cited by 2,434
- Findings of the Association for Computational Linguistics: EMNLP 2021
Authors: Firoj Alam, Shaden Shaar, Fahim Dalvi, Hassan Sajjad, Alex Nikolov, Hamdy Mubarak, Giovanni Da, San Martino, Ahmed Abdelali, Nadir Durrani, Kareem Darwish, Abdulaziz Al-Homaid, Wajdi Za- Ghouani, Tommaso Caselli, Tianda Li, Ahmad Rashid, Aref Jafari, Pranav Sharma, Ali Ghodsi, Mehdi Rezagholizadeh, Thi-Nhung Nguyen, Yimin Fan, Yaobo Liang, Alexandre Muzio, Hany Hassan, Houqiang Li, Ming Zhou, Nan Duan, Shiyang Li, Semih Yavuz, Wenhu Chen, Xifeng Yan, ;, Weiwen Xu, Yang Deng, Huihui Zhang, Deng Cai, Wai Lam, . . . . . . . . . . . . . . . . . . . . . ; Bowei, Zhifeng Zou, Manuel Li, Jan-David Plank, Terry Krieger, Bela Ruas, Akiko Gipp, Aizawa, Jiangnan Li, Zheng Lin, Peng Fu, Weiping Wang ; Yanyan, Hainan Zou, Hongshen Zhang, Zhuoye Chen, Caixia Ding, Xiaojie Yuan, Wang, Guoxin Yu, Jiwei Li, Ling Luo, Yuxian Meng, Xiang Ao, Qing He, Zixuan Zhang, Hongwei Wang, Han Zhao, Hanghang Tong, Heng Ji ; Guangrun, Hang Wang, Jiefeng Xu, Bert, Tong Overkill ; Bryan Mccann, Nazneen Niu, Rajani, Shirish Nitish, Thamar Keskar, Solorio, Shifeng Liu, Yifang Sun, Bing Li, Wei Wang, Florence Bourgeois, Adam Dunn, . ; Meishan, Zhenghua Zhang, Min ; Meng Li, Oyvind Huang, Chao Tafjord, Zhao, Yunlong Liang, Fandong Meng, Jinchao Zhang, Yufeng Chen, Jinan Xu, Jie Zhou, Yang Zhong, Jingfeng Yang, Wei Xu, Diyi Yang ; Yuchen, Chengyu Zhai, Minghui Wang and 296 more - 2021 cited by 896
- UniXcoder: Unified Cross-Modal Pre-training for Code Representation
Authors: Daya Guo, Shuai Lu, Nan Duan, Yanlin Wang, Ming Zhou, Jian Yin - Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), ECOOP 2022 cited by 678
- Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models
Authors: Chenfei Wu, Shengming Yin, Weizhen Qi, Xiaodong Wang, Zecheng Tang, Nan Duan - arXiv (Cornell University), CoRR 2023 cited by 688
- CLIP4Clip: An empirical study of CLIP for end to end video clip retrieval and captioning
Authors: Huaishao Luo, Lei Ji, Ming Zhong, Yang Chen, Wen Lei, Nan Duan, Tianrui Li - Neurocomputing 2022 cited by 677
- scGPT: toward building a foundation model for single-cell multi-omics using generative AI
Authors: Haotian Cui, Chloe Wang, Hassaan Maan, Kuan Pang, Fengning Luo, Nan Duan, Bo Wang - Nature Methods 2024 cited by 1,044
- AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models
Authors: Wanjun Zhong, Ruixiang Cui, Yiduo Guo, Yaobo Liang, Shuai Lu, Yanlin Wang, Amin Saied, Weizhu Chen, Nan Duan - Findings of the Association for Computational Linguistics: NAACL 2024, NAACL-HLT (Findings) 2024 cited by 485
- CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation
Authors: Shuai Lu, Daya Guo, Shuo Ren, Junjie Huang, Alexey Svyatkovskiy, Ambrosio Blanco, Colin B. Clement, Dawn Drain, Daxin Jiang, Duyu Tang, Ge Li, Lidong Zhou, Linjun Shou, Long Zhou, Michele Tufano, Ming Gong, Ming Zhou, Nan Duan, Neel Sundaresan, Shao Kun Deng, Shengyu Fu, Shujie Liu - NeurIPS Datasets and Benchmarks 2021 cited by 1,543
- GraphCodeBERT: Pre-training Code Representations with Data Flow
Authors: Daya Guo, Shuo Ren, Shuai Lu, Zhangyin Feng, Duyu Tang, Shujie Liu, Long Zhou, Nan Duan, Alexey Svyatkovskiy, Shengyu Fu, Michele Tufano, Shao Kun Deng, Colin B. Clement, Dawn Drain, Neel Sundaresan, Jian Yin, Daxin Jiang, Ming Zhou - ICLR 2021 cited by 1,779
- CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
Authors: Zhibin Gou, Zhihong Shao, Yeyun Gong, Yelong Shen, Yujiu Yang, Nan Duan, Weizhu Chen - ICLR 2024 cited by 816
- CMMLU: Measuring massive multitask language understanding in Chinese
Authors: Haonan Li, Yixuan Zhang, Fajri Koto, Yifei Yang, Hai Zhao, Yeyun Gong, Nan Duan, Timothy Baldwin - Findings of the Association for Computational Linguistics ACL 2024, ACL (Findings) 2024 cited by 301
- DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory
Authors: Shengming Yin, Chenfei Wu, Jian Liang, Jie Shi, Houqiang Li, Gong Ming, Nan Duan - arXiv (Cornell University), CoRR 2023 cited by 236
- ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
Authors: Zhibin Gou, Zhihong Shao, Yeyun Gong, Yelong Shen, Yujiu Yang, Minlie Huang, Nan Duan, Weizhu Chen - ICLR 2024 cited by 314
- GODIVA: Generating Open-DomaIn Videos from nAtural Descriptions
Authors: Chenfei Wu, Lun Huang, Qianxi Zhang, Binyang Li, Lei Ji, Fan Yang, Guillermo Sapiro, Nan Duan - arXiv (Cornell University), CoRR 2021 cited by 245
- Enhancing Retrieval-Augmented Large Language Models with Iterative Retrieval-Generation Synergy
Authors: Zhihong Shao, Yeyun Gong, Yelong Shen, Minlie Huang, Nan Duan, Weizhu Chen - Findings of the Association for Computational Linguistics: EMNLP 2023, EMNLP (Findings) 2023 cited by 176
- Unicoder-VL: A Universal Encoder for Vision and Language by Cross-Modal Pre-Training
Authors: Gen Li, Nan Duan, Yuejian Fang, Ming Gong, Daxin Jiang - AAAI Conference on Artificial Intelligence 2020 cited by 750
- Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model
Authors: Guoqing Ma, Haoyang Huang, Kun Yan, Liangyu Chen, Nan Duan, Shengming Yin, Changyi Wan, Ming, Ranchen, Xiaoniu Song, Xing Chen, Yu Zhou, Deshan Sun, Deyu Zhou, Jian Zhou, Kaijun Tan, Kang An, Mei Chen, Wei Ji, Qiling Wu, Wen Sun, Xin Han, Yanan Wei, Zheng Ge, A. F. Li, Bin Wang, Huang, Bizhu, Bo Wang, Brian Y. Li, Changxing Miao, Chen Xu, Chenfei Wu, Chenguang Yu, Dapeng Shi, Dingyuan Hu, Liu, Enle, Yu, Gang, Ge Yang, Guangnan Huang, Yan, Gulin, Haiyang Feng, Hao Nie, Haonan Jia, Hanpeng Hu, Hanqi Chen, Haolong Yan, Heng Wang, Hongcheng Guo, Huilin Xiong, Huixin Xiong, Jiahao Gong, Jianchang Wu, Jiao-Ren Wu, Jie Wu, Jie Yang, Jiashuai Liu, Jiashuo Li, Jingyang Zhang, Jiajie Guo, Junzhe Lin, Kaixiang Li, Lei Liu, Lei Xia, Liang Zhao, Liguo Tan, Liwen Huang, Liying Shi, Ming Li, Mingliang Li, Mu‐hua Cheng, Na Wang, Qiaohui Chen, Qinglin He, Qiuyan Liang, Quan Sun, Ran Sun, Rui Wang, Shaoliang Pang, Shiliang Yang, Sitong Liu, Siqi Liu, Shuli Gao, Tiancheng Cao, Tianyu Wang, Weipeng Ming, Wenqing He, Xu Zhao, Xuelin Zhang, Xianfang Zeng, Xiaojia Liu, Xuan Yang, Dai, Yaqi, Yanbo Yu, Yang Li, Deng, Yineng, Ying-Ming Wang, Yilei Wang, Yuanwei Lu, Yu Chen, Yu Luo, Yi Luo and 15 more - ArXiv.org, CoRR 2025 cited by 152
- Query Rewriting for Retrieval-Augmented Large Language Models
Authors: Xinbei Ma, Yeyun Gong, Pengcheng He, Hai Zhao, Nan Duan - arXiv (Cornell University), CoRR 2023 cited by 157
- Query Rewriting in Retrieval-Augmented Large Language Models
Authors: Xinbei Ma, Yeyun Gong, Pengcheng He, Hai Zhao, Nan Duan - Conference on Empirical Methods in Natural Language Processing, EMNLP 2023 cited by 209
- Baize: An Open-Source Chat Model with Parameter-Efficient Tuning on Self-Chat Data
Authors: Canwen Xu, Daya Guo, Nan Duan, Julian J. McAuley - Conference on Empirical Methods in Natural Language Processing, EMNLP 2023 cited by 193
- Rho-1: Not All Tokens Are What You Need
Authors: Zhenghao Lin, Zhibin Gou, Yeyun Gong, Xiao Liu, Yelong Shen, Ruochen Xu, Chen Lin, Yujiu Yang, Jian Jiao, Nan Duan, Weizhu Chen - arXiv (Cornell University), CoRR 2024 cited by 124
- UniViLM: A Unified Video and Language Pre-Training Model for Multimodal Understanding and Generation
Authors: Huaishao Luo, Lei Ji, Botian Shi, Haoyang Huang, Nan Duan, Tianrui Li, Jason Li, Taroon Bharti, Ming Zhou - arXiv (Cornell University), CoRR 2020 cited by 306
- AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators
Authors: Xingwei He, Zhenghao Lin, Yeyun Gong, A-Long Jin, Hang Zhang, Chen Lin, Jian Jiao, Siu Ming Yiu, Nan Duan, Weizhu Chen - Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 6: Industry Track), NAACL (Industry Track) 2024 cited by 136
- NUWA-XL: Diffusion over Diffusion for eXtremely Long Video Generation
Authors: Shengming Yin, Chenfei Wu, Huan Yang, Jianfeng Wang, Xiaodong Wang, Minheng Ni, Zhengyuan Yang, Linjie Li, Shuguang Liu, Fan Yang, Jianlong Fu, Gong Ming, Lijuan Wang, Zicheng Liu, Houqiang Li, Nan Duan - Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), ACL (1) 2023 cited by 114
