Tong Lu
Active 1992–2026
- Also published as
- Tong Lü
- 526
- Papers
- 35,130
- Citations
- 78
- h-index
- 291
- i10-index
Citations
Citation sources
Countries
Institutions
Fields
- Computer Science60.7%
- Engineering12.9%
- Medicine11.2%
- Biochemistry, Genetics and Molecular Biology5.7%
- Neuroscience1.9%
- Environmental Science1.3%
- Other6.3%
Topics
- Multimodal Machine Learning Applications7.4%
- Advanced Neural Network Applications6%
- Advanced Image and Video Retrieval Techniques3.2%
- Domain Adaptation and Few-Shot Learning3.1%
- Topic Modeling2.5%
- Handwritten Text Recognition Techniques2.5%
- Other75.3%
Coauthors
- Palaiahnakote Shivakumara121
- Umapada Pal87
- Wenhai Wang48
- Yirui Wu40
- Zhe Chen31
- Michael Blumenstein30
- Chew Lim Tan23
- Yu Qiao20
- Guo Chen19
- Feng Su18
- Jifeng Dai18
- Limin Wang18
- Zhiqi Li16
- Jiahao Wang15
- Tao Wang15
- Yin-Dong Zheng15
- Lokesh Nandanwar14
- Xizhou Zhu14
- Lewei Lu13
- Weiyun Wang13
- Yifei Huang13
- Daniel Lopresti12
- Enze Xie12
- Ping Luo12
All papers
- Pyramid Vision Transformer: A Versatile Backbone for Dense Prediction without Convolutions
Authors: Wenhai Wang, Enze Xie, Xiang Li, Deng-Ping Fan, Kaitao Song, Ding Liang, Tong Lu, Ping Luo, Ling Shao - IEEE/CVF International Conference on Computer Vision (ICCV) 2021 cited by 4,694
- InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models
Authors: Jinguo Zhu, Weiyun Wang, Zhe Chen, Zhaoyang Liu, Shenglong Ye, Lixin Gu, Hao Tian, Yuchen Duan, Weijie Su, Jie Shao, Zhangwei Gao, Erfei Cui, Xuehui Wang, Yue Cao, Yangzhou Liu, Xingguang Wei, Hongjie Zhang, Haomin Wang, Weiye Xu, Hao Li, Jiahao Wang, Nianchen Deng, Songze Li, Yinan He, Tan Jiang, Jiapeng Luo, Yi Wang, Conghui He, Botian Shi, Xingcheng Zhang, Wenqi Shao, Junjun He, Yingtong Xiong, Wenwen Qu, Peng Sun, Penglong Jiao, Han Lv, Lijun Wu, Kaipeng Zhang, Huipeng Deng, Jiaye Ge, Kai Chen, Limin Wang, Min Dou, Lewei Lu, Xizhou Zhu, Tong Lu, Dahua Lin, Yu Qiao, Jifeng Dai, Wenhai Wang - ArXiv.org, CoRR 2025 cited by 1,446
- Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling
Authors: Zhe Chen, Weiyun Wang, Yue Cao, Yangzhou Liu, Zhangwei Gao, Erfei Cui, Jinguo Zhu, Sheng‐Long Ye, Hao Tian, Zhaoyang Liu, Lixin Gu, Xuehui Wang, Qingyun Li, Yimin Ren, Zixuan Chen, Jiapeng Luo, Jiahao Wang, Tan Jiang, Bo Wang, Conghui He, Botian Shi, Zhang, Xingcheng, Han Lv, Zhichao Wang, Wei Shao, Pei Chu, Zhongying Tu, Tong He, Zhiyong Wu, Huipeng Deng, Jiaye Ge, Kai Chen, Zhang, Kaipeng, Wang, Limin, Min Dou, Lewei Lu, Zhu, Xizhou, Tong Lü, Dahua Lin, Yu Qiao, Jifeng Dai, Wenhai Wang - arXiv (Cornell University), CoRR 2024 cited by 1,368
- PVT v2: Improved baselines with Pyramid Vision Transformer
Authors: Wenhai Wang, Enze Xie, Xiang Li, Deng-Ping Fan, Kaitao Song, Ding Liang, Tong Lu, Ping Luo, Ling Shao - Computational Visual Media, Comput. Vis. Media 2022 cited by 2,178
- InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency
Authors: Weiyun Wang, Zhangwei Gao, Lixin Gu, Hengjun Pu, Long Cui, Xingguang Wei, Zhaoyang Liu, Linglin Jing, Shenglong Ye, Jie Shao, Zhaokai Wang, Zhe Chen, Hongjie Zhang, Ganlin Yang, Haomin Wang, Qi Wei, Jinhui Yin, Wenhao Li, Erfei Cui, Guanzhou Chen, Zichen Ding, Changyao Tian, Zhenyu Wu, JingJing Xie, Zehao Li, Bowen Yang, Yuchen Duan, Xuehui Wang, Zhi Hou, Haoran Hao, Tianyi Zhang, Songze Li, Xiangyu Zhao, Haodong Duan, Nianchen Deng, Bin Fu, Yinan He, Yi Wang, Conghui He, Botian Shi, Junjun He, Yingtong Xiong, Han Lv, Lijun Wu, Wenqi Shao, Kaipeng Zhang, Huipeng Deng, Biqing Qi, Jiaye Ge, Qipeng Guo, Wenwei Zhang, Songyang Zhang, Maosong Cao, Junyao Lin, Kexian Tang, Jianfei Gao, Haian Huang, Yuzhe Gu, Chengqi Lyu, Huanze Tang, Rui Wang, Haijun Lv, Wanli Ouyang, Limin Wang, Min Dou, Xizhou Zhu, Tong Lu, Dahua Lin, Jifeng Dai, Weijie Su, Bowen Zhou, Kai Chen, Yu Qiao, Wenhai Wang, Gen Luo - ArXiv.org, CoRR 2025 cited by 1,013
- How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites
Authors: Zhe Chen, Weiyun Wang, Hao Tian, Sheng‐Long Ye, Zhangwei Gao, Erfei Cui, Wenwen Tong, Kongzhi Hu, Jiapeng Luo, Zheng Ma, Ji Ma, Jiaqi Wang, Xiaoyi Dong, Hang Yan, Hewei Guo, Conghui He, Botian Shi, Zhenjiang Jin, Chao Xu, Bin Wang, Xingjian Wei, Wei Li, Wenjian Zhang, Bo Zhang, Pinlong Cai, Licheng Wen, Xiangchao Yan, Min Dou, Lewei Lu, Xizhou Zhu, Tong Lu, Dahua Lin, Yu Qiao, Jifeng Dai, Wenhai Wang, Wenhai Wang, Wenhai Wang - Science China Information Sciences, Sci. China Inf. Sci. 2024 cited by 701
- InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks
Authors: Zhe Chen, Jiannan Wu, Wenhai Wang, Weijie Su, Chen Guo, Sen Xing, Zhong Muyan, Qinglong Zhang, Xizhou Zhu, Lewei Lu, Bin Li, Ping Luo, Tong Lu, Yu Qiao, Jifeng Dai - arXiv (Cornell University), CoRR 2023 cited by 522
- Intern VL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks
Authors: Zhe Chen, Jiannan Wu, Wenhai Wang, Weijie Su, Guo Chen, Sen Xing, Muyan Zhong, Qinglong Zhang, Xizhou Zhu, Lewei Lu, Bin Li, Ping Luo, Tong Lu, Yu Qiao, Jifeng Dai - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024 cited by 414
- Vision Transformer Adapter for Dense Predictions
Authors: Zhe Chen, Yuchen Duan, Wenhai Wang, Junjun He, Tong Lu, Jifeng Dai, Yu Qiao - ICLR 2023 cited by 892
- VisionLLM: Large Language Model is also an Open-Ended Decoder for Vision-Centric Tasks
Authors: Wenhai Wang, Zhe Chen, Xiaokang Chen, Jiannan Wu, Xizhou Zhu, Gang Zeng, Ping Luo, Tong Lu, Jie Zhou, Yu Qiao, Jifeng Dai - NeurIPS 2023 cited by 699
- Shape Robust Text Detection With Progressive Scale Expansion Network
Authors: Wenhai Wang, Enze Xie, Xiang Li, Wenbo Hou, Tong Lu, Gang Yu, Shuai Shao - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2019 cited by 844
- BEVFormer: Learning Bird's-Eye-View Representation from Multi-Camera Images via Spatiotemporal Transformers
Authors: Zhiqi Li, Wenhai Wang, Hongyang Li, Enze Xie, Chonghao Sima, Tong Lu, Qiao Yu, Jifeng Dai - Lecture notes in computer science, ECCV (9) 2022 cited by 1,187
- BEVFormer: Learning Bird's-Eye-View Representation From LiDAR-Camera via Spatiotemporal Transformers
Authors: Zhiqi Li, Wenhai Wang, Hongyang Li, Enze Xie, Chonghao Sima, Tong Lu, Yu Qiao, Jifeng Dai - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2024 cited by 174
- Video Mamba Suite: State Space Model as a Versatile Alternative for Video Understanding
Authors: Guo Chen, Yifei Huang, Jilan Xu, Baoqi Pei, Zhe Chen, Zhiqi Li, Jiahao Wang, Kunchang Li, Tong Lu, Limin Wang - arXiv (Cornell University), CoRR 2024 cited by 103
- VideoLLM: Modeling Video Sequence with Large Language Models
Authors: Chen Guo, Yin-Dong Zheng, Jiahao Wang, Jilan Xu, Yifei Huang, Junting Pan, Yi Wang, Yali Wang, Yu Qiao, Tong Lü, Limin Wang - arXiv (Cornell University), CoRR 2023 cited by 116
- Neutrophil-induced ferroptosis promotes tumor necrosis in glioblastoma progression
Authors: Patricia Yee, Yiju Wei, Soo Yeon Kim, Tong Lu, Stephen Y. Chih, Cynthia Lawson, Miaolu Tang, Zhijun Liu, Benjamin Anderson, Krishnamoorthy Thamburaj, Megan M. Young, Dawit Aregawi, Michael Glantz, Brad E. Zacharia, Charles S. Specht, Hong‐Gang Wang, Wei Li - Nature Communications 2020 cited by 411
- LLDiffusion: Learning degradation representations in diffusion models for low-light image enhancement
Authors: Tao Wang, Kaihao Zhang, Yong Zhang, Wenhan Luo, Björn Stenger, Tong Lu, Tae-Kyun Kim, Wei Liu - Pattern Recognition, Pattern Recognit. 2025 cited by 100
- Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures
Authors: Yuchen Duan, Weiyun Wang, Zhe Chen, Xizhou Zhu, Lewei Lu, Tong Lu, Yu Qiao, Hongsheng Li, Jifeng Dai, Wenhai Wang - ICLR 2025 cited by 155
- Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models
Authors: Zhiqi Li, Guo Chen, Shilong Liu, Shihao Wang, Vibashan VS, Yishen Ji, Shiyi Lan, Hao Zhang, Yilin Zhao, Subhashree Radhakrishnan, Nadine Chang, Karan Sapra, Amala Sanjay Deshmukh, Tuomas Rintamaki, Matthieu Le, Ilia Karmanov, Lukas Voegtle, Philipp Fischer, De-An Huang, Timo Roman, Tong Lu, José M. Álvarez, Bryan Catanzaro, Jan Kautz, Andrew Tao, Guilin Liu, Zhiding Yu - ArXiv.org, CoRR 2025 cited by 73
- The All-Seeing Project: Towards Panoptic Visual Recognition and Understanding of the Open World
Authors: Weiyun Wang, Min Shi, Qingyun Li, Wenhai Wang, Zhenhang Huang, Linjie Xing, Zhe Chen, Hao Li, Xizhou Zhu, Zhiguo Cao, Yushi Chen, Tong Lu, Jifeng Dai, Yu Qiao - ICLR 2024 cited by 130
- InternImage: Exploring Large-Scale Vision Foundation Models with Deformable Convolutions
Authors: Wenhai Wang, Jifeng Dai, Zhe Chen, Zhenhang Huang, Zhiqi Li, Xizhou Zhu, Xiaowei Hu, Tong Lu, Lewei Lu, Hongsheng Li, Xiaogang Wang, Yu Qiao - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2023 cited by 898
- MM-Interleaved: Interleaved Image-Text Generative Modeling via Multi-modal Feature Synchronizer
Authors: Changyao Tian, Xizhou Zhu, Yuwen Xiong, Weiyun Wang, Zhe Chen, Wenhai Wang, Yuntao Chen, Lewei Lu, Tong Lu, Jie Zhou, Hongsheng Li, Yu Qiao, Jifeng Dai - arXiv (Cornell University), CoRR 2024 cited by 67
- VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks
Authors: Jiannan Wu, Muyan Zhong, Sen Xing, Zeqiang Lai, Zhaoyang Liu, Zhe Chen, Wenhai Wang, Xizhou Zhu, Lewei Lu, Tong Lu, Ping Luo, Yu Qiao, Jifeng Dai - Advances in Neural Information Processing Systems 37, NeurIPS 2024 cited by 172
- OmniCorpus: A Unified Multimodal Corpus of 10 Billion-Level Images Interleaved with Text
Authors: Qingyun Li, Zhe Chen, Weiyun Wang, Wenhai Wang, Shenglong Ye, Zhenjiang Jin, Guanzhou Chen, Yinan He, Zhangwei Gao, Erfei Cui, Jiashuo Yu, Hao Tian, Jiasheng Zhou, Chao Xu, Bin Wang, Xingjian Wei, Wei Li, Wenjian Zhang, Bo Zhang, Pinlong Cai, Licheng Wen, Xiangchao Yan, Zhenxiang Li, Pei Chu, Yi Wang, Min Dou, Changyao Tian, Xizhou Zhu, Lewei Lu, Yushi Chen, Junjun He, Zhongying Tu, Tong Lu, Yali Wang, Limin Wang, Dahua Lin, Yu Qiao, Botian Shi, Conghui He, Jifeng Dai - ICLR 2025 cited by 58
