Shijian Lu
Active 1997–2026
- 363
- Papers
- 18,604
- Citations
- 70
- h-index
- 230
- i10-index
Citations
Citation sources
Countries
Institutions
Fields
- Computer Science77.2%
- Engineering11.6%
- Medicine4.8%
- Neuroscience1.8%
- Environmental Science0.8%
- Psychology0.7%
- Other3.1%
Topics
- Handwritten Text Recognition Techniques9.8%
- Advanced Image and Video Retrieval Techniques6.1%
- Advanced Neural Network Applications5.8%
- Multimodal Machine Learning Applications4.2%
- Image Retrieval and Classification Techniques4.2%
- Vehicle License Plate Recognition3.6%
- Other66.3%
Coauthors
- Jiaxing Huang52
- Chew Lim Tan49
- Fangneng Zhan48
- Xiaoqin Zhang33
- Aoran Xiao31
- Ling Shao30
- Gongjie Zhang29
- Dayan Guan27
- Yingchen Yu27
- Bolan Su22
- Joo-Hwee Lim22
- Jiahui Zhang21
- Alex C. Kot19
- Kaiwen Cui18
- Rongliang Wu18
- Zhipeng Luo16
- Tao Chen15
- Jingyi Zhang14
- Chuhui Xue13
- Yap-Peng Tan13
- Yun Xing13
- Xuansong Xie12
- Eric P. Xing11
- Hongyuan Zhu11
All papers
- ICDAR 2015 competition on Robust Reading
Authors: Dimosthenis Karatzas, Lluis Gomez-Bigorda, Anguelos Nicolaou, Suman K. Ghosh, Andrew D. Bagdanov, Masakazu Iwamura, Jiri Matas, Lukás Neumann, Vijay Ramaseshan Chandrasekhar, Shijian Lu, Faisal Shafait, Seiichi Uchida, Ernest Valveny - 13th International Conference on Document Analysis and Recognition (ICDAR) 2015 cited by 1,585
- R1-VL: Learning to Reason with Multimodal Large Language Models via Step-Wise Group Relative Policy Optimization
Authors: Jingyi Zhang, Jiaxing Huang, Huanjin Yao, Shunyu Liu, Xikun Zhang, Shijian Lu, Dacheng Tao - IEEE/CVF International Conference on Computer Vision (ICCV) 2025 cited by 235
- Vision-Language Models for Vision Tasks: A Survey
Authors: Jingyi Zhang, Jiaxing Huang, Sheng Jin, Shijian Lu - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2024 cited by 738
- ICDAR2019 Competition on Scanned Receipt OCR and Information Extraction
Authors: Zheng Huang, Kai Chen, Jianhua He, Xiang Bai, Dimosthenis Karatzas, Shijian Lu, C. V. Jawahar - International Conference on Document Analysis and Recognition (ICDAR) 2019 cited by 318
- Mitigating Object Hallucinations in Large Vision-Language Models through Visual Contrastive Decoding
Authors: Sicong Leng, Hang Zhang, Guanzheng Chen, Xin Li, Shijian Lu, Chunyan Miao, Lidong Bing - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024 cited by 122
- CAD-Net: A Context-Aware Detection Network for Objects in Remote Sensing Imagery
Authors: Gongjie Zhang, Shijian Lu, Wei Zhang - IEEE Transactions on Geoscience and Remote Sensing, IEEE Trans. Geosci. Remote. Sens. 2019 cited by 460
- Learning Disentangled Representation Implicitly Via Transformer for Occluded Person Re-Identification
Authors: Mengxi Jia, Xinhua Cheng, Shijian Lu, Jian Zhang - IEEE Transactions on Multimedia, IEEE Trans. Multim. 2022 cited by 202
- Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
Authors: Kunhao Liu, Wenbo Hu, Jiale Xu, Ying Shan, Shijian Lu - ArXiv.org, CoRR 2025 cited by 100
- Meta-DETR: Image-Level Few-Shot Detection With Inter-Class Correlation Exploitation
Authors: Gongjie Zhang, Zhipeng Luo, Kaiwen Cui, Shijian Lu, Eric P. Xing - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2022 cited by 156
- Defect-GAN: High-Fidelity Defect Synthesis for Automated Defect Inspection
Authors: Gongjie Zhang, Kaiwen Cui, Tzu-Yi Hung, Shijian Lu - IEEE Winter Conference on Applications of Computer Vision (WACV) 2021 cited by 163
- Accelerating DETR Convergence via Semantic-Aligned Matching
Authors: Gongjie Zhang, Zhipeng Luo, Yingchen Yu, Kaiwen Cui, Shijian Lu - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2022 cited by 119
- ICDAR 2019 Robust Reading Challenge on Reading Chinese Text on Signboard
Authors: Rui Zhang, Mingkun Yang, Xiang Bai, Baoguang Shi, Dimosthenis Karatzas, Shijian Lu, C. V. Jawahar, Yongsheng Zhou, Qianyi Jiang, Qi Song, Nan Li, Kai Zhou, Lei Wang, Dong Wang, Minghui Liao - International Conference on Document Analysis and Recognition (ICDAR) 2019 cited by 130
- MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation
Authors: Weihao Xuan, Rui Yang, Heli Qi, Qingcheng Zeng, Yunze Xiao, Aosong Feng, Dairui Liu, Yun Xing, Junjue Wang, Fan Gao, Jinghui Lu, Yuang Jiang, Huitao Li, Xin Li, Kunyu Yu, Ruihai Dong, Shangding Gu, Yuekang Li, Xiaofei Xie, Felix Juefei-Xu, Foutse Khomh, Osamu Yoshie, Qingyu Chen, Douglas Teodoro, Nan Liu, Randy Goebel, Lei Ma, Edison Marrese-Taylor, Shijian Lu, Yusuke Iwasawa, Yutaka Matsuo, Irene Li - Conference on Empirical Methods in Natural Language Processing, EMNLP 2025 cited by 47
- AGLA: Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention
Authors: Wenbin An, Feng Tian, Sicong Leng, Jiahao Nie, Haonan Lin, Qianying Wang, Guang Dai, Ping Chen, Shijian Lu - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025 cited by 44
- Matching on Sets: Conquer Occluded Person Re-identification Without Alignment
Authors: Mengxi Jia, Xinhua Cheng, Yunpeng Zhai, Shijian Lu, Siwei Ma, Yonghong Tian, Jian Zhang - AAAI Conference on Artificial Intelligence 2021 cited by 91
- Investigating Pose Representations and Motion Contexts Modeling for 3D Motion Prediction
Authors: Zhenguang Liu, Shuang Wu, Shuyuan Jin, Shouling Ji, Qi Liu, Shijian Lu, Li Cheng - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2022 cited by 84
- StyleGaussian: Instant 3D Style Transfer with Gaussian Splatting
Authors: Kunhao Liu, Fangneng Zhan, Muyu Xu, Christian Theobalt, Ling Shao, Shijian Lu - SIGGRAPH Asia 2024 Technical Communications, SIGGRAPH Asia Technical Communications 2024 cited by 43
- LongVT: Incentivizing "Thinking with Long Videos" via Native Tool Calling
Authors: Zuhao Yang, S. H. Wang, K. Zhang, WU Ke-ming, Sicong Leng, Yifan Zhang, Li, Bo, Qin, Chengwei, Shijian Lu, Xingxuan Li, Lidong Bing - ArXiv.org, CoRR 2025 cited by 33
- Model Adaptation: Historical Contrastive Learning for Unsupervised Domain Adaptation without Source Data
Authors: Jiaxing Huang, Dayan Guan, Aoran Xiao, Shijian Lu - NeurIPS 2021 cited by 293
- The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio
Authors: Sicong Leng, Yun Xing, Zesen Cheng, Yang Zhou, Hang Zhang, Xin Li, Deli Zhao, Shijian Lu, Chunyan Miao, Lidong Bing - NeurIPS 2025 cited by 49
- Towards Natural and Accurate Future Motion Prediction of Humans and Animals
Authors: Zhenguang Liu, Shuang Wu, Shuyuan Jin, Qi Liu, Shijian Lu, Roger Zimmermann, Cheng Li - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2019 cited by 143
- MMR1: Enhancing Multimodal Reasoning with Variance-Aware Sampling and Open Resources
Authors: Sicong Leng, Jing Wang, Jiaxi Li, Hao Zhang, Zhiqiang Hu, Boqiang Zhang, Yuming Jiang, Hang Zhang, Xin Li, Lidong Bing, Deli Zhao, Wei Lu, Yu Rong, Aixin Sun, Shijian Lu - ArXiv.org, CoRR 2025 cited by 26
- 3D Open-vocabulary Segmentation with Foundation Models
Authors: Kunhao Liu, Fangneng Zhan, Jiahui Zhang, Muyu Xu, Yingchen Yu, Abdulmotaleb El Saddik, Christian Theobalt, Eric P. Xing, Shijian Lu - NeurIPS 2023 cited by 157
- Visual Instruction Tuning towards General-Purpose Multimodal Model: A Survey
Authors: Jiaxing Huang, Jingyi Zhang, Kai Jiang, Han Qiu, Shijian Lu - arXiv (Cornell University), CoRR 2023 cited by 26
