Xiang Bai
Active 2006–2026
- 484
- Papers
- 48,837
- Citations
- 103
- h-index
- 321
- i10-index
Citations
Citation sources
Countries
Institutions
Fields
- Computer Science71.9%
- Engineering18.5%
- Medicine2.7%
- Earth and Planetary Sciences1.3%
- Environmental Science1%
- Biochemistry, Genetics and Molecular Biology0.9%
- Other3.7%
Topics
- Advanced Image and Video Retrieval Techniques8.4%
- Advanced Neural Network Applications6.5%
- Handwritten Text Recognition Techniques6.4%
- Image Retrieval and Classification Techniques4.2%
- Video Surveillance and Tracking Methods3.6%
- Multimodal Machine Learning Applications3.5%
- Other67.4%
Coauthors
- Wenyu Liu70
- Yuliang Liu64
- Song Bai56
- Dingkang Liang54
- Cong Yao42
- Longin Jan Latecki41
- Xinggang Wang40
- Baoguang Shi29
- Minghui Liao27
- Yongchao Xu22
- Yu Zhou20
- Zhe Liu20
- Zhuowen Tu20
- Lianwen Jin19
- Xiaoqing Ye19
- Xinwei He19
- Mingkun Yang18
- Gui-Song Xia17
- Wei Shen17
- Xin Zhou15
- Zhen Zhu15
- Jingdong Wang14
- Wenwen Yu13
- Zhikang Zou13
All papers
- AID: A Benchmark Data Set for Performance Evaluation of Aerial Scene Classification
Authors: Gui-Song Xia, Jingwen Hu, Fan Hu, Baoguang Shi, Xiang Bai, Yanfei Zhong, Liangpei Zhang, Xiaoqiang Lu - IEEE Transactions on Geoscience and Remote Sensing, IEEE Trans. Geosci. Remote. Sens. 2017 cited by 2,107
- An End-to-End Trainable Neural Network for Image-Based Sequence Recognition and Its Application to Scene Text Recognition
Authors: Baoguang Shi, Xiang Bai, Cong Yao - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2016 cited by 3,117
- Gliding Vertex on the Horizontal Bounding Box for Multi-Oriented Object Detection
Authors: Yongchao Xu, Mingtao Fu, Qimeng Wang, Yukang Wang, Kai Chen, Gui-Song Xia, Xiang Bai - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2020 cited by 957
- OCRBench: on the hidden mystery of OCR in large multimodal models
Authors: Yuliang Liu, Zhang Li, Hongliang Li, Wenwen Yu, Mingxin Huang, Dezhi Peng, Mingyu Liu, Mingrui Chen, Chunyuan Li, Lianwen Jin, Xiang Bai - Science China Information Sciences, Sci. China Inf. Sci. 2024 cited by 323
- End-to-End Semi-Supervised Object Detection with Soft Teacher
Authors: Mengde Xu, Zheng Zhang, Han Hu, Jianfeng Wang, Lijuan Wang, Fangyun Wei, Xiang Bai, Zicheng Liu - IEEE/CVF International Conference on Computer Vision (ICCV) 2021 cited by 531
- ASTER: An Attentional Scene Text Recognizer with Flexible Rectification
Authors: Baoguang Shi, Mingkun Yang, Xinggang Wang, Pengyuan Lyu, Cong Yao, Xiang Bai - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2018 cited by 926
- Real-Time Scene Text Detection With Differentiable Binarization and Adaptive Scale Fusion
Authors: Minghui Liao, Zhisheng Zou, Zhaoyi Wan, Cong Yao, Xiang Bai - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2022 cited by 395
- TextMonkey: An OCR-Free Large Multimodal Model for Understanding Document
Authors: Yuliang Liu, Biao Yang, Qiang Liu, Zhang Li, Zhiyin Ma, Shuo Zhang, Xiang Bai - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2026 cited by 156
- End-to-End Temporal Action Detection With Transformer
Authors: Xiaolong Liu, Qimeng Wang, Yao Hu, Xu Tang, Shiwei Zhang, Song Bai, Xiang Bai - IEEE Transactions on Image Processing, IEEE Trans. Image Process. 2022 cited by 260
- A Simple Baseline for Open-Vocabulary Semantic Segmentation with Pre-trained Vision-Language Model
Authors: Mengde Xu, Zheng Zhang, Fangyun Wei, Yutong Lin, Yue Cao, Han Hu, Xiang Bai - Lecture notes in computer science, ECCV (29) 2022 cited by 197
- TextBoxes++: A Single-Shot Oriented Scene Text Detector
Authors: Minghui Liao, Baoguang Shi, Xiang Bai - IEEE Transactions on Image Processing, IEEE Trans. Image Process. 2018 cited by 926
- Richer Convolutional Features for Edge Detection
Authors: Yun Liu, Ming-Ming Cheng, Xiaowei Hu, Kai Wang, Xiang Bai - IEEE Conference on Computer Vision and Pattern Recognition (CVPR) 2017 cited by 768
- ICDAR2019 Competition on Scanned Receipt OCR and Information Extraction
Authors: Zheng Huang, Kai Chen, Jianhua He, Xiang Bai, Dimosthenis Karatzas, Shijian Lu, C. V. Jawahar - International Conference on Document Analysis and Recognition (ICDAR) 2019 cited by 318
- ReCamMaster: Camera-Controlled Generative Rendering from A Single Video
Authors: Jianhong Bai, Menghan Xia, Xiao Fu, Xintao Wang, Lianrui Mu, Jinwen Cao, Zuozhu Liu, Haoji Hu, Xiang Bai, Pengfei Wan, Di Zhang - IEEE/CVF International Conference on Computer Vision (ICCV) 2025 cited by 125
- OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning
Authors: Ling Fu, Zhebin Kuang, Jiajun Song, Mingxin Huang, Biao Yang, Yuzhe Li, Linghao Zhu, Qidi Luo, Xinyu Wang, Hao Lu, Li Zhang, Guozhi Tang, Bin Shan, Chunhui Lin, Qi Liu, Binghong Wu, Hao Feng, Hao Liu, Can Huang, Jingqun Tang, Wei Chen, Lianwen Jin, Yuliang Liu, Xiang Bai - NeurIPS 2025 cited by 146
- PointMamba: A Simple State Space Model for Point Cloud Analysis
Authors: Dingkang Liang, Xin Zhou, Wei Xu, Xingkui Zhu, Zhikang Zou, Xiaoqing Ye, Xiao Tan, Xiang Bai - Advances in Neural Information Processing Systems 37, NeurIPS 2024 cited by 331
- Monkey: Image Resolution and Text Label Are Important Things for Large Multi-modal Models
Authors: Zhang Li, Biao Yang, Qiang Liu, Zhiyin Ma, Shuo Zhang, Jingxu Yang, Yabo Sun, Yuliang Liu, Xiang Bai - IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024 cited by 123
- TextBoxes: A Fast Text Detector with a Single Deep Neural Network
Authors: Minghui Liao, Baoguang Shi, Xiang Bai, Xinggang Wang, Wenyu Liu - AAAI Conference on Artificial Intelligence 2017 cited by 861
- Revisiting Multiple Instance Neural Networks
Authors: Xinggang Wang, Yongluan Yan, Peng Tang, Xiang Bai, Wenyu Liu - Pattern Recognition, Pattern Recognit. 2017 cited by 503
- MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering
Authors: Jingqun Tang, Qi Liu, Yongjie Ye, Jinghui Lu, Wei Shu, Chunhui Lin, Wanqing Li, Mohamad Fitri Faiz Bin Mahmood, Hao Feng, Zhao Zhen, He, Yangfan, Lu, Kuan, Yanjie Wang, Yuliang Liu, Hao Líu, Xiang Bai, Can Huang - arXiv (Cornell University), CoRR 2024 cited by 96
- PRA-Net: Point Relation-Aware Network for 3D Point Cloud Analysis
Authors: Silin Cheng, Xiwu Chen, Xinwei He, Zhe Liu, Xiang Bai - IEEE Transactions on Image Processing, IEEE Trans. Image Process. 2021 cited by 182
- Multiple Instance Detection Network with Online Instance Classifier Refinement
Authors: Peng Tang, Xinggang Wang, Xiang Bai, Wenyu Liu - IEEE Conference on Computer Vision and Pattern Recognition (CVPR) 2017 cited by 522
- EPNet++: Cascade Bi-Directional Fusion for Multi-Modal 3D Object Detection
Authors: Zhe Liu, Tengteng Huang, Bingling Li, Xiwu Chen, Xi Wang, Xiang Bai - IEEE Transactions on Pattern Analysis and Machine Intelligence, IEEE Trans. Pattern Anal. Mach. Intell. 2022 cited by 146
- ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation
Authors: Haoyu Fu, Diankun Zhang, Zongchuang Zhao, Jianfeng Cui, Dingkang Liang, Chong Zhang, Dingyuan Zhang, Hongwei Xie, Bing Wang, Xiang Bai - IEEE/CVF International Conference on Computer Vision (ICCV) 2025 cited by 81
