Thomas Wolf
Active 1976–2026
- 208
- Papers
- 42,352
- Citations
- 74
- h-index
- 135
- i10-index
Citations
Citation sources
Countries
Institutions
- Tsinghua University0.8%
- Carnegie Mellon University0.7%
- Stanford University0.6%
- University of Washington0.6%
- Chinese Academy of Sciences0.5%
- Peking University0.5%
- Other96.3%
Fields
- Computer Science72%
- Medicine5.5%
- Social Sciences4.1%
- Engineering3.7%
- Biochemistry, Genetics and Molecular Biology3.2%
- Psychology2.4%
- Other9.1%
Topics
- Topic Modeling15.7%
- Natural Language Processing Techniques11%
- Multimodal Machine Learning Applications4.5%
- Domain Adaptation and Few-Shot Learning1.9%
- Sentiment Analysis and Opinion Mining1.9%
- Software Engineering Research1.8%
- Other63.2%
Coauthors
- Leandro von Werra11
- Boris Lohmann10
- Victor Sanh10
- Julien Chaumond9
- Ronald E. Myers8
- Alexander M. Rush7
- Clement Delangue7
- Lewis Tunstall7
- Ming‐Fu Lin7
- Quentin Lhoest7
- Yacine Jernite7
- Heiko K. F. Panzer6
- J. Pedro F. Nunes6
- Loubna Ben Allal6
- Markus Gühr6
- Martin Centurion6
- Teven Le Scao6
- Xiaozhe Shen6
- Xijie Wang6
- Gianni Panagiotou5
- Gilbert Fridgen5
- Guilherme Penedo5
- Hynek Kydlícek5
- Jie Yang5
All papers
- DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter
Authors: Victor Sanh, Lysandre Debut, Julien Chaumond, Thomas Wolf - TGDK 2025 cited by 5,459
- Transformers: State-of-the-Art Natural Language Processing
Authors: Thomas Wolf, Lysandre Debut, Victor Sanh, Julien Chaumond, Clement Delangue, Anthony Moi, Pierric Cistac, Tim Rault, Rémi Louf, Morgan Funtowicz, Joe Davison, Sam Shleifer, Patrick von Platen, Clara Ma, Yacine Jernite, Julien Plu, Canwen Xu, Teven Le Scao, Sylvain Gugger, Mariama Drame, Quentin Lhoest, Alexander M. Rush - Conference on Empirical Methods in Natural Language Processing: System Demonstrations, EMNLP (Demos) 2020 cited by 8,019
- HuggingFace's Transformers: State-of-the-art Natural Language Processing
Authors: Thomas Wolf, Lysandre Debut, Victor Sanh, Julien Chaumond, Clément Delangue, Anthony Moi, Pierric Cistac, Tim Rault, Rémi Louf, Morgan Funtowicz, Davison, Joe, Shleifer, Sam, von Platen, Patrick, Ma, Clara, Jernite, Yacine, Plu, Julien, Xu, Canwen, Scao, Teven Le, Gugger, Sylvain, Drame, Mariama, Lhoest, Quentin, Rush, Alexander M. - arXiv (Cornell University), CoRR 2019 cited by 4,445
- StarCoder: may the source be with you!
Authors: Raymond Li, Loubna Ben Allal, Yangtian Zi, Niklas Muennighoff, Denis Kocetkov, Chenghao Mou, Marc Marone, Christopher Akiki, Jia Li, Jenny Chim, Qian Liu, Evgenii Zheltonozhskii, Terry Yue Zhuo, Thomas J. Wang, Olivier Dehaene, Mishig Davaadorj, Joël Lamy-Poirier, João Monteiro, Oleh Shliazhko, Nicolas Gontier, Nicholas Meade, Armel Randy Zebaze, Ming‐Ho Yee, Logesh Kumar Umapathi, Jianguo Zhu, Benjamin Lipkin, Muhtasham Oblokulov, Zhiruo Wang, Rudra Murthy, Jason Stillerman, Siva Sankalp Patel, Dmitry Abulkhanov, Marco Zocca, Manan Dey, Zhihan Zhang, Nour Fahmy, Urvashi Bhattacharyya, Wenhao Yu, Swayam Singh, Sasha Luccioni, Paulo Villegas, Maxim Kunakov, Fedor Zhdanov, Manuel Romero, Tong Lee, Nadav Timor, Ding, Jennifer, Claire Schlesinger, Hailey Schoelkopf, Jan Ebert, Tri Dao, Mayank Mishra, Alex Gu, Jennifer G. Robinson, Carolyn Jane Anderson, Brendan Dolan-Gavitt, Danish Contractor, Siva Reddy, Daniel Fried, Dzmitry Bahdanau, Yacine Jernite, Carlos Muñoz Ferrandis, Sean Hughes, Thomas Wolf, Arjun Guha, Leandro von Werra, Harm de Vries - arXiv (Cornell University), CoRR 2023 cited by 1,146
- Zephyr: Direct Distillation of LM Alignment
Authors: Lewis Tunstall, Edward Beeching, Nathan Lambert, Nazneen Rajani, Kashif Rasul, Younes Belkada, Shengyi Huang, Leandro von Werra, Clémentine Fourrier, Nathan Habib, Nathan Sarrazin, Omar Sanseviero, Alexander M. Rush, Thomas Wolf - arXiv (Cornell University), CoRR 2023 cited by 605
- Multitask Prompted Training Enables Zero-Shot Task Generalization
Authors: Victor Sanh, Albert Webson, Colin Raffel, Stephen H. Bach, Lintang Sutawika, Zaid Alyafeai, Antoine Chaffin, Arnaud Stiegler, Teven Le Scao, Arun Raja, Manan Dey, M. Saiful Bari, Canwen Xu, Urmish Thakker, Shanya Sharma, Eliza Szczechla, Taewoon Kim, Gunjan Chhablani, Nihal V. Nayak, Debajyoti Datta, Jonathan Chang, Mike Tian-Jian Jiang, Han Wang, Matteo Manica, Sheng Shen, Zheng Xin Yong, Harshit Pandey, Rachel Bawden, Thomas Wang, Trishala Neeraj, Jos Rozen, Abheesht Sharma, Andrea Santilli, Thibault Févry, Jason Alan Fries, Ryan Teehan, Stella Biderman, Leo Gao, Tali Bers, Thomas Wolf, Alexander M. Rush - ICLR 2022 cited by 2,035
- The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale
Authors: Guilherme Penedo, Hynek Kydlícek, Loubna Ben Allal, Anton Lozhkov, Margaret Mitchell, Colin A. Raffel, Leandro von Werra, Thomas Wolf - Advances in Neural Information Processing Systems 37, NeurIPS 2024 cited by 1,056
- SmolLM2: When Smol Goes Big - Data-Centric Training of a Small Language Model
Authors: Loubna Ben Allal, Anton Lozhkov, Elie Bakouch, Gabriel Martín Blázquez, Guilherme Penedo, Lewis Tunstall, Andrés Marafioti, Hynek Kydlícek, Agustín Piqueres Lajarín, Vaibhav Srivastav, Joshua Lochner, Caleb Fahlgren, Xuan-Son Nguyen, Clémentine Fourrier, Ben Burtenshaw, Hugo Larcher, Haojun Zhao, Cyril Zakka, Mathieu Morlon, Colin Raffel, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 cited by 320
- SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
Authors: Mustafa Shukor, Dana Aubakirova, Francesco Capuano, Pepijn Kooijmans, Steven Palma, Adil Zouitine, Michel Aractingi, Caroline Pascal, Martino Russi, Andrés Marafioti, Simon Alibert, Matthieu Cord, Thomas Wolf, Rémi Cadène - ArXiv.org, CoRR 2025 cited by 293
- GAIA: a benchmark for General AI Assistants
Authors: Grégoire Mialon, Clémentine Fourrier, Craig Swift, Thomas Wolf, Yann LeCun, Thomas Scialom - ICLR 2024 cited by 1,034
- The Stack: 3 TB of permissively licensed source code
Authors: Denis Kocetkov, Raymond Li, Loubna Ben Allal, Jia Li, Chenghao Mou, Yacine Jernite, Margaret Mitchell, Carlos Muñoz Ferrandis, Sean Hughes, Thomas Wolf, Dzmitry Bahdanau, Leandro von Werra, Harm de Vries - Trans. Mach. Learn. Res. 2023 cited by 227
- SmolVLM: Redefining small and efficient multimodal models
Authors: Andrés Marafioti, Orr Zohar, Miquel Farré, Merve Noyan, Elie Bakouch, Pedro Cuenca, Cyril Zakka, Loubna Ben Allal, Anton Lozhkov, Nouamane Tazi, Vaibhav Srivastav, Joshua Lochner, Hugo Larcher, Mathieu Morlon, Lewis Tunstall, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 cited by 184
- Datasets: A Community Library for Natural Language Processing
Authors: Quentin Lhoest, Albert Villanova del Moral, Yacine Jernite, Abhishek Thakur, Patrick von Platen, Suraj Patil, Julien Chaumond, Mariama Drame, Julien Plu, Lewis Tunstall, Joe Davison, Mario Sasko, Gunjan Chhablani, Bhavitvya Malik, Simon Brandeis, Teven Le Scao, Victor Sanh, Canwen Xu, Nicolas Patry, Angelina McMillan-Major, Philipp Schmid, Sylvain Gugger, Clément Delangue, Théo Matussière, Lysandre Debut, Stas Bekman, Pierric Cistac, Thibault Goehringer, Victor Mustar, François Lagunas, Alexander M. Rush, Thomas Wolf - Conference on Empirical Methods in Natural Language Processing: System Demonstrations, EMNLP (Demos) 2021 cited by 368
- Scaling Data-Constrained Language Models
Authors: Niklas Muennighoff, Alexander M. Rush, Boaz Barak, Teven Le Scao, Nouamane Tazi, Aleksandra Piktus, Sampo Pyysalo, Thomas Wolf, Colin A. Raffel - J. Mach. Learn. Res. 2023 cited by 423
- Federated benchmarking of medical artificial intelligence with MedPerf
Authors: Alexandros Karargyris, Renato Umeton, Micah J. Sheller, Alejandro Aristizabal, Johnu George, Anna Wuest, Sarthak Pati, Hasan Kassem, Maximilian Zenk, Ujjwal Baid, Prakash Narayana Moorthy, Alexander Chowdhury, Junyi Guo, Sahil S. Nalawade, Jacob Rosenthal, David Kanter, Maria Xenochristou, Daniel J. Beutel, Verena Chung, Timothy Bergquist, James A. Eddy, Abubakar Abid, Lewis Tunstall, Omar Sanseviero, Dimitrios Dimitriadis, Yiming Qian, Xinxing Xu, Yong Liu, Rick Siow Mong Goh, Srini Bala, Victor Bittorf, Sreekar Reddy Puchala, Biagio Ricciuti, Soujanya Samineni, Eshna Sengupta, Akshay Chaudhari, Cody Coleman, Bala Desinghu, Gregory F. Diamos, Debo Dutta, Diane Feddema, Grigori Fursin, Xinyuan Huang, Satyananda Kashyap, Nicholas D. Lane, Indranil Mallick, Pietro Mascagni, Virendra Mehta, Cassiano Ferro Moraes, Vivek Natarajan, Nikola Nikolov, Nicolas Padoy, Gennady Pekhimenko, Vijay Janapa Reddi, G. Anthony Reina, Pablo Ribalta, Abhishek Singh, Jayaraman J. Thiagarajan, Jacob Albrecht, Thomas Wolf, Geralyn Miller, Huazhu Fu, Prashant Shah, Daguang Xu, Poonam Yadav, David Talby, Mark M. Awad, Jeremy P. Howard, Michael Rosenthal, Luigi Marchionni, Massimo Loda, Jason M. Johnson, Spyridon Bakas, Peter Mattson - Nature Machine Intelligence, Nat. Mac. Intell. 2023 cited by 149
- Transfer Learning in Natural Language Processing
Authors: Sebastian Ruder, Matthew E. Peters, Swabha Swayamdipta, Thomas Wolf - Conference of the North, NAACL-HLT (Tutorial Abstracts) 2019 cited by 579
- FineWeb2: One Pipeline to Scale Them All - Adapting Pre-Training Data Processing to Every Language
Authors: Guilherme Penedo, Hynek Kydlícek, Vinko Sabolcec, Bettina Messmer, Negar Foroutan, Amir Hossein Kargaran, Colin Raffel, Martin Jaggi, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 cited by 76
- Grounding Large Language Models in Interactive Environments with Online Reinforcement Learning
Authors: Thomas Carta, Clément Romac, Thomas Wolf, Sylvain Lamprier, Olivier Sigaud, Pierre-Yves Oudeyer - ICML 2023 cited by 272
- Multi-view gait recognition using 3D convolutional neural networks
Authors: Thomas Wolf, Mohammadreza Babaee, Gerhard Rigoll - IEEE International Conference on Image Processing (ICIP) 2016 cited by 246
- TransferTransfo: A Transfer Learning Approach for Neural Network Based Conversational Agents
Authors: Thomas Wolf, Victor Sanh, Julien Chaumond, Clement Delangue - arXiv (Cornell University), CoRR 2019 cited by 301
- DABstep: Data Agent Benchmark for Multi-step Reasoning
Authors: Alex Egg, Martin Iglesias Goyanes, Friso Kingma, Andreu Mora, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 cited by 28
- antiSMASH 4.0 - improvements in chemistry prediction and gene cluster boundary identification
Authors: Kai Blin, Thomas Wolf, Marc G. Chevrette, Xiaowen Lu, Christopher J. Schwalen, Satria A. Kautsar, Hernando G. Suarez Duran, Emmanuel L. C. de los Santos, Hyun Uk Kim, Mariana Nave, Jeroen S. Dickschat, Douglas A. Mitchell, Ekaterina Shelest, Rainer Breitling, Eriko Takano, Sang Yup Lee, Tilmann Weber, Marnix H. Medema - Nucleic Acids Research, Nucleic Acids Res. 2017 cited by 1,219
- Movement Pruning: Adaptive Sparsity by Fine-Tuning
Authors: Victor Sanh, Thomas Wolf, Alexander M. Rush - NeurIPS 2020 cited by 623
- VIMPAC: Video Pre-Training via Masked Token Prediction and Contrastive Learning
Authors: Hao Tan, Jie Lei, Thomas Wolf, Mohit Bansal - arXiv (Cornell University), CoRR 2021 cited by 62
