Thomas Wolf
1976–2026 年に発表
- 208
- 論文数
- 42,352
- 被引用数
- 74
- h 指数
- 135
- i10 指数
被引用数
引用元
国・地域
機関
分野
- Computer Science72%
- Medicine5.5%
- Social Sciences4.1%
- Engineering3.7%
- Biochemistry, Genetics and Molecular Biology3.2%
- Psychology2.4%
- その他9.1%
トピック
- Topic Modeling15.7%
- Natural Language Processing Techniques11%
- Multimodal Machine Learning Applications4.5%
- Domain Adaptation and Few-Shot Learning1.9%
- Sentiment Analysis and Opinion Mining1.9%
- Software Engineering Research1.8%
- その他63.2%
共著者
- Leandro von Werra11
- Boris Lohmann10
- Victor Sanh10
- Julien Chaumond9
- Ronald E. Myers8
- Alexander M. Rush7
- Clement Delangue7
- Lewis Tunstall7
- Ming‐Fu Lin7
- Quentin Lhoest7
- Yacine Jernite7
- Heiko K. F. Panzer6
- J. Pedro F. Nunes6
- Loubna Ben Allal6
- Markus Gühr6
- Martin Centurion6
- Teven Le Scao6
- Xiaozhe Shen6
- Xijie Wang6
- Gianni Panagiotou5
- Gilbert Fridgen5
- Guilherme Penedo5
- Hynek Kydlícek5
- Jie Yang5
全論文
- DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter
著者: Victor Sanh, Lysandre Debut, Julien Chaumond, Thomas Wolf - TGDK 2025 被引用: 5,459
- Transformers: State-of-the-Art Natural Language Processing
著者: Thomas Wolf, Lysandre Debut, Victor Sanh, Julien Chaumond, Clement Delangue, Anthony Moi, Pierric Cistac, Tim Rault, Rémi Louf, Morgan Funtowicz, Joe Davison, Sam Shleifer, Patrick von Platen, Clara Ma, Yacine Jernite, Julien Plu, Canwen Xu, Teven Le Scao, Sylvain Gugger, Mariama Drame, Quentin Lhoest, Alexander M. Rush - Conference on Empirical Methods in Natural Language Processing: System Demonstrations, EMNLP (Demos) 2020 被引用: 8,019
- HuggingFace's Transformers: State-of-the-art Natural Language Processing
著者: Thomas Wolf, Lysandre Debut, Victor Sanh, Julien Chaumond, Clément Delangue, Anthony Moi, Pierric Cistac, Tim Rault, Rémi Louf, Morgan Funtowicz, Davison, Joe, Shleifer, Sam, von Platen, Patrick, Ma, Clara, Jernite, Yacine, Plu, Julien, Xu, Canwen, Scao, Teven Le, Gugger, Sylvain, Drame, Mariama, Lhoest, Quentin, Rush, Alexander M. - arXiv (Cornell University), CoRR 2019 被引用: 4,445
- StarCoder: may the source be with you!
著者: Raymond Li, Loubna Ben Allal, Yangtian Zi, Niklas Muennighoff, Denis Kocetkov, Chenghao Mou, Marc Marone, Christopher Akiki, Jia Li, Jenny Chim, Qian Liu, Evgenii Zheltonozhskii, Terry Yue Zhuo, Thomas J. Wang, Olivier Dehaene, Mishig Davaadorj, Joël Lamy-Poirier, João Monteiro, Oleh Shliazhko, Nicolas Gontier, Nicholas Meade, Armel Randy Zebaze, Ming‐Ho Yee, Logesh Kumar Umapathi, Jianguo Zhu, Benjamin Lipkin, Muhtasham Oblokulov, Zhiruo Wang, Rudra Murthy, Jason Stillerman, Siva Sankalp Patel, Dmitry Abulkhanov, Marco Zocca, Manan Dey, Zhihan Zhang, Nour Fahmy, Urvashi Bhattacharyya, Wenhao Yu, Swayam Singh, Sasha Luccioni, Paulo Villegas, Maxim Kunakov, Fedor Zhdanov, Manuel Romero, Tong Lee, Nadav Timor, Ding, Jennifer, Claire Schlesinger, Hailey Schoelkopf, Jan Ebert, Tri Dao, Mayank Mishra, Alex Gu, Jennifer G. Robinson, Carolyn Jane Anderson, Brendan Dolan-Gavitt, Danish Contractor, Siva Reddy, Daniel Fried, Dzmitry Bahdanau, Yacine Jernite, Carlos Muñoz Ferrandis, Sean Hughes, Thomas Wolf, Arjun Guha, Leandro von Werra, Harm de Vries - arXiv (Cornell University), CoRR 2023 被引用: 1,146
- Zephyr: Direct Distillation of LM Alignment
著者: Lewis Tunstall, Edward Beeching, Nathan Lambert, Nazneen Rajani, Kashif Rasul, Younes Belkada, Shengyi Huang, Leandro von Werra, Clémentine Fourrier, Nathan Habib, Nathan Sarrazin, Omar Sanseviero, Alexander M. Rush, Thomas Wolf - arXiv (Cornell University), CoRR 2023 被引用: 605
- Multitask Prompted Training Enables Zero-Shot Task Generalization
著者: Victor Sanh, Albert Webson, Colin Raffel, Stephen H. Bach, Lintang Sutawika, Zaid Alyafeai, Antoine Chaffin, Arnaud Stiegler, Teven Le Scao, Arun Raja, Manan Dey, M. Saiful Bari, Canwen Xu, Urmish Thakker, Shanya Sharma, Eliza Szczechla, Taewoon Kim, Gunjan Chhablani, Nihal V. Nayak, Debajyoti Datta, Jonathan Chang, Mike Tian-Jian Jiang, Han Wang, Matteo Manica, Sheng Shen, Zheng Xin Yong, Harshit Pandey, Rachel Bawden, Thomas Wang, Trishala Neeraj, Jos Rozen, Abheesht Sharma, Andrea Santilli, Thibault Févry, Jason Alan Fries, Ryan Teehan, Stella Biderman, Leo Gao, Tali Bers, Thomas Wolf, Alexander M. Rush - ICLR 2022 被引用: 2,035
- The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale
著者: Guilherme Penedo, Hynek Kydlícek, Loubna Ben Allal, Anton Lozhkov, Margaret Mitchell, Colin A. Raffel, Leandro von Werra, Thomas Wolf - Advances in Neural Information Processing Systems 37, NeurIPS 2024 被引用: 1,056
- SmolLM2: When Smol Goes Big - Data-Centric Training of a Small Language Model
著者: Loubna Ben Allal, Anton Lozhkov, Elie Bakouch, Gabriel Martín Blázquez, Guilherme Penedo, Lewis Tunstall, Andrés Marafioti, Hynek Kydlícek, Agustín Piqueres Lajarín, Vaibhav Srivastav, Joshua Lochner, Caleb Fahlgren, Xuan-Son Nguyen, Clémentine Fourrier, Ben Burtenshaw, Hugo Larcher, Haojun Zhao, Cyril Zakka, Mathieu Morlon, Colin Raffel, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 被引用: 320
- SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
著者: Mustafa Shukor, Dana Aubakirova, Francesco Capuano, Pepijn Kooijmans, Steven Palma, Adil Zouitine, Michel Aractingi, Caroline Pascal, Martino Russi, Andrés Marafioti, Simon Alibert, Matthieu Cord, Thomas Wolf, Rémi Cadène - ArXiv.org, CoRR 2025 被引用: 293
- GAIA: a benchmark for General AI Assistants
著者: Grégoire Mialon, Clémentine Fourrier, Craig Swift, Thomas Wolf, Yann LeCun, Thomas Scialom - ICLR 2024 被引用: 1,034
- The Stack: 3 TB of permissively licensed source code
著者: Denis Kocetkov, Raymond Li, Loubna Ben Allal, Jia Li, Chenghao Mou, Yacine Jernite, Margaret Mitchell, Carlos Muñoz Ferrandis, Sean Hughes, Thomas Wolf, Dzmitry Bahdanau, Leandro von Werra, Harm de Vries - Trans. Mach. Learn. Res. 2023 被引用: 227
- SmolVLM: Redefining small and efficient multimodal models
著者: Andrés Marafioti, Orr Zohar, Miquel Farré, Merve Noyan, Elie Bakouch, Pedro Cuenca, Cyril Zakka, Loubna Ben Allal, Anton Lozhkov, Nouamane Tazi, Vaibhav Srivastav, Joshua Lochner, Hugo Larcher, Mathieu Morlon, Lewis Tunstall, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 被引用: 184
- Datasets: A Community Library for Natural Language Processing
著者: Quentin Lhoest, Albert Villanova del Moral, Yacine Jernite, Abhishek Thakur, Patrick von Platen, Suraj Patil, Julien Chaumond, Mariama Drame, Julien Plu, Lewis Tunstall, Joe Davison, Mario Sasko, Gunjan Chhablani, Bhavitvya Malik, Simon Brandeis, Teven Le Scao, Victor Sanh, Canwen Xu, Nicolas Patry, Angelina McMillan-Major, Philipp Schmid, Sylvain Gugger, Clément Delangue, Théo Matussière, Lysandre Debut, Stas Bekman, Pierric Cistac, Thibault Goehringer, Victor Mustar, François Lagunas, Alexander M. Rush, Thomas Wolf - Conference on Empirical Methods in Natural Language Processing: System Demonstrations, EMNLP (Demos) 2021 被引用: 368
- Scaling Data-Constrained Language Models
著者: Niklas Muennighoff, Alexander M. Rush, Boaz Barak, Teven Le Scao, Nouamane Tazi, Aleksandra Piktus, Sampo Pyysalo, Thomas Wolf, Colin A. Raffel - J. Mach. Learn. Res. 2023 被引用: 423
- Federated benchmarking of medical artificial intelligence with MedPerf
著者: Alexandros Karargyris, Renato Umeton, Micah J. Sheller, Alejandro Aristizabal, Johnu George, Anna Wuest, Sarthak Pati, Hasan Kassem, Maximilian Zenk, Ujjwal Baid, Prakash Narayana Moorthy, Alexander Chowdhury, Junyi Guo, Sahil S. Nalawade, Jacob Rosenthal, David Kanter, Maria Xenochristou, Daniel J. Beutel, Verena Chung, Timothy Bergquist, James A. Eddy, Abubakar Abid, Lewis Tunstall, Omar Sanseviero, Dimitrios Dimitriadis, Yiming Qian, Xinxing Xu, Yong Liu, Rick Siow Mong Goh, Srini Bala, Victor Bittorf, Sreekar Reddy Puchala, Biagio Ricciuti, Soujanya Samineni, Eshna Sengupta, Akshay Chaudhari, Cody Coleman, Bala Desinghu, Gregory F. Diamos, Debo Dutta, Diane Feddema, Grigori Fursin, Xinyuan Huang, Satyananda Kashyap, Nicholas D. Lane, Indranil Mallick, Pietro Mascagni, Virendra Mehta, Cassiano Ferro Moraes, Vivek Natarajan, Nikola Nikolov, Nicolas Padoy, Gennady Pekhimenko, Vijay Janapa Reddi, G. Anthony Reina, Pablo Ribalta, Abhishek Singh, Jayaraman J. Thiagarajan, Jacob Albrecht, Thomas Wolf, Geralyn Miller, Huazhu Fu, Prashant Shah, Daguang Xu, Poonam Yadav, David Talby, Mark M. Awad, Jeremy P. Howard, Michael Rosenthal, Luigi Marchionni, Massimo Loda, Jason M. Johnson, Spyridon Bakas, Peter Mattson - Nature Machine Intelligence, Nat. Mac. Intell. 2023 被引用: 149
- Transfer Learning in Natural Language Processing
著者: Sebastian Ruder, Matthew E. Peters, Swabha Swayamdipta, Thomas Wolf - Conference of the North, NAACL-HLT (Tutorial Abstracts) 2019 被引用: 579
- FineWeb2: One Pipeline to Scale Them All - Adapting Pre-Training Data Processing to Every Language
著者: Guilherme Penedo, Hynek Kydlícek, Vinko Sabolcec, Bettina Messmer, Negar Foroutan, Amir Hossein Kargaran, Colin Raffel, Martin Jaggi, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 被引用: 76
- Grounding Large Language Models in Interactive Environments with Online Reinforcement Learning
著者: Thomas Carta, Clément Romac, Thomas Wolf, Sylvain Lamprier, Olivier Sigaud, Pierre-Yves Oudeyer - ICML 2023 被引用: 272
- Multi-view gait recognition using 3D convolutional neural networks
著者: Thomas Wolf, Mohammadreza Babaee, Gerhard Rigoll - IEEE International Conference on Image Processing (ICIP) 2016 被引用: 246
- TransferTransfo: A Transfer Learning Approach for Neural Network Based Conversational Agents
著者: Thomas Wolf, Victor Sanh, Julien Chaumond, Clement Delangue - arXiv (Cornell University), CoRR 2019 被引用: 301
- DABstep: Data Agent Benchmark for Multi-step Reasoning
著者: Alex Egg, Martin Iglesias Goyanes, Friso Kingma, Andreu Mora, Leandro von Werra, Thomas Wolf - ArXiv.org, CoRR 2025 被引用: 28
- antiSMASH 4.0 - improvements in chemistry prediction and gene cluster boundary identification
著者: Kai Blin, Thomas Wolf, Marc G. Chevrette, Xiaowen Lu, Christopher J. Schwalen, Satria A. Kautsar, Hernando G. Suarez Duran, Emmanuel L. C. de los Santos, Hyun Uk Kim, Mariana Nave, Jeroen S. Dickschat, Douglas A. Mitchell, Ekaterina Shelest, Rainer Breitling, Eriko Takano, Sang Yup Lee, Tilmann Weber, Marnix H. Medema - Nucleic Acids Research, Nucleic Acids Res. 2017 被引用: 1,219
- Movement Pruning: Adaptive Sparsity by Fine-Tuning
著者: Victor Sanh, Thomas Wolf, Alexander M. Rush - NeurIPS 2020 被引用: 623
- VIMPAC: Video Pre-Training via Masked Token Prediction and Contrastive Learning
著者: Hao Tan, Jie Lei, Thomas Wolf, Mohit Bansal - arXiv (Cornell University), CoRR 2021 被引用: 62
