Punit Singh Koura
Active 2021–2025
- 11
- Papers
- 19,121
- Citations
- 9
- h-index
- 9
- i10-index
Citations
Citation sources
Countries
Institutions
Fields
- Computer Science78.6%
- Engineering4.6%
- Social Sciences3.9%
- Medicine2.5%
- Decision Sciences2%
- Psychology1.7%
- Other6.7%
Topics
- Topic Modeling15.3%
- Natural Language Processing Techniques11.1%
- Multimodal Machine Learning Applications5.2%
- Adversarial Robustness in Machine Learning2%
- Domain Adaptation and Few-Shot Learning2%
- Speech Recognition and Synthesis1.7%
- Other62.7%
Coauthors
- Todor Mihaylov8
- Luke Zettlemoyer6
- Naman Goyal6
- Xi Victoria Lin6
- Xian Li6
- Daniel Simig5
- Mikel Artetxe5
- Myle Ott5
- Sam Shleifer5
- Shuohui Chen5
- Tianlu Wang5
- Brian O'Horo4
- Jeff Wang4
- Moya Chen4
- Ramakanth Pasunuru4
- Shruti Bhosale4
- Christopher Dewan3
- Jingfei Du3
- Kurt Shuster3
- Mona T. Diab3
- Prajjwal Bhargava3
- Stephen Roller3
- Susan Zhang3
- Zornitsa Kozareva3
All papers
- Llama 2: Open Foundation and Fine-Tuned Chat Models
Authors: Hugo Touvron, Louis Martin, Kevin H. Stone, Peter J. Albert, Amjad Almahairi, Yasmine Babaei, Nikolay Bashlykov, Soumya Batra, Prajjwal Bhargava, Shruti Bhosale, Dan Bikel, Lukas Blecher, Cristian Canton Ferrer, Moya Chen, Guillem Cucurull, David Esiobu, Jude Fernandes, Jeremy Fu, Wenyin Fu, Brian Fuller, Cynthia Gao, Vedanuj Goswami, Naman Goyal, Anthony S. Hartshorn, Saghar Hosseini, Rui Hou, Hakan Inan, Marcin Kardas, Viktor Kerkez, Madian Khabsa, Isabel M. Kloumann, Artem Korenev, Punit Singh Koura, Marie-Anne Lachaux, Thibaut Lavril, Jenya Lee, Diana Liskovich, Yinghai Lu, Yuning Mao, Xavier Martinet, Todor Mihaylov, Pushkar Mishra, Igor Molybog, Yixin Nie, Andrew M. Poulton, Jeremy Reizenstein, Rashi Rungta, Kalyan Saladi, Alan Schelten, Ruan Silva, Eric M. Smith, Ranjan Subramanian, Xiaoqing Ellen Tan, Binh Tang, Ross Taylor, Adina Williams, Jian Xiang Kuan, Puxin Xu, Zheng Yan, Iliyan Zarov, Yuchen Zhang, Angela Fan, Melanie Kambadur, Sharan Narang, Aurelien Rodriguez, Robert Stojnic, Sergey Edunov, Thomas Scialom - arXiv (Cornell University), CoRR 2023 cited by 14,585
- OPT: Open Pre-trained Transformer Language Models
Authors: Susan Zhang, Stephen Roller, Naman Goyal, Mikel Artetxe, Moya Chen, Shuohui Chen, Christopher Dewan, Mona T. Diab, Xian Li, Xi Victoria Lin, Todor Mihaylov, Myle Ott, Sam Shleifer, Kurt Shuster, Daniel Simig, Punit Singh Koura, Anjali Sridhar, Tianlu Wang, Luke Zettlemoyer - CoRR 2022 cited by 2,918
- Analysing Off-The-Shelf Options for Question Answering with Portuguese FAQs
Authors: Susan Zhang, Stephen Roller, Goyal, Naman, Mikel Artetxe, Moya Chen, Shuohui Chen, Christopher Dewan, Mona Diab, Xian Li, Xi Victoria Lin, Todor Mihaylov, Myle Ott, Sam Shleifer, Kurt Shuster, Daniel Simig, Punit Singh Koura, Anjali Sridhar, Tianlu Wang, Luke Zettlemoyer - SLATE 2022 cited by 919
- OPT-IML: Scaling Language Model Instruction Meta Learning through the Lens of Generalization
Authors: Srinivasan Iyer, Xi Victoria Lin, Ramakanth Pasunuru, Todor Mihaylov, Daniel Simig, Ping Yu, Kurt Shuster, Tianlu Wang, Qing Liu, Punit Singh Koura, Xian Li, Brian O'Horo, Gabriel Pereyra, Jeff Wang, Christopher Dewan, Asli Celikyilmaz, Luke Zettlemoyer, Ves Stoyanov - arXiv (Cornell University), CoRR 2022 cited by 232
- Few-shot Learning with Multilingual Language Models
Authors: Xi Victoria Lin, Todor Mihaylov, Mikel Artetxe, Tianlu Wang, Shuohui Chen, Daniel Simig, Myle Ott, Naman Goyal, Shruti Bhosale, Jingfei Du, Ramakanth Pasunuru, Sam Shleifer, Punit Singh Koura, Vishrav Chaudhary, Brian O'Horo, Jeff Wang, Luke Zettlemoyer, Zornitsa Kozareva, Mona T. Diab, Veselin Stoyanov, Xian Li - arXiv (Cornell University), CoRR 2021 cited by 167
- Efficient Large Scale Language Modeling with Mixtures of Experts
Authors: Mikel Artetxe, Shruti Bhosale, Naman Goyal, Todor Mihaylov, Myle Ott, Sam Shleifer, Xi Victoria Lin, Jingfei Du, Srinivasan Iyer, Ramakanth Pasunuru, Giri Anantharaman, Xian Li, Shuohui Chen, Halil Akın, Mandeep Baines, Louis Martin, Xing Zhou, Punit Singh Koura, Brian O’Horo, Jeff Wang, Luke Zettlemoyer, Mona Diab, Zornitsa Kozareva, Ves Stoyanov - Conference on Empirical Methods in Natural Language Processing, EMNLP 2022 cited by 117
- Few-shot Learning with Multilingual Generative Language Models
Authors: Xi Victoria Lin, Todor Mihaylov, Mikel Artetxe, Tianlu Wang, Shuohui Chen, Daniel Simig, Myle Ott, Naman Goyal, Shruti Bhosale, Jingfei Du, Ramakanth Pasunuru, Sam Shleifer, Punit Singh Koura, Vishrav Chaudhary, Brian O'Horo, Jeff Wang, Luke Zettlemoyer, Zornitsa Kozareva, Mona T. Diab, Veselin Stoyanov, Xian Li - Conference on Empirical Methods in Natural Language Processing, EMNLP 2022 cited by 114
- A Theory on Adam Instability in Large-Scale Machine Learning
Authors: Igor Molybog, Peter Albert, Moya Chen, Zachary DeVito, David Esiobu, Naman Goyal, Punit Singh Koura, Sharan Narang, Andrew Poulton, Ruan Silva, Binh Tang, Diana Liskovich, Puxin Xu, Yuchen Zhang, Melanie Kambadur, Stephen Roller, Susan Zhang - arXiv (Cornell University), CoRR 2023 cited by 48
- Optimizing Pretraining Data Mixtures with LLM-Estimated Utility
Authors: William Barr Held, Bhargavi Paranjape, Punit Singh Koura, Mike Lewis, Frank Zhang, Todor Mihaylov - ArXiv.org, CoRR 2025 cited by 15
- BTS: Harmonizing Specialized Experts into a Generalist LLM
Authors: Qizhen Zhang, Prajjwal Bhargava, Chloe Bi, Chris X. Cai, Jakob Nicolaus Foerster, Jeremy Fu, Punit Singh Koura, Ruan Silva, Sheng Shen, Emily Dinan, Suchin Gururangan, Mike Lewis - Conference on Empirical Methods in Natural Language Processing, EMNLP 2025 cited by 3
- Correlating and Predicting Human Evaluations of Language Models from Natural Language Processing Benchmarks
Authors: Rylan Schaeffer, Punit Singh Koura, Binh Tang, Ranjan Subramanian, Aaditya K. Singh, Todor Mihaylov, Prajjwal Bhargava, Lovish Madaan, Niladri S. Chatterji, Vedanuj Goswami, Sergey Edunov, Dieuwke Hupkes, Sanmi Koyejo, Sharan Narang - ArXiv.org, CoRR 2025 cited by 3
All 11 papers shown.
