Samuel R. Bowman
2010–2026 年に発表
- 126
- 論文数
- 30,721
- 被引用数
- 61
- h 指数
- 104
- i10 指数
被引用数
引用元
国・地域
機関
分野
- Computer Science79.8%
- Social Sciences6.5%
- Engineering2.3%
- Medicine2.2%
- Decision Sciences1.7%
- Psychology1.7%
- その他5.8%
トピック
- Topic Modeling19.8%
- Natural Language Processing Techniques13.6%
- Multimodal Machine Learning Applications5.6%
- Explainable Artificial Intelligence (XAI)3.9%
- Adversarial Robustness in Machine Learning3%
- Ethics and Social Impacts of AI2.2%
- その他51.9%
共著者
- Ethan Perez22
- Jason Phang18
- Alex Warstadt15
- Nikita Nangia15
- Alicia Parrish13
- Haokun Liu13
- Kyunghyun Cho13
- Phu Mon Htut12
- Angelica Chen10
- Alex Wang9
- Carson Denison9
- Evan Hubinger9
- Christopher D. Manning8
- Clara Vania8
- Jared Kaplan8
- Julian Michael8
- Katharina Kann8
- Nicholas Schiefer8
- Christopher Potts7
- Richard Yuanzhe Pang7
- Amanda Askell6
- Anhad Mohananey6
- Anna Chen6
- Ansh Radhakrishnan6
全論文
- Constitutional AI: Harmlessness from AI Feedback
著者: Bai, Yuntao, Saurav Kadavath, Sandipan Kundu, Amanda Askell, Jackson Kernion, Andy Jones, Anna Chen, Anna Goldie, Azalia Mirhoseini, Cameron McKinnon, Carol Chen, Catherine Olsson, Christopher Olah, Danny Hernandez, Dawn Drain, Deep Ganguli, Dustin Li, Eli Tran-Johnson, Ethan Perez, Jamie Kerr, Jared Mueller, Jeffrey Ladish, Joshua D. Landau, Kamal Ndousse, Kamile Lukosuite, Liane Lovitt, Michael Sellitto, Nelson Elhage, Nicholas Schiefer, Noemi Mercado, Nova DasSarma, Robert Lasenby, Robin J. Larson, Sam Ringer, Scott G. Johnston, Shauna Kravec, Sheer El Showk, Stanislav Fort, Tamera Lanham, Timothy Telleen-Lawton, Tom Conerly, Tom Henighan, Tristan Hume, Samuel R. Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, Jared Kaplan - arXiv (Cornell University), CoRR 2022 被引用: 3,000
- GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding
著者: Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman - International Conference on Learning Representations, BlackboxNLP@EMNLP 2018 被引用: 3,957
- GPQA: A Graduate-Level Google-Proof Q&A Benchmark
著者: David Rein, Betty Li Hou, Asa Cooper Stickland, Jackson Petty, Richard Yuanzhe Pang, Julien Dirani, Julian Michael, Samuel R. Bowman - arXiv (Cornell University), CoRR 2023 被引用: 950
- Towards Understanding Sycophancy in Language Models
著者: Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R. Bowman, Newton Cheng, Esin Durmus, Zac Hatfield-Dodds, Scott R. Johnston, Shauna Kravec, Timothy Maxwell, Sam McCandlish, Kamal Ndousse, Oliver Rausch, Nicholas Schiefer, Da Yan, Miranda Zhang, Ethan Perez - ICLR 2024 被引用: 1,091
- Measuring Faithfulness in Chain-of-Thought Reasoning
著者: Tamera Lanham, Anna Chen, Ansh Radhakrishnan, Benoit Steiner, Carson Denison, Danny Hernandez, Dustin Li, Esin Durmus, Evan Hubinger, Jackson Kernion, Kamile Lukosiute, Karina Nguyen, Newton Cheng, Nicholas Joseph, Nicholas Schiefer, Oliver Rausch, Robin Larson, Sam McCandlish, Sandipan Kundu, Saurav Kadavath, Shannon Yang, Thomas Henighan, Timothy Maxwell, Timothy Telleen-Lawton, Tristan Hume, Zac Hatfield-Dodds, Jared Kaplan, Jan Brauner, Samuel R. Bowman, Ethan Perez - arXiv (Cornell University), CoRR 2023 被引用: 506
- A large annotated corpus for learning natural language inference
著者: Samuel R. Bowman, Gabor Angeli, Christopher Potts, Christopher D. Manning - Conference on Empirical Methods in Natural Language Processing, EMNLP 2015 被引用: 3,452
- Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training
著者: Evan Hubinger, Carson Denison, Jesse Mu, Mike Lambert, Meg Tong, Monte MacDiarmid, Tamera Lanham, Daniel M. Ziegler, Tim Maxwell, Newton Cheng, Adam S. Jermyn, Amanda Askell, Ansh Radhakrishnan, Cem Anil, David Duvenaud, Deep Ganguli, Fazl Barez, Jack Clark, Kamal Ndousse, Kshitij Sachan, Michael Sellitto, Mrinank Sharma, Nova DasSarma, Roger B. Grosse, Shauna Kravec, Yuntao Bai, Zachary Witten, Marina Favaro, Jan Brauner, Holden Karnofsky, Paul F. Christiano, Samuel R. Bowman, Logan Graham, Jared Kaplan, Sören Mindermann, Ryan Greenblatt, Buck Shlegeris, Nicholas Schiefer, Ethan Perez - arXiv (Cornell University), CoRR 2024 被引用: 414
- Discovering Language Model Behaviors with Model-Written Evaluations
著者: Ethan Perez, Sam Ringer, Kamile Lukosiute, Karina Nguyen, Edwin Chen, Scott Heiner, Craig Pettit, Catherine Olsson, Sandipan Kundu, Saurav Kadavath, Andy Jones, Anna Chen, Benjamin Mann, Brian Israel, Bryan Seethor, Cameron McKinnon, Christopher Olah, Da Yan, Daniela Amodei, Dario Amodei, Dawn Drain, Dustin Li, Eli Tran-Johnson, Guro Khundadze, Jackson Kernion, James Landis, Jamie Kerr, Jared Mueller, Jeeyoon Hyun, Joshua Landau, Kamal Ndousse, Landon Goldberg, Liane Lovitt, Martin Lucas, Michael Sellitto, Miranda Zhang, Neerav Kingsland, Nelson Elhage, Nicholas Joseph, Noemí Mercado, Nova DasSarma, Oliver Rausch, Robin Larson, Sam McCandlish, Scott Johnston, Shauna Kravec, Sheer El Showk, Tamera Lanham, Timothy Telleen-Lawton, Tom Brown, Tom Henighan, Tristan Hume, Yuntao Bai, Zac Hatfield-Dodds, Jack Clark, Samuel R. Bowman, Amanda Askell, Roger B. Grosse, Danny Hernandez, Deep Ganguli, Evan Hubinger, Nicholas Schiefer, Jared Kaplan - Findings of the Association for Computational Linguistics: ACL 2023, ACL (Findings) 2023 被引用: 423
- A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference
著者: Adina Williams, Nikita Nangia, Samuel R. Bowman - Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, Volume 1 (Long Papers), NAACL-HLT 2018 被引用: 899
- Alignment faking in large language models
著者: Ryan Greenblatt, Carson Denison, Benjamin Wright, Fabien Roger, Monte MacDiarmid, Samuel Marks, Johannes Treutlein, Tim Belonax, Jack Chen, David Duvenaud, Akbir Khan, Julian Michael, Sören Mindermann, Ethan Perez, Linda Petrini, Jonathan Uesato, Jared Kaplan, Buck Shlegeris, Samuel R. Bowman, Evan Hubinger - arXiv (Cornell University), CoRR 2024 被引用: 349
- BBQ: A Hand-Built Bias Benchmark for Question Answering
著者: Alicia Parrish, Angelica Chen, Nikita Nangia, Vishakh Padmakumar, Jason Phang, Jana Thompson, Phu Mon Htut, Samuel R. Bowman - Findings of the Association for Computational Linguistics: ACL 2022, ACL (Findings) 2022 被引用: 393
- Reasoning Models Don't Always Say What They Think
著者: Yanda Chen, Joe Benton, Ansh Radhakrishnan, Jonathan Uesato, Carson Denison, John Schulman, Arushi Somani, Peter Hase, Misha Wagner, Fabien Roger, Vladimir Mikulik, Samuel R. Bowman, Jan Leike, Jared Kaplan, Ethan Perez - ArXiv.org, CoRR 2025 被引用: 270
- Studying Large Language Model Generalization with Influence Functions
著者: Roger B. Grosse, Juhan Bae, Cem Anil, Nelson Elhage, Alex Tamkin, Amirhossein Tajdini, Benoit Steiner, Dustin Li, Esin Durmus, Ethan Perez, Evan Hubinger, Kamile Lukosiute, Karina Nguyen, Nicholas Joseph, Sam McCandlish, Jared Kaplan, Samuel R. Bowman - arXiv (Cornell University), CoRR 2023 被引用: 255
- Language Models Don't Always Say What They Think: Unfaithful Explanations in Chain-of-Thought Prompting
著者: Miles Turpin, Julian Michael, Ethan Perez, Samuel R. Bowman - Advances in Neural Information Processing Systems 36, NeurIPS 2023 被引用: 1,421
- SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems
著者: Alex Wang, Yada Pruksachatkun, Nikita Nangia, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman - Neural Information Processing Systems, NeurIPS 2019 被引用: 2,851
- Measuring Progress on Scalable Oversight for Large Language Models
著者: Samuel R. Bowman, Jeeyoon Hyun, Ethan Perez, Edwin Chen, Craig Pettit, Scott Heiner, Kamile Lukosiute, Amanda Askell, Andy Jones, Anna Chen, Anna Goldie, Azalia Mirhoseini, Cameron McKinnon, Christopher Olah, Daniela Amodei, Dario Amodei, Dawn Drain, Dustin Li, Eli Tran-Johnson, Jackson Kernion, Jamie Kerr, Jared Mueller, Jeffrey Ladish, Joshua Landau, Kamal Ndousse, Liane Lovitt, Nelson Elhage, Nicholas Schiefer, Nicholas Joseph, Noemí Mercado, Nova DasSarma, Robin Larson, Sam McCandlish, Sandipan Kundu, Scott Johnston, Shauna Kravec, Sheer El Showk, Stanislav Fort, Timothy Telleen-Lawton, Tom Brown, Tom Henighan, Tristan Hume, Yuntao Bai, Zac Hatfield-Dodds, Ben Mann, Jared Kaplan - arXiv (Cornell University), CoRR 2022 被引用: 231
- LLM Evaluators Recognize and Favor Their Own Generations
著者: Arjun Panickssery, Samuel R. Bowman, Shi Feng - Advances in Neural Information Processing Systems 37, NeurIPS 2024 被引用: 593
- The Capacity for Moral Self-Correction in Large Language Models
著者: Deep Ganguli, Amanda Askell, Nicholas Schiefer, Thomas I. Liao, Kamile Lukosiute, Anna Chen, Anna Goldie, Azalia Mirhoseini, Catherine Olsson, Danny Hernandez, Dawn Drain, Dustin Li, Eli Tran-Johnson, Ethan Perez, Jackson Kernion, Jamie Kerr, Jared Mueller, Joshua Landau, Kamal Ndousse, Karina Nguyen, Liane Lovitt, Michael Sellitto, Nelson Elhage, Noemí Mercado, Nova DasSarma, Oliver Rausch, Robert Lasenby, Robin Larson, Sam Ringer, Sandipan Kundu, Saurav Kadavath, Scott Johnston, Shauna Kravec, Sheer El Showk, Tamera Lanham, Timothy Telleen-Lawton, Tom Henighan, Tristan Hume, Yuntao Bai, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, Christopher Olah, Jack Clark, Samuel R. Bowman, Jared Kaplan - arXiv (Cornell University), CoRR 2023 被引用: 227
- XNLI: Evaluating Cross-lingual Sentence Representations
著者: Alexis Conneau, Ruty Rinott, Guillaume Lample, Adina Williams, Samuel R. Bowman, Holger Schwenk, Veselin Stoyanov - Conference on Empirical Methods in Natural Language Processing, EMNLP 2018 被引用: 934
- CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models
著者: Nikita Nangia, Clara Vania, Rasika Bhalerao, Samuel R. Bowman - Conference on Empirical Methods in Natural Language Processing (EMNLP), EMNLP (1) 2020 被引用: 214
- Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models
著者: Carson Denison, Monte MacDiarmid, Fazl Barez, David Duvenaud, Shauna Kravec, Samuel Marks, Nicholas Schiefer, Ryan Soklaski, Alex Tamkin, Jared Kaplan, Buck Shlegeris, Samuel R. Bowman, Ethan Perez, Evan Hubinger - arXiv (Cornell University), CoRR 2024 被引用: 166
- Constitutional Classifiers: Defending against Universal Jailbreaks across Thousands of Hours of Red Teaming
著者: Mrinank Sharma, Meg Tong, Jesse Mu, Jerry Wei, Jorrit Kruthoff, Scott Goodfriend, Euan Ong, Alwin Peng, Raj Agarwal, Cem Anil, Amanda Askell, Nathan Bailey, Joe Benton, Emma Bluemke, Samuel R. Bowman, Eric Christiansen, Hoagy Cunningham, Andy Dau, Anjali Gopal, Rob Gilson, Logan Graham, Logan Howard, Nimit Kalra, Taesung Lee, Kevin Lin, Peter Lofgren, Francesco Mosconi, Clare O'Hara, Catherine Olsson, Linda Petrini, Samir Rajani, Nikhil Saxena, Alex Silverstein, Tanya Singh, Theodore R. Sumers, Leonard Tang, Kevin K. Troy, Constantin Weisser, Ruiqi Zhong, Giulio Zhou, Jan Leike, Jared Kaplan, Ethan Perez - ArXiv.org, CoRR 2025 被引用: 144
- Debating with More Persuasive LLMs Leads to More Truthful Answers
著者: Akbir Khan, John Hughes, Dan Valentine, Laura Ruis, Kshitij Sachan, Ansh Radhakrishnan, Edward Grefenstette, Samuel R. Bowman, Tim Rocktäschel, Ethan Perez - ICML 2024 被引用: 285
- Neural Network Acceptability Judgments
著者: Alex Warstadt, Amanpreet Singh, Samuel R. Bowman - Transactions of the Association for Computational Linguistics, Trans. Assoc. Comput. Linguistics 2019 被引用: 297
