HC
Hyung Won Chung
cs.CLcs.LGcs.AIcs.CVcs.CYstat.MLBenchmarkingComputer Simulationcs.SDeess.AS
On Valency
published · living versionsW_jsb5733n·v1 · currentpublished
Deliberative Alignment: Reasoning Enables Safer Language Models
with Melody Y. Guan, Manas Joglekar, Eric Wallace, Saachi Jain +10
1 version
Preprints & journals
31 papers in the corpus · 2020–2025OpenAI o1 System Card2412.16720v2 · OpenAI: Aaron Jaech, Adam Kalai, Adam Lerer et al.2024 · 44 citationsarXiv
Publisher Correction: Large language models encode clinical knowledge.37500979 · Singhal, Karan, Azizi, Shekoofeh, Tu, Tao et al.2025 · 101 citationsNature. 2023;620(7973):E19
BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents2504.12516v1 · Jason Wei, Zhiqing Sun, Spencer Papay et al.2025 · 2 citationsarXiv
Deliberative Alignment: Reasoning Enables Safer Language Models2412.16339v2 · Melody Y. Guan, Manas Joglekar, Eric Wallace et al.2024 · 34 citationsarXivon Valency
Measuring short-form factuality in large language models2411.04368v1 · Jason Wei, Nguyen Karina, Hyung Won Chung et al.2024 · 13 citationsarXiv
GPT-4o System Card2410.21276v1 · OpenAI: Aaron Hurst, Adam Lerer, Adam P. Goucher et al.2024 · 165 citationsarXiv
Large language models encode clinical knowledge.37438534 · Singhal, Karan, Azizi, Shekoofeh, Tu, Tao et al.2023 · 4,033 citationsNature. 2023;620(7972):172-180
Mixture-of-Experts Meets Instruction Tuning:A Winning Combination for Large Language Models2305.14705v2 · Sheng Shen, Le Hou, Yanqi Zhou et al.2023 · 20 citationsarXiv
BLOOM: A 176B-Parameter Open-Access Multilingual Language Model2211.05100v4 · BigScience Workshop: Teven Le Scao, Angela Fan, Christopher Akiki et al.2022 · 834 citationsarXiv
UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining2304.09151v1 · Hyung Won Chung, Noah Constant, Xavier Garcia et al.2023 · 6 citationsarXiv
UL2: Unifying Language Learning Paradigms2205.05131v3 · Yi Tay, Mostafa Dehghani, Vinh Q. Tran et al.2022 · 94 citationsarXiv
The Flan Collection: Designing Data and Methods for Effective Instruction Tuning2301.13688v2 · Shayne Longpre, Le Hou, Tu Vu et al.2023 · 113 citationsarXiv
Large Language Models Encode Clinical Knowledge2212.13138v1 · Karan Singhal, Shekoofeh Azizi, Tao Tu et al.2022 · 4,033 citationsarXiv
Scaling Instruction-Finetuned Language Models2210.11416v5 · Hyung Won Chung, Le Hou, Shayne Longpre et al.2022 · 1,174 citationsarXiv
Transcending Scaling Laws with 0.1% Extra Compute2210.11399v2 · Yi Tay, Jason Wei, Hyung Won Chung et al.2022 · 33 citationsarXiv
Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them2210.09261v1 · Mirac Suzgun, Nathan Scales, Nathanael Scharli et al.2022 · 276 citationsarXiv
Language Models are Multilingual Chain-of-Thought Reasoners2210.03057v1 · Freda Shi, Mirac Suzgun, Markus Freitag et al.2022 · 55 citationsarXiv
PaLM: Scaling Language Modeling with Pathways2204.02311v5 · Aakanksha Chowdhery, Sharan Narang, Jacob Devlin et al.2022 · 2,138 citationsarXiv
Scaling Laws vs Model Architectures: How does Inductive Bias Influence Scaling?2207.10551v1 · Yi Tay, Mostafa Dehghani, Samira Abnar et al.2022 · 42 citationsarXiv
What Language Model Architecture and Pretraining Objective Work Best for Zero-Shot Generalization?2204.05832v1 · Thomas Wang, Adam Roberts, Daniel Hesslow et al.2022 · 22 citationsarXiv
Scaling Up Models and Data with $\texttt{t5x}$ and $\texttt{seqio}$2203.17189v1 · Adam Roberts, Hyung Won Chung, Anselm Levskaya et al.2022 · 47 citationsarXiv
Charformer: Fast Character Transformers via Gradient-based Subword Tokenization2106.12672v3 · Yi Tay, Vinh Q. Tran, Sebastian Ruder et al.2021 · 81 citationsarXiv
Scale Efficiently: Insights from Pre-training and Fine-tuning Transformers2109.10686v2 · Yi Tay, Mostafa Dehghani, Jinfeng Rao et al.2021 · 56 citationsarXiv
A Simple and Effective Positional Encoding for Transformers2104.08698v2 · Pu-Chin Chen, Henry Tsai, Srinadh Bhojanapalli et al.2021 · 59 citationsarXiv
Learning Compact Metrics for MT2110.06341v1 · Amy Pu, Hyung Won Chung, Ankur P. Parikh et al.2021 · 48 citationsarXiv
Do Transformer Modifications Transfer Across Implementations and Applications?2102.11972v2 · Sharan Narang, Hyung Won Chung, Yi Tay et al.2021 · 82 citationsarXiv
Neural Data Augmentation via Example Extrapolation2102.01335v1 · Kenton Lee, Kelvin Guu, Luheng He et al.2021 · 37 citationsarXiv
Improving Multilingual Models with Language-Clustered Vocabularies2010.12777v1 · Hyung Won Chung, Dan Garrette, Kiat Chuan Tan et al.2020 · 46 citationsarXiv
Rethinking embedding coupling in pre-trained language models2010.12821v1 · Hyung Won Chung, Thibault F'evry, Henry Tsai et al.2020 · 11 citationsarXiv
Learning to Evaluate Translation Beyond English: BLEURT Submissions to the WMT Metrics 2020 Shared Task2010.04297v3 · Thibault Sellam, Amy Pu, Hyung Won Chung et al.2020 · 26 citationsarXiv
Finding Fast Transformers: One-Shot Neural Architecture Search by Component Composition2008.06808v1 · Henry Tsai, Jayden Ooi, Chun-Sung Ferng et al.2020 · 12 citationsarXiv
Career total: 57 works. 31 are in this corpus.
Profile built from the corpus for this byline.
Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.