JD
Jeff Dean
cs.LGcs.CLcs.AIstat.MLcs.CVcs.NEcs.CYcs.DCClinical notescs.DB
On Valency
published · living versionsW_u7fa5rax·v1 · currentpublished
MLSys: The New Frontier of Machine Learning Systems
with Alexander Ratner, Dan Alistarh, Gustavo Alonso, David G. Andersen +64
1 version
Preprints & journals
32 papers in the corpus · 2011–2026Decoupled DiLoCo for Resilient Distributed Pre-training2604.21428v1 · Arthur Douillard, Keith Rush, Yani Donchev et al.2026 · 0 citationsarXiv
DataRater: Meta-Learned Dataset Curation2505.17895v2 · Dan A. Calian, Gregory Farquhar, Iurii Kemaev et al.2025 · 1 citationarXiv
Equilibria and Learning in Modular Marketplaces2502.20346v1 · Kshipra Bhawalkar, Jeff Dean, Christopher Liaw et al.2025 · 0 citationsarXiv
Addendum: A graph placement methodology for fast chip design.39327495 · Goldie, Anna, Mirhoseini, Azalia, Yazgan, Mustafa et al.2024 · 11 citationsNature. 2024;634(8034):E10-E11
Shaping AI's Impact on Billions of Lives2412.02730v2 · Mariano-Florentino Cu'ellar, Jeff Dean, Finale Doshi-Velez et al.2024 · 4 citationsarXiv
Gemma 2: Improving Open Language Models at a Practical Size2408.00118v3 · Gemma Team: Morgane Riviere, Shreya Pathak, Pier Giuseppe Sessa et al.2024 · 146 citationsarXiv
Author Correction: A graph placement methodology for fast chip design.35361999 · Mirhoseini, Azalia, Goldie, Anna, Yazgan, Mustafa et al.2024 · 5 citationsNature. 2022;604(7906):E24
Capabilities of Gemini Models in Medicine2404.18416v2 · Khaled Saab, Tao Tu, Wei-Hung Weng et al.2024 · 98 citationsarXiv
Brainformers: Trading Simplicity for Efficiency2306.00008v2 · Yanqi Zhou, Nan Du, Yanping Huang et al.2023 · 0 citationsarXiv
Gemma: Open Models Based on Gemini Research and Technology2403.08295v4 · Gemma Team: Thomas Mesnard, Cassidy Hardin, Robert Dadashi et al.2024 · 240 citationsarXiv
Deep learning-enabled medical computer vision.33420381 · Esteva, Andre, Chou, Katherine, Yeung, Serena et al.2024 · 1,399 citationsNPJ digital medicine. 2021;4(1):5
Scaling Instruction-Finetuned Language Models2210.11416v5 · Hyung Won Chung, Le Hou, Shayne Longpre et al.2022 · 1,174 citationsarXiv
An Evolutionary Approach to Dynamic Introduction of Tasks in Large-scale Multitask Learning Systems2205.12755v6 · Andrea Gesmundo, Jeff Dean2022 · 19 citationsarXiv
Efficiently Scaling Transformer Inference2211.05102v1 · Reiner Pope, Sholto Douglas, Aakanksha Chowdhery et al.2022 · 56 citationsarXiv
Emergent Abilities of Large Language Models2206.07682v2 · Jason Wei, Yi Tay, Rishi Bommasani et al.2022 · 1,047 citationsarXiv
PaLM: Scaling Language Modeling with Pathways2204.02311v5 · Aakanksha Chowdhery, Sharan Narang, Jacob Devlin et al.2022 · 2,138 citationsarXiv
A Review of Sparse Expert Models in Deep Learning2209.01667v1 · William Fedus, Jeff Dean, Barret Zoph2022 · 33 citationsarXiv
Interlocking Backpropagation: Improving depthwise model-parallelism2010.04116v3 · Aidan N. Gomez, Oscar Key, Kuba Perlin et al.2020 · 5 citationsarXiv
muNet: Evolving Pretrained Deep Neural Networks into Scalable Auto-tuning Multitask Systems2205.10937v2 · Andrea Gesmundo, Jeff Dean2022 · 5 citationsarXiv
ST-MoE: Designing Stable and Transferable Sparse Expert Models2202.08906v2 · Barret Zoph, Irwan Bello, Sameer Kumar et al.2022 · 52 citationsarXiv
Pathways: Asynchronous Distributed Dataflow for ML2203.12533v1 · Paul Barham, Aakanksha Chowdhery, Jeff Dean et al.2022 · 36 citationsarXiv
A graph placement methodology for fast chip design.34108699 · Mirhoseini, Azalia, Goldie, Anna, Yazgan, Mustafa et al.2021 · 612 citationsNature. 2021;594(7862):207-212
Carbon Emissions and Large Neural Network Training2104.10350v3 · David Patterson, Joseph Gonzalez, Quoc Le et al.2021 · 128 citationsarXiv
Customization scenarios for de-identification of clinical notes.32000770 · Hartman, Tzvika, Howell, Michael D, Dean, Jeff et al.2020 · 45 citationsBMC medical informatics and decision making. 2020;20(1):14
Chip Placement with Deep Reinforcement Learning2004.10746v1 · Azalia Mirhoseini, Anna Goldie, Mustafa Yazgan et al.2020 · 151 citationsarXiv
MLSys: The New Frontier of Machine Learning Systems1904.03257v3 · Alexander Ratner, Dan Alistarh, Gustavo Alonso et al.2019 · 20 citationsarXivon Valency
A guide to deep learning in healthcare.30617335 · Esteva, Andre, Robicquet, Alexandre, Ramsundar, Bharath et al.2019 · 5,268 citationsNature medicine. 2019;25(1):24-29
Efficient Neural Architecture Search via Parameter Sharing1802.03268v2 · Hieu Pham, Melody Y. Guan, Barret Zoph et al.2018 · 620 citationsarXiv
Device Placement Optimization with Reinforcement Learning1706.04972v2 · Azalia Mirhoseini, Hieu Pham, Quoc V. Le et al.2017 · 319 citationsarXiv
Building high-level features using large scale unsupervised learning1112.6209v5 · Quoc V. Le, Marc'Aurelio Ranzato, Rajat Monga et al.2011 · 2,019 citationsarXiv
Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer1701.06538v1 · Noam Shazeer, Azalia Mirhoseini, Krzysztof Maziarz et al.2017 · 261 citationsarXiv
Distributed Representations of Words and Phrases and their Compositionality1310.4546v1 · Tomas Mikolov, Ilya Sutskever, Kai Chen et al.2013 · 17,952 citationsarXiv
Career total: 49 works. 32 are in this corpus.
Profile built from the corpus for this byline.
Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.