JR
Jason Riesa
cs.CLcs.LGcs.AIcs.SDeess.AScs.CVstat.ML
On Valency
published · living versionsW_zb7r6dq8·v1 · currentpublished
Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation
with Yonghui Wu, Mike Schuster, Zhifeng Chen, Quoc V. Le +26
1 version
Preprints & journals
19 papers in the corpus · 2016–2025ECLeKTic: a Novel Challenge Set for Evaluation of Cross-Lingual Knowledge Transfer2502.21228v3 · Omer Goldman, Uri Shaham, Dan Malkin et al.2025 · 1 citationarXiv
Gemini: A Family of Highly Capable Multimodal Models2312.11805v5 · Gemini Team Google: Rohan Anil, Sebastian Borgeaud, Jean-Baptiste Alayrac et al.2023 · 838 citationsarXiv
WMT24++: Expanding the Language Coverage of WMT24 to 55 Languages & Dialects2502.12404v1 · Daniel Deutsch, Eleftheria Briakou, Isaac Caswell et al.2025 · 5 citationsarXiv
FLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks2408.06227v1 · Min Ma, Yuma Koizumi, Shigeki Karita et al.2024 · 5 citationsINTERSPEECH 2024
FRMT: A Benchmark for Few-Shot Region-Aware Machine Translation2210.00193v3 · Parker Riley, Timothy Dozat, Jan A. Botha et al.2022 · 8 citationsarXiv
Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages2303.01037v3 · Yu Zhang, Wei Han, James Qin et al.2023 · 111 citationsarXiv
Multimodal Modeling For Spoken Language Identification2309.10567v1 · Shikhar Bharadwaj, Min Ma, Shikhar Vashishth et al.2023 · 1 citationarXiv
SQuId: Measuring Speech Naturalness in Many Languages2210.06324v2 · Thibault Sellam, Ankur Bapna, Joshua Camp et al.2022 · 17 citationsarXiv
Building Machine Translation Systems for the Next Thousand Languages2205.03983v3 · Ankur Bapna, Isaac Caswell, Julia Kreutzer et al.2022 · 43 citationsarXiv
FLEURS: Few-shot Learning Evaluation of Universal Representations of Speech2205.12446v1 · Alexis Conneau, Min Ma, Simran Khanuja et al.2022 · 195 citationsarXiv
XTREME-S: Evaluating Cross-lingual Speech Representations2203.10752v3 · Alexis Conneau, Ankur Bapna, Yu Zhang et al.2022 · 17 citationsarXiv
mSLAM: Massively multilingual joint pre-training for speech and text2202.01374v1 · Ankur Bapna, Colin Cherry, Yu Zhang et al.2022 · 59 citationsarXiv
SLAM: A Unified Encoder for Speech and Language Modeling via Speech-Text Joint Pre-Training2110.10329v1 · Ankur Bapna, Yu-an Chung, Nan Wu et al.2021 · 49 citationsarXiv
Improving Multilingual Models with Language-Clustered Vocabularies2010.12777v1 · Hyung Won Chung, Dan Garrette, Kiat Chuan Tan et al.2020 · 46 citationsarXiv
Finding Fast Transformers: One-Shot Neural Architecture Search by Component Composition2008.06808v1 · Henry Tsai, Jayden Ooi, Chun-Sung Ferng et al.2020 · 12 citationsarXiv
Evaluating the Cross-Lingual Effectiveness of Massively Multilingual Neural Machine Translation1909.00437v1 · Aditya Siddhant, Melvin Johnson, Henry Tsai et al.2019 · 70 citationsAAAI 2020
Small and Practical BERT Models for Sequence Labeling1909.00100v1 · Henry Tsai, Jason Riesa, Melvin Johnson et al.2019 · 137 citationsarXiv
A Fast, Compact, Accurate Model for Language Identification of Codemixed Text1810.04142v1 · Yuan Zhang, Jason Riesa, Daniel Gillick et al.2018 · 39 citationsarXiv
Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation1609.08144v2 · Yonghui Wu, Mike Schuster, Zhifeng Chen et al.2016 · 5,573 citationsarXivon Valency
Career total: 33 works. 19 are in this corpus.
Profile built from the corpus for this byline.
Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.