EG
Edouard Grave
cs.CLcs.LGcs.AIstat.MLcs.CVcs.IRcs.SDeess.ASBreast cancerBreast Neoplasms
On Valency
published · living versionsW_dby3ngaf·v1 · currentpublished
FastText.zip: Compressing text classification models
with Armand Joulin, Piotr Bojanowski, Matthijs Douze, Hérve Jégou +1
1 version
Preprints & journals
66 papers in the corpus · 2011–2026To Each Language Its Tokenizer: Modular Tokenizers for Efficient Multilingual LLMs2609.15528v1 · Franck Signe, Hippolyte Pilchen, Francois Yvon et al.2026 · 0 citationsarXiv
ARC-Encoder: learning compressed text representations for large language models2510.20535v2 · Hippolyte Pilchen, Edouard Grave, Patrick P'erez2025 · 0 citationsTransactions on Machine Learning Research 2026 (https://openreview.net/forum?id=lU1P9dsqfn)
Understanding Data Temporality Impact on Large Language Models Pre-training2605.22769v2 · Hippolyte Pilchen, Romain Fabre, Franck Signe Talla et al.2026 · 0 citationsarXiv
CASA: Cross-Attention over Self-Attention for Efficient Vision-Language Fusion2512.19535v2 · Moritz Bohle, Am'elie Royer, Juliette Marrie et al.2025 · 0 citationsarXiv
Streaming Sequence-to-Sequence Learning with Delayed Streams Modeling2509.08753v2 · Neil Zeghidour, Eugene Kharitonov, Manu Orsini et al.2025 · 1 citationarXiv
Neutral Residues: Revisiting Adapters for Model Extension2410.02744v3 · Franck Signe Talla, Edouard Grave, Herv'e J'egou2024 · 0 citationsarXiv
High-Fidelity Simultaneous Speech-To-Speech Translation2502.03382v2 · Tom Labiausse, Laurent Mazar'e, Edouard Grave et al.2025 · 0 citationsarXiv
Moshi: a speech-text foundation model for real-time dialogue2410.00037v2 · Alexandre D'efossez, Laurent Mazar'e, Manu Orsini et al.2024 · 8 citationsarXiv
Time Sensitive Knowledge Editing through Efficient Finetuning2406.04496v2 · Xiou Ge, Ali Mousavi, Edouard Grave et al.2024 · 0 citationsarXiv
PaSS: Parallel Speculative Sampling2311.13581v1 · Giovanni Monea, Armand Joulin, Edouard Grave2023 · 2 citationsarXiv
ResMLP: Feedforward Networks for Image Classification With Data-Efficient Training.36094972 · Touvron, Hugo, Bojanowski, Piotr, Caron, Mathilde et al.2023 · 814 citationsIEEE transactions on pattern analysis and machine intelligence. 2023;45(4):5314-5321
LLaMA: Open and Efficient Foundation Language Models2302.13971v1 · Hugo Touvron, Thibaut Lavril, Gautier Izacard et al.2023 · 3,982 citationsarXiv
Augmented Language Models: a Survey2302.07842v1 · Gr'egoire Mialon, Roberto Dessi, Maria Lomeli et al.2023 · 144 citationsarXiv
Atlas: Few-shot Learning with Retrieval Augmented Language Models2208.03299v3 · Gautier Izacard, Patrick Lewis, Maria Lomeli et al.2022 · 200 citationsarXiv
EditEval: An Instruction-Based Benchmark for Text Improvements2209.13331v1 · Jane Dwivedi-Yu, Timo Schick, Zhengbao Jiang et al.2022 · 9 citationsarXiv
Unsupervised Dense Information Retrieval with Contrastive Learning2112.09118v4 · Gautier Izacard, Mathilde Caron, Lucas Hosseini et al.2021 · 151 citationsarXiv
PEER: A Collaborative Language Model2208.11663v1 · Timo Schick, Jane Dwivedi-Yu, Zhengbao Jiang et al.2022 · 44 citationsarXiv
Distilling Knowledge from Reader to Retriever for Question Answering2012.04584v2 · Gautier Izacard, Edouard Grave2020 · 50 citationsarXiv
Improving Wikipedia Verifiability with AI2207.06220v1 · Fabio Petroni, Samuel Broscheit, Aleksandra Piktus et al.2022 · 19 citationsarXiv
Flashlight: Enabling Innovation in Tools for Machine Learning2201.12465v2 · Jacob Kahn, Vineel Pratap, Tatiana Likhomanenko et al.2022 · 14 citationsarXiv
The Web Is Your Oyster - Knowledge-Intensive NLP against a Very Large Web Corpus2112.09924v2 · Aleksandra Piktus, Fabio Petroni, Vladimir Karpukhin et al.2021 · 23 citationsarXiv
Are Large-scale Datasets Necessary for Self-Supervised Pre-training?2112.10740v1 · Alaaeldin El-Nouby, Gautier Izacard, Hugo Touvron et al.2021 · 18 citationsarXiv
NeurIPS 2020 EfficientQA Competition: Systems, Analyses and Lessons Learned2101.00133v2 · Sewon Min, Jordan Boyd-Graber, Chris Alberti et al.2021 · 65 citationsarXiv
ResMLP: Feedforward networks for image classification with data-efficient training2105.03404v2 · Hugo Touvron, Piotr Bojanowski, Mathilde Caron et al.2021 · 814 citationsarXiv
Training with Quantization Noise for Extreme Model Compression2004.07320v3 · Angela Fan, Pierre Stock, Benjamin Graham et al.2020 · 114 citationsarXiv
Leveraging Passage Retrieval with Generative Models for Open Domain Question Answering2007.01282v2 · Gautier Izacard, Edouard Grave2020 · 1,026 citationsarXiv
Addressing Some Limitations of Transformers with Feedback Memory2002.09402v3 · Angela Fan, Thibaut Lavril, Edouard Grave et al.2020 · 30 citationsarXiv
A Memory Efficient Baseline for Open Domain Question Answering2012.15156v1 · Gautier Izacard, Fabio Petroni, Lucas Hosseini et al.2020 · 28 citationsarXiv
Beyond English-Centric Multilingual Machine Translation2010.11125v1 · Angela Fan, Shruti Bhosale, Holger Schwenk et al.2020 · 485 citationsarXiv
Self-training Improves Pre-training for Natural Language Understanding2010.02194v1 · Jingfei Du, Edouard Grave, Beliz Gunel et al.2020 · 138 citationsarXiv
End-to-end ASR: from Supervised to Semi-Supervised Learning with Modern Architectures1911.08460v3 · Gabriel Synnaeve, Qiantong Xu, Jacob Kahn et al.2019 · 164 citationsarXiv
CCMatrix: Mining Billions of High-Quality Parallel Sentences on the WEB1911.04944v2 · Holger Schwenk, Guillaume Wenzek, Sergey Edunov et al.2019 · 139 citationsarXiv
Unsupervised Cross-lingual Representation Learning at Scale1911.02116v2 · Alexis Conneau, Kartikay Khandelwal, Naman Goyal et al.2019 · 5,452 citationsarXiv
Depth-Adaptive Transformer1910.10073v4 · Maha Elbayad, Jiatao Gu, Edouard Grave et al.2019 · 59 citationsarXiv
CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data1911.00359v2 · Guillaume Wenzek, Marie-Anne Lachaux, Alexis Conneau et al.2019 · 314 citationsarXiv
Don't Forget the Long Tail! A Comprehensive Analysis of Morphological Generalization in Bilingual Lexicon Induction1909.02855v2 · Paula Czarnowska, Sebastian Ruder, Edouard Grave et al.2019 · 37 citationsarXiv
Updating Pre-trained Word Vectors and Text Classifiers using Monolingual Alignment1910.06241v2 · Piotr Bojanowski, Onur Celebi, Tomas Mikolov et al.2019 · 7 citationsarXiv
Reducing Transformer Depth on Demand with Structured Dropout1909.11556v1 · Angela Fan, Edouard Grave, Armand Joulin2019 · 375 citationsarXiv
Adaptive Attention Span in Transformers1905.07799v2 · Sainbayar Sukhbaatar, Edouard Grave, Piotr Bojanowski et al.2019 · 303 citationsarXiv
Predicting delayed cerebral ischemia after subarachnoid hemorrhage using physiological time series data.29556884 · Park, Soojin, Megjhani, Murad, Frey, Hans-Peter et al.2019 · 31 citationsJournal of clinical monitoring and computing. 2019;33(1):95-105
Can You Tell Me How to Get Past Sesame Street? Sentence-Level Pretraining Beyond Language Modeling1812.10860v5 · Alex Wang, Jan Hula, Patrick Xia et al.2018 · 102 citationsarXiv
Augmenting Self-attention with Persistent Memory1907.01470v1 · Sainbayar Sukhbaatar, Edouard Grave, Guillaume Lample et al.2019 · 46 citationsarXiv
Unsupervised Hyperalignment for Multilingual Word Embeddings1811.01124v3 · Jean Alaux, Edouard Grave, Marco Cuturi et al.2018 · 63 citationsarXiv
Misspelling Oblivious Word Embeddings1905.09755v1 · Bora Edizel, Aleksandra Piktus, Piotr Bojanowski et al.2019 · 0 citationsarXiv
Lightweight Adaptive Mixture of Neural and N-gram Language Models1804.07705v2 · Anton Bakhtin, Arthur Szlam, Marc'Aurelio Ranzato et al.2018 · 8 citationsarXiv
Loss in Translation: Learning Bilingual Word Mapping with a Retrieval Criterion1804.07745v3 · Armand Joulin, Piotr Bojanowski, Tomas Mikolov et al.2018 · 376 citationsarXiv
Unsupervised Alignment of Embeddings with Wasserstein Procrustes1805.11222v1 · Edouard Grave, Armand Joulin, Quentin Berthet2018 · 37 citationsarXiv
Learning Word Vectors for 157 Languages1802.06893v2 · Edouard Grave, Piotr Bojanowski, Prakhar Gupta et al.2018 · 185 citationsarXiv
Colorless green recurrent networks dream hierarchically1803.11138v1 · Kristina Gulordava, Piotr Bojanowski, Edouard Grave et al.2018 · 504 citationsarXiv
Efficient Large-Scale Multi-Modal Classification1802.02892v1 · D. Kiela, E. Grave, A. Joulin et al.2018 · 180 citationsarXiv
Career total: 102 works. 66 are in this corpus.Showing the 50 most recent.
Profile built from the corpus for this byline.
Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.