FO

Francesco Orabona

cs.LGstat.MLmath.OCcs.AIcs.CLmath.PRcs.CRcs.CVcs.CYcs.DC

On Valency

published · living versions

Preprints & journals

73 papers in the corpus · 2008–2026
Global PIQA: Evaluating Commonsense Reasoning Across 100+ Languages and Cultures2510.24081v2 · Tyler A. Chang, Catherine Arnett, Abdelrahman Sadallah et al.2025 · 0 citationsarXiv
Nonparametric Teaching of Attention Learners2602.20461v1 · Chen Zhang, Jianghui Wang, Bingyang Cheng et al.2026 · 0 citationsarXiv
Online Conformal Prediction via Universal Portfolio Algorithms2602.03168v1 · Tuo Liu, Edgar Dobriban, Francesco Orabona2026 · 0 citationsarXiv
Dynamic Regret Reduces to Kernelized Static Regret2507.05478v2 · Andrew Jacobsen, Alessandro Rudi, Francesco Orabona et al.2025 · 0 citationsarXiv
A Best-of-Both-Worlds Proof for Tsallis-INF without Fenchel Conjugates2511.11211v1 · Wei-Cheng Lee, Francesco Orabona2025 · 0 citationsarXiv
STaR-Bets: Sequential Target-Recalculating Bets for Tighter Confidence Intervals2505.22422v2 · V'aclav Vor'acek, Francesco Orabona2025 · 0 citationsarXiv
Beyond the Ideal: Analyzing the Inexact Muon Update2510.19933v1 · Egor Shulgin, Sultan AlRashed, Francesco Orabona et al.2025 · 0 citationsarXiv
Optimal Stochastic Non-smooth Non-convex Optimization through Online-to-Non-convex Conversion2302.03775v3 · Ashok Cutkosky, Harsh Mehta, Francesco Orabona2023 · 6 citationsarXiv
Position: Machine Learning Conferences Should Establish a "Refutations and Critiques" Track2506.19882v3 · Rylan Schaeffer, Joshua Kazdan, Yegor Denisov-Blanch et al.2025 · 0 citationsarXiv
New Lower Bounds for Stochastic Non-Convex Optimization through Divergence Decomposition2502.14060v2 · El Mehdi Saad, Wei-Cheng Lee, Francesco Orabona2025 · 0 citationsarXiv
Dual Averaging Converges for Nonconvex Smooth Stochastic Optimization2505.21394v1 · Tuo Liu, El Mehdi Saad, Wojciech Kot\lowski et al.2025 · 0 citationsarXiv
ATA: Adaptive Task Allocation for Efficient Resource Management in Distributed Machine Learning2502.00775v2 · Artavazd Maranjyan, El Mehdi Saad, Peter Richt'arik et al.2025 · 0 citationsarXiv
A Unified Theoretical Analysis of Private and Robust Offline Alignment: from RLHF to DPO2505.15694v1 · Xingyu Zhou, Yulian Wu, Francesco Orabona2025 · 0 citationsarXiv
Self-Directed Learning of Convex Labelings on Graphs2409.01428v2 · Georgy Sokolov, Maximilian Thiessen, Margarita Akhmejanova et al.2024 · 0 citationsarXiv
An Equivalence Between Static and Dynamic Regret Minimization2406.01577v2 · Andrew Jacobsen, Francesco Orabona2024 · 0 citationsarXiv
Better-than-KL PAC-Bayes Bounds2402.09201v2 · Ilja Kuzborskij, Kwang-Sung Jun, Yulian Wu et al.2024 · 0 citationsarXiv
Towards Training Without Depth Limits: Batch Normalization Without Gradient Explosion2310.02012v1 · Alexandru Meterez, Amir Joudaki, Francesco Orabona et al.2023 · 0 citationsarXiv
Normalized Gradients for All2308.05621v1 · Francesco Orabona2023 · 0 citationsarXiv
Implicit Interpretation of Importance Weight Aware Updates2307.11955v1 · Keyi Chen, Francesco Orabona2023 · 0 citationsarXiv
Generalized Implicit Follow-The-Regularized-Leader2306.00201v1 · Keyi Chen, Francesco Orabona2023 · 0 citationsarXiv
Tighter PAC-Bayes Bounds Through Coin-Betting2302.05829v1 · Kyoungseok Jang, Kwang-Sung Jun, Ilja Kuzborskij et al.2023 · 2 citationsarXiv
Robustness to Unbounded Smoothness of Generalized SignSGD2208.11195v1 · Michael Crawshaw, Mingrui Liu, Francesco Orabona et al.2022 · 8 citationsarXiv
On the Last Iterate Convergence of Momentum Methods2102.07002v3 · Xiaoyu Li, Mingrui Liu, Francesco Orabona2021 · 1 citationarXiv
Better Parameter-free Stochastic Optimization with ODE Updates for Coin-Betting2006.07507v3 · Keyi Chen, John Langford, Francesco Orabona2020 · 3 citationsarXiv
Implicit Parameter-free Online Learning with Truncated Linear Models2203.10327v1 · Keyi Chen, Ashok Cutkosky, Francesco Orabona2022 · 1 citationarXiv
On the Initialization for Convex-Concave Min-max Problems2103.00284v2 · Mingrui Liu, Francesco Orabona2021 · 0 citationsarXiv
Understanding AdamW through Proximal Methods and Scale-Freeness2202.00089v1 · Zhenxun Zhuang, Mingrui Liu, Ashok Cutkosky et al.2022 · 37 citationsarXiv
Minimax Optimal Quantile and Semi-Adversarial Regret via Root-Logarithmic Regularizers2110.14804v2 · Jeffrey Negrea, Blair Bilodeau, Nicolo Campolongo et al.2021 · 0 citationsNeurIPS 2021
Online Learning with Optimism and Delay2106.06885v4 · Genevieve Flaspohler, Francesco Orabona, Judah Cohen et al.2021 · 0 citationsarXiv
A Second look at Exponential and Cosine Step Sizes: Simplicity, Adaptivity, and Performance2002.05273v4 · Xiaoyu Li, Zhenxun Zhuang, Francesco Orabona2020 · 14 citationsarXiv
A closer look at temporal variability in dynamic online learning2102.07666v1 · Nicolo Campolongo, Francesco Orabona2021 · 3 citationsarXiv
Adam$^+$: A Stochastic Method with Adaptive Variance Reduction2011.11985v1 · Mingrui Liu, Wei Zhang, Francesco Orabona et al.2020 · 11 citationsarXiv
Temporal Variability in Implicit Online Learning2006.07503v2 · Nicolo Campolongo, Francesco Orabona2020 · 7 citationsarXiv
A High Probability Analysis of Adaptive SGD with Momentum2007.14294v1 · Xiaoyu Li, Francesco Orabona2020 · 13 citationsarXiv
Momentum-Based Variance Reduction in Non-Convex SGD1905.10018v3 · Ashok Cutkosky, Francesco Orabona2019 · 30 citationsarXiv
Parameter-Free Locally Differentially Private Stochastic Subgradient Descent1911.09564v1 · Kwang-Sung Jun, Francesco Orabona2019 · 2 citationsarXiv
Parameter-Free Online Convex Optimization with Sub-Exponential Noise1902.01500v3 · Kwang-Sung Jun, Francesco Orabona2019 · 18 citationsarXiv
Surrogate Losses for Online Learning of Stepsizes in Stochastic Non-Convex Optimization1901.09068v2 · Zhenxun Zhuang, Ashok Cutkosky, Francesco Orabona2019 · 0 citationsarXiv
Kernel Truncated Randomized Ridge Regression: Optimal Rates and Low Noise Acceleration1905.10680v1 · Kwang-Sung Jun, Ashok Cutkosky, Francesco Orabona2019 · 11 citationsarXiv
On the Convergence of Stochastic Gradient Descent with Adaptive Stepsizes1805.08114v3 · Xiaoyu Li, Francesco Orabona2018 · 137 citationsarXiv
Black-Box Reductions for Parameter-free Online Learning in Banach Spaces1802.06293v2 · Ashok Cutkosky, Francesco Orabona2018 · 8 citationsarXiv
Career total: 148 works. 73 are in this corpus.Showing the 50 most recent.

Profile built from the corpus for this byline.

Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.