paper-with-me

Papers

Generalization Bounds for (Wasserstein) Robust Optimization

2021-12-01 · NeurIPS 2021 12 · Yang An, Rui Gao

(Distributionally) robust optimization has gained momentum in machine learning community recently, due to its promising applications in developing generalizable learning paradigms. In this paper, we derive generalization bounds for robust optimization and Wasserstein robust optimization for Lipschitz and piecewise Hölder smooth loss functions under both stochastic and adversarial setting, assuming that the underlying data distribution satisfies transportation-information inequalities. The proofs are built on new generalization bounds for variation regularization (such as Lipschitz or gradient regularization) and its connection with robustness.

📄 PDF Abstract BibTeX

Code (0)

등록된 구현이 없습니다.

Tasks

Generalization Bounds

Similar Papers 제목 키워드 기반

On Generalization and Regularization via Wasserstein Distributionally Robust Optimization

2022-12-12 · Qinyu Wu, Jonathan Yu-Meng Li, Tiantian Mao

Wasserstein distributionally robust optimization (DRO) has gained prominence in operations research and machine learning as a powerful method for achieving solutions with favorable out-of-sample performance. Two compelli…

Generalization Bounds

PAC-Bayesian Generalization Bounds for Adversarial Generative Models

2023-02-17 · Sokhna Diarra Mbacke, Florence Clerc, Pascal Germain

We extend PAC-Bayesian theory to generative models and develop generalization bounds for models based on the Wasserstein distance and the total variation distance. Our first result on the Wasserstein distance assumes the…

Dimensionality ReductionGeneralization Bounds

Generalization Bounds on Optimal Control for Transformer Training and Wasserstein Distributional Robustness

2026-07-30 · Kağan Akman, Naci Saldi, Serdar Yüksel arxiv

We derive finite-sample generalization bounds for Transformers trained with dynamic programming recursions. Building on the doubly lifted, measure-valued formulation of Transformer dynamics, we view data sets as probabil…

Minimax Statistical Learning with Wasserstein Distances

2017-05-22 · NeurIPS 2018 12 · Jaeho Lee, Maxim Raginsky

As opposed to standard empirical risk minimization (ERM), distributionally robust optimization aims to minimize the worst-case risk over a larger ambiguity set containing the original empirical distribution of the traini…

Domain AdaptationGeneralization Bounds

Tighter Expected Generalization Error Bounds via Convexity of Information Measures

2022-02-24 · Gholamali Aminian, Yuheng Bu, Gregory Wornell, Miguel Rodrigues

Generalization error bounds are essential to understanding machine learning algorithms. This paper presents novel expected generalization error upper bounds based on the average joint distribution between the output hypo…