paper-with-me

Papers

Safe Approximate Dynamic Programming Via Kernelized Lipschitz Estimation

2019-07-03 · Ankush Chakrabarty, Devesh K. Jha, Gregery T. Buzzard, Yebin Wang, Kyriakos Vamvoudakis

We develop a method for obtaining safe initial policies for reinforcement learning via approximate dynamic programming (ADP) techniques for uncertain systems evolving with discrete-time dynamics. We employ kernelized Lipschitz estimation and semidefinite programming for computing admissible initial control policies with provably high probability. Such admissible controllers enable safe initialization and constraint enforcement while providing exponential stability of the equilibrium of the closed-loop system.

📄 PDF Abstract BibTeX arXiv:1907.02151

Code (0)

등록된 구현이 없습니다.

Tasks

reinforcement-learningReinforcement LearningReinforcement Learning (RL)

Similar Papers 제목 키워드 기반

A Multi-Fidelity Bayesian Approach to Safe Controller Design

2023-04-21 · Ethan Lau, Vaibhav Srivastava, Shaunak D. Bopardikar

Safely controlling unknown dynamical systems is one of the biggest challenges in the field of control. Oftentimes, an approximate model of a system's dynamics exists which provides beneficial information for the selectio…

Scalable Autonomous Vehicle Safety Validation through Dynamic Programming and Scene Decomposition

2020-04-14 · Anthony Corso, Ritchie Lee, Mykel J. Kochenderfer

An open question in autonomous driving is how best to use simulation to validate the safety of autonomous vehicles. Existing techniques rely on simulated rollouts, which can be inefficient for finding rare failure events…

Autonomous DrivingAutonomous VehiclesOpen-Ended Question Answering

Quadratic Programming for Continuous Control of Safety-Critical Multi-Agent Systems Under Uncertainty

2022-11-30 · Si Wu, Tengfei Liu, Magnus Egerstedt, Zhong-Ping Jiang

This paper studies the control problem for safety-critical multi-agent systems based on quadratic programming (QP). Each controlled agent is modeled as a cascade connection of an integrator and an uncertain nonlinear act…

Collision Avoidancecontinuous-controlContinuous Control

Scalable synthesis of safety certificates from data with application to learning-based control

2017-11-30 · Kim P. Wabersich, Melanie N. Zeilinger

The control of complex systems faces a trade-off between high performance and safety guarantees, which in particular restricts the application of learning-based methods to safety-critical systems. A recently proposed fra…

Approximate Dynamic Programming For Linear Systems with State and Input Constraints

2019-06-26 · Ankush Chakrabarty, Rien Quirynen, Claus Danielson, Weinan Gao

Enforcing state and input constraints during reinforcement learning (RL) in continuous state spaces is an open but crucial problem which remains a roadblock to using RL in safety-critical applications. This paper leverag…

reinforcement-learningReinforcement LearningReinforcement Learning (RL)