paper-with-me

홈 › Papers

Bisimulation metric for Model Predictive Control

2024-10-06 · Yutaka Shimizu, Masayoshi Tomizuka

Model-based reinforcement learning has shown promise for improving sample efficiency and decision-making in complex environments. However, existing methods face challenges in training stability, robustness to noise, and computational efficiency. In this paper, we propose Bisimulation Metric for Model Predictive Control (BS-MPC), a novel approach that incorporates bisimulation metric loss in its objective function to directly optimize the encoder. This time-step-wise direct optimization enables the learned encoder to extract intrinsic information from the original state space while discarding irrelevant details and preventing the gradients and errors from diverging. BS-MPC improves training stability, robustness against input noise, and computational efficiency by reducing training time. We evaluate BS-MPC on both continuous control and image-based tasks from the DeepMind Control Suite, demonstrating superior performance and robustness compared to state-of-the-art baseline methods.

📄 PDF Abstract BibTeX arXiv:2410.04553

Code (1)

purewater0901/BSMPC 공식 구현 pytorch

Tasks

Computational Efficiencycontinuous-controlContinuous ControlDecision MakingmodelModel-based Reinforcement LearningModel Predictive Control

Similar Papers 제목 키워드 기반

Efficient Embedding of Semantic Similarity in Control Policies via Entangled Bisimulation

2022-01-28 · Martin Bertran, Walter Talbott, Nitish Srivastava, Joshua Susskind

Learning generalizeable policies from visual input in the presence of visual distractions is a challenging problem in reinforcement learning. Recently, there has been renewed interest in bisimulation metrics as a tool to…

Data AugmentationReinforcement Learning (RL)Semantic SimilaritySemantic Textual Similarity

Approximate Policy Iteration with Bisimulation Metrics

2022-02-06 · Mete Kemertas, Allan Jepson

Bisimulation metrics define a distance measure between states of a Markov decision process (MDP) based on a comparison of reward sequences. Due to this property they provide theoretical guarantees in value function appro…

Continuous ControlRepresentation Learning

Learning Action-based Representations Using Invariance

2024-03-25 · Max Rudolph, Caleb Chuck, Kevin Black, Misha Lvovsky 외

Robust reinforcement learning agents using high-dimensional observations must be able to identify relevant state features amidst many exogeneous distractors. A representation that captures controllability identifies thes…

Task-Aware Exploration via a Predictive Bisimulation Metric

2026-02-21 · Dayang Liang, Ruihan Liu, Lipeng Wan, Yunlong Liu 외 arxiv

Accelerating exploration in visual reinforcement learning under sparse rewards remains challenging due to the substantial task-irrelevant variations. Despite advances in intrinsic exploration, many methods either assume …

Reinforcement Learning

Revisiting Bisimulation Metric for Robust Representations in Reinforcement Learning

2025-07-24 · Leiji Zhang, Zeyu Wang, Xin Li, Yao-Hui Li arxiv

Bisimulation metric has long been regarded as an effective control-related representation learning technique in various reinforcement learning tasks. However, in this paper, we identify two main issues with the conventio…

Representation LearningReinforcement Learning