paper-with-me

Papers

IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation

2026-05-14 · Shijie Lian, Bin Yu, Xiaopeng Lin, Zhaolong Shen, Laurence Tianruo Yang, Yurun Jin, Haishan Liu, Changti Wu, Hang Yuan, Cong Huang, Kai Chen arxiv

Robot imitation data are often multimodal: similar visual-language observations may be followed by different action chunks because human demonstrators act with different short-horizon intents, task phases, or recent context. Existing frame-conditioned VLA policies infer each chunk from the current observation and instruction alone, so under partial observability they may resample different intents across adjacent replanning steps, leading to inter-chunk conflict and unstable execution. We introduce IntentVLA, a history-conditioned VLA framework that encodes recent visual observations into a compact short-horizon intent representation and uses it to condition chunk generation. We further introduce AliasBench, a 12-task ambiguity-aware benchmark on RoboTwin2 with matched training data and evaluation environments that isolate short-horizon observation aliasing. Across AliasBench, SimplerEnv, LIBERO, and RoboCasa, IntentVLA improves rollout stability and outperforms strong VLA baselines

📄 PDF Abstract BibTeX arXiv:2605.14712

Code (0)

등록된 구현이 없습니다.

Tasks

Robot Manipulation

Similar Papers 제목 키워드 기반

R3-REC: Reasoning-Driven Recommendation via Retrieval-Augmented LLMs over Multi-Granular Interest Signals

2026-03-14 · Yuchen Miao, Mingxuan Cui, Yitong Zhu, Yu Wang 외 arxiv

This paper addresses two persistent challenges in sequential recommendation: (i) evidence insufficiency-cold-start sparsity together with noisy, length-varying item texts; and (ii) opaque modeling of dynamic, multi-facet…

Sequential Recommendation

Long-term Traffic Simulation via Structured Autoregressive Modeling

2026-06-30 · Lingyu Xiao, Zexin Feng, Xintao Yan arxiv

Interactive traffic simulation is a vital world model for autonomous driving. A central challenge in long-horizon simulation is modeling sustained multi-agent interactions, which is further exacerbated by dynamic token c…

Autonomous Driving

HYPER: Learned Hybrid Trajectory Prediction via Factored Inference and Adaptive Sampling

2021-10-05 · Xin Huang, Guy Rosman, Igor Gilitschenski, Ashkan Jasour 외

Modeling multi-modal high-level intent is important for ensuring diversity in trajectory prediction. Existing approaches explore the discrete nature of human intent before predicting continuous trajectories, to improve a…

DiversityPredictionTrajectory Prediction

LifeSim: Long-Horizon User Life Simulator for Personalized Assistant Evaluation

2026-03-12 · Feiyu Duan, Xuanjing Huang, Zhongyu Wei arxiv

The rapid advancement of large language models (LLMs) has accelerated progress toward universal AI assistants. However, existing benchmarks for personalized assistants remain misaligned with real-world user-assistant int…

Learning Parametric-Output HMMs with Two Aliased States

2015-02-07 · Roi Weiss, Boaz Nadler

In various applications involving hidden Markov models (HMMs), some of the hidden states are aliased, having identical output distributions. The minimality, identifiability and learnability of such aliased HMMs have been…

Vocal Bursts Valence Prediction