paper-with-me

Scene Parsing

2개 벤치마크 · 논문 216편 · 이 태스크의 논문 보기 →

Benchmarks

PGDP5K

결과 4개

Cityscapes test

결과 2개

Most implemented

Pyramid Scene Parsing Network

2016-12-04 · 구현 67개

Panoptic Segmentation

2018-01-03 · 구현 9개

Papers

Engine-Native Editable 3D World Reconstruction with Objects and Lighting

2026-07-23 · Junhao Chen, Xinghao Chen, Henghaofan Zhang, Zihao Qiao 외 arxiv

Editable 3D scene creation requires object instances and lights that can be inspected, moved, and imported into standard engines, yet existing single-image methods largely stop at room-scale geometry, baked/global illumi…

Scene Parsing

R2RDreamer: 3D-aware Data Augmentation for Spatially-generalized 2D Manipulation Policies

2026-06-15 · Xiuwei Xu, Haowen Sun, Angyuan Ma, Yiwei Zhang 외 arxiv

Spatial generalization is critical for imitation-learned manipulation policies, but achieving it typically requires scaling demonstrations across diverse object poses, robot configurations, and camera viewpoints. Data au…

Data AugmentationScene Parsing

PhysScene: A Scene Graph Dataset for Scientific Visual Reasoning in Physics Experiments

2026-06-08 · Minghao Zou, Qingtian Zeng, Shangkun Liu, Yanda Meng 외 arxiv

Scene Graphs (SGs) provide structured representations of visual scenes by modeling objects and their pairwise relationships. Despite recent progress, existing datasets primarily focus on generic natural contexts, leaving…

Relational ReasoningVisual ReasoningScene Parsing

Unsupervised Collaborative Domain Adaptation for Driving Scene Parsing

2026-06-01 · Jiahe Fan, Shaolong Shu, Mingjian Sun, Tiehua Zhang 외 arxiv

Reliable driving scene parsing is a fundamental capability for autonomous vehicles operating in open and dynamic driving environments. However, adapting perception models to new deployment domains remains challenging bec…

Unsupervised Domain AdaptationAutonomous VehiclesScene Parsing

SWARD: Stochastic Window-Attention-Based Relational Distillation for Cross-Architectural Semantic Segmentation

2026-05-31 · Aditya Makineni, Qing Tian arxiv

Large-scale vision foundation models have driven substantial gains on dense prediction tasks such as semantic segmentation, but their size makes deployment impractical in resource-constrained settings, motivating knowled…

Medical Image SegmentationKnowledge DistillationSemantic SegmentationScene Parsing

SceneParser: Hierarchical Scene Parsing for Visual Semantics Understanding

2026-05-14 · Pengxin Xu, Xincheng Lin, Luping Xiao, Qing Jiang 외 arxiv

General scene perception has progressed from object recognition toward open-vocabulary grounding, part localization, and affordance prediction. Yet these capabilities are often realized as isolated predictions that local…

Scene UnderstandingObject RecognitionScene Parsing

전체 216편 보기 →