Scene Parsing
2개 벤치마크 · 논문 216편 · 이 태스크의 논문 보기 →
Benchmarks
PGDP5K
Cityscapes test
Most implemented
Pyramid Scene Parsing Network
Semantic Understanding of Scenes through the ADE20K Dataset
Panoptic Segmentation
Deep Dual-resolution Networks for Real-time and Accurate Semantic Segmentation of Road Scenes
OCNet: Object Context Network for Scene Parsing
Papers
Engine-Native Editable 3D World Reconstruction with Objects and Lighting
Editable 3D scene creation requires object instances and lights that can be inspected, moved, and imported into standard engines, yet existing single-image methods largely stop at room-scale geometry, baked/global illumi…
Scene ParsingR2RDreamer: 3D-aware Data Augmentation for Spatially-generalized 2D Manipulation Policies
Spatial generalization is critical for imitation-learned manipulation policies, but achieving it typically requires scaling demonstrations across diverse object poses, robot configurations, and camera viewpoints. Data au…
Data AugmentationScene ParsingPhysScene: A Scene Graph Dataset for Scientific Visual Reasoning in Physics Experiments
Scene Graphs (SGs) provide structured representations of visual scenes by modeling objects and their pairwise relationships. Despite recent progress, existing datasets primarily focus on generic natural contexts, leaving…
Relational ReasoningVisual ReasoningScene ParsingUnsupervised Collaborative Domain Adaptation for Driving Scene Parsing
Reliable driving scene parsing is a fundamental capability for autonomous vehicles operating in open and dynamic driving environments. However, adapting perception models to new deployment domains remains challenging bec…
Unsupervised Domain AdaptationAutonomous VehiclesScene ParsingSWARD: Stochastic Window-Attention-Based Relational Distillation for Cross-Architectural Semantic Segmentation
Large-scale vision foundation models have driven substantial gains on dense prediction tasks such as semantic segmentation, but their size makes deployment impractical in resource-constrained settings, motivating knowled…
Medical Image SegmentationKnowledge DistillationSemantic SegmentationScene ParsingSceneParser: Hierarchical Scene Parsing for Visual Semantics Understanding
General scene perception has progressed from object recognition toward open-vocabulary grounding, part localization, and affordance prediction. Yet these capabilities are often realized as isolated predictions that local…
Scene UnderstandingObject RecognitionScene Parsing