Natural Language Queries
1개 벤치마크 · 논문 465편 · 이 태스크의 논문 보기 →
Benchmarks
Ego4D
Most implemented
CodeSearchNet Challenge: Evaluating the State of Semantic Code Search
TALL: Temporal Activity Localization via Language Query
QVHighlights: Detecting Moments and Highlights in Videos via Natural Language Queries
V3CTRON | Data Retrieval & Access System For Flexible Semantic Search & Retrieval Of Proprietary Document Collections Using Natural Language Queries.
UMT: Unified Multi-modal Transformers for Joint Video Moment Retrieval and Highlight Detection
TempoQR: Temporal Question Reasoning over Knowledge Graphs
Papers
Where to Look Matters: Learning Influential Views for VLM-based 3D Visual Grounding
Recent zero-shot 3D visual grounding methods leverage vision-language models (VLMs) to localize objects in 3D scenes from natural language queries. However, these methods typically rely on heuristic rules to select which…
Natural Language QueriesVisual GroundingAutomated Testing of LLM-Based Post Hoc Explainers Using Model Checking as an Oracle
Large language models (LLMs) are used as post hoc explainers of sequential decision-making policies, producing natural-language explanations of why an action was chosen. However, LLMs often generate plausible but incorre…
Natural Language QueriesBALMS: Benchmarking Agentic LLMs for Longitudinal Mental Health Sensing
Mental health assessment relies on episodic self-report scales, which convert subjective states such as stress into numerical scores but provide only sparse snapshots of wellbeing. Wearable devices offer longitudinal beh…
Natural Language QueriesID-VTG: Image-Disambiguated Video Temporal Grounding
Video Temporal Grounding (VTG) faces significant challenges when natural language queries must distinguish between multiple events involving visually similar entities, particularly when relying on fine-grained visual att…
Natural Language QueriesA Multi-Agent Platform for Automated Enterprise Analytics and Insight Generation
This paper proposes a multi-agent framework built on CrewAI [1] for conversational business intelligence. Five specialized AI agents operate in a sequential pipeline to process natural language queries, retrieve and anal…
Natural Language QueriesC-GAP: Class-Aware and Online Prompting Improves Vision-Language Models on Imbalanced Classes
Safety-critical perception systems must reliably detect rare object classes within small label spaces, a setting that long-tailed detection methods, designed for hundreds of classes with dense annotation, fundamentally d…
Natural Language Queries