Logical Reasoning Question Answering
1개 벤치마크 · 논문 4편 · 이 태스크의 논문 보기 →
Benchmarks
ReClor
Most implemented
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
RussianSuperGLUE: A Russian Language Understanding Evaluation Benchmark
ReClor: A Reading Comprehension Dataset Requiring Logical Reasoning
Papers
LLMI3D: Empowering LLM with 3D Perception from a Single 2D Image
Recent advancements in autonomous driving, augmented reality, robotics, and embodied intelligence have necessitated 3D perception algorithms. However, current 3D perception methods, particularly small models, struggle wi…
Autonomous DrivingLogical ReasoningLogical Reasoning Question Answeringparameter-efficient fine-tuning+1Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
Spatial reasoning plays a vital role in both human cognition and machine intelligence, prompting new research into language models' (LMs) capabilities in this regard. However, existing benchmarks reveal shortcomings in e…
Logical Reasoning Question AnsweringSpatial ReasoningVisual Question AnsweringRussianSuperGLUE: A Russian Language Understanding Evaluation Benchmark
In this paper, we introduce an advanced Russian general language understanding evaluation benchmark -- RussianGLUE. Recent advances in the field of universal language models and transformers require the development of a …
Common Sense ReasoningDiagnosticLexical EntailmentLogical Reasoning Question Answering+5ReClor: A Reading Comprehension Dataset Requiring Logical Reasoning
Recent powerful pre-trained language models have achieved remarkable performance on most of the popular datasets for reading comprehension. It is time to introduce more challenging datasets to push the development of thi…
Logical ReasoningLogical Reasoning Question AnsweringLogical Reasoning Reading ComprehensionMachine Reading Comprehension+2