paper-with-me

Papers

ThinknCheck: Grounded Claim Verification with Compact, Reasoning-Driven, and Interpretable Models

2026-04-02 · Delip Rao, Feijiang Han, Chris Callison-Burch arxiv

We present ThinknCheck, a 1B-parameter verifier for grounded claim verification that first produces a short, structured rationale and then a binary verdict. We construct LLMAggreFact-Think, a 24.1k reasoning-augmented training set derived from LLMAggreFact, and fine-tune a 4-bit Gemma3 model to follow this format. On LLMAggreFact, ThinknCheck attains 78.1 balanced accuracy (BAcc), surpassing MiniCheck-7B (77.4) with 7x fewer parameters; removing the reasoning step reduces BAcc to 57.5. On SciFact, ThinknCheck reaches 64.7 BAcc, a +14.7 absolute gain over MiniCheck-7B. By contrast, zero-shot chain-of-thought on the base Gemma3-1B harms accuracy relative to direct answers, and preference optimization with a simple format+accuracy reward underperforms supervised reasoning. To probe the latter, we introduce GSMClaims and a domain-specialized variant, ThinknCheck-Science, which improves across benchmarks, including 61.0\% accuracy on GSMClaims. Overall, explicit, supervised reasoning enables compact verifiers that are competitive while remaining resource-efficient and interpretable.

📄 PDF Abstract BibTeX arXiv:2604.01652

Code (0)

등록된 구현이 없습니다.

Similar Papers 제목 키워드 기반

Explainable Claim Verification via Knowledge-Grounded Reasoning with Large Language Models

2023-10-08 · Haoran Wang, Kai Shu

Claim verification plays a crucial role in combating misinformation. While existing works on claim verification have shown promising results, a crucial piece of the puzzle that remains unsolved is to understand how to ve…

Claim VerificationDecision MakingIn-Context LearningMisinformation

What Do Claim Verification Datasets Actually Test? A Reasoning Trace Analysis

2026-04-02 · Delip Rao, Chris Callison-Burch arxiv

Despite rapid progress in claim verification, we lack a systematic understanding of what reasoning these benchmarks actually exercise. We generate structured reasoning traces for 24K claim-verification examples across 9 …

Arithmetic Reasoning

ReflectFact: Self-Reflective Agents for Improving Comprehension and Reasoning in Multi-Hop Fact Verification

2026-08-13 · Runze Zhao, Zixin Tang, Xiaoshuai Hao, Leyuan Chang 외 arxiv

Multi-hop fact verification, which verifies claims by reasoning over multiple pieces of evidence, is critical for combating misinformation on social media yet remains highly challenging. Recent methods primarily rely on …

Fact Verification

CLIPPER: Compression enables long-context synthetic data generation

2025-02-20 · Chau Minh Pham, Yapei Chang, Mohit Iyyer

LLM developers are increasingly reliant on synthetic data, but generating high-quality data for complex long-context reasoning tasks remains challenging. We introduce CLIPPER, a compression-based approach for generating …

Claim VerificationSynthetic Data Generation

Paladin-mini: A Compact and Efficient Grounding Model Excelling in Real-World Scenarios

2025-06-25 · Dror Ivry, Oran Nahum

This paper introduces two significant contributions to address the issue of grounding claims in a given context. Grounding means that given a context (document) and a claim, there's at least one supportive evidence for t…