paper-with-me

홈 › Papers

MAVEN: Multi-Agent Verification-Elaboration Network with In-Step Epistemic Auditing

2026-05-08 · Yinsheng Yao, Jiehao Tang, Zhaozhen Yang, Dawei Cheng arxiv

While explicit reasoning trajectories enhance model interpretability, existing paradigms often rely on monolithic chains that lack intermediate verification, allowing early errors to cascade unchecked. This lack of modularity impedes granular auditing and compromises the epistemic trust required for high-stakes applications. We propose MAVEN (Multi-Agent Verification-Elaboration Network with In-Step Epistemic Auditing), a blackboard-inspired framework designed to transform LLMs into deliberate reasoners through explicit role-decoupling. At its core, MAVEN operationalizes an adversarial Skeptic-Researcher-Judge loop, simulating expert deliberation by functionally separating logical defense from factual grounding. Experiments on OpenBookQA, TruthfulQA, HALUEVAL and StrategyQA benchmarks demonstrate that MAVEN delivers superior reasoning quality across four fine-grained metrics. Notably, MAVEN consistently outperforms latent reasoning models such as GEMINI-3.1-Pro and consensus-based baselines (e.g., ReConcile) by generating explicitly structured, modular, and verifiable deliberation trajectories, rather than relying on implicit internal states or post-hoc consensus. Moreover, comprehensive evaluations confirm that MAVEN is fully model-agnostic, serving as a strong and transferable reasoning booster that yields substantial performance improvements across diverse backbone models.

📄 PDF Abstract BibTeX arXiv:2605.07646

Code (0)

등록된 구현이 없습니다.

Similar Papers 제목 키워드 기반

MAVEN: Improving Generalization in Agentic Tool Calling

2026-05-29 · Omkar Ghugarkar, Vishvesh Bhat, Muhammad Ahmed Mohsin, Asad Aali arxiv

Generalization across agentic tool-calling environments remains a central challenge for reliable agentic reasoning systems. Although large language models achieve strong results on individual benchmarks, their ability to…

On Generalization in Agentic Tool Calling: CoreThink Agentic Reasoner and MAVEN Dataset

2025-10-27 · Vishvesh Bhat, Omkar Ghugarkar, Julian McAuley arxiv

Generalization across Agentic tool-calling environments remains a key unsolved challenge in developing reliable agentic reasoning systems. While large language models (LLMs) demonstrate strong performance on isolated ben…

MAVEN A Multi-Agent Framework for Multicultural Text-to-Video Generation

2026-05-16 · Shuowei Li, Yuming Zhao, Parth Bhalerao, Oana Ignat arxiv

Text-to-video (T2V) generation has rapidly progressed in visual fidelity, yet its ability to faithfully represent multiple cultures within a single prompt remains underexplored. We introduce MAVEN, a multi-agent prompt r…

Text-to-Video Generation

MAVEN: Multi-Agent Variational Exploration

2019-10-16 · NeurIPS 2019 12 · Anuj Mahajan, Tabish Rashid, Mikayel Samvelyan, Shimon Whiteson

Centralised training with decentralised execution is an important setting for cooperative deep multi-agent reinforcement learning due to communication constraints during execution and computational tractability in traini…

Multi-agent Reinforcement LearningReinforcement LearningSMACSMAC+

MAVEN: A Multi-stage Agentic Annotation Pipeline for Video Reasoning Tasks

2026-05-21 · Han Zhang, Wanting Jiang, Tomasz Kornuta, Tian Zheng 외 arxiv

Training Vision Language Models (VLMs) for video event reasoning requires high-quality structured annotations capturing not only what happened, but when, where, why, and with what consequence, at a scale manual labelling…

Domain Adaptation