Logic Matters in Lightweight Hallucination Classification for RAG System
Ningyuan Yang, Kaizhu Huang
摘要
We propose a lightweight, modular framework for hallucination detection in Retrieval-Augmented Generation (RAG) systems, addressing the critical challenge where logical dependencies span across fragmented retrieval results. Through graph-based semantic evidence aggregation, which captures the implicit logical structure by clustering semantically coherent segments across retrieved documents via betweenness centrality, our approach enables small NLI models to handle multihop reasoning without task-specific training. We present two deployment configurations: a resource-efficient variant (≈0.5B parameters) achieving 82.4% accuracy on HotPotQA-Derived at 85 ms latency, outperforming all sub-1B baselines by over 30%; and a higheraccuracy variant (≈1.5B parameters) reaching 85.6%, surpassing 11B TrueTeacher while being 7× smaller and 1.7× faster. Experiments with six NLI discriminator models show consistent gains of +6.7%-+29.9%, confirming that graph-based evidence aggregation is NLIagnostic and the primary performance driver. We also contribute HotPotQA-Derived, a new multi-hop hallucination benchmark preserving separate retrieved documents for systematic evaluation.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper8
- Retrieval-Augmented Generation for Knowledge-Intensive NLP TasksPatrick Lewis, Ethan Perez, Aleksandra Piktus, Fabio Petroni 等NeurIPS 2020 · 被引用 19,162 次
- HaluEval: A Large-Scale Hallucination Evaluation Benchmark for Large Language ModelsJunyi Li, Xiaoxue Cheng, Xin Zhao, Jian-Yun Nie 等EMNLP 2023 · 被引用 224 次
- AlignScore: Evaluating Factual Consistency with A Unified Alignment FunctionYuheng Zha, Yichi Yang, Ruichen Li, Zhiting HuACL 2023 · 被引用 44 次
- MiniCheck: Efficient Fact-Checking of LLMs on Grounding DocumentsLiyan Tang, Philippe Laban, Greg DurrettEMNLP 2024 · 被引用 26 次
- TrueTeacher: Learning Factual Consistency Evaluation with Large Language ModelsZorik Gekhman, Jonathan Herzig, Roee Aharoni, Chen Elkind 等EMNLP 2023 · 被引用 24 次
相关 Paper
- S2G-RAG: Structured Sufficiency and Gap Judging for Iterative Retrieval-Augmented QAMinghan Li, Junjie Zou, Xinxuan Lv, Chao Zhang 等ACL 2026 · 被引用 1 次
- QA-GraphRAG: Query-Adaptive Plug-and-Play Retrieval Integration for Graph-based Retrieval-Augmented GenerationZeang Sheng, Ruihong Sun, Jiahao Xu, Hanmei Luo 等VLDB 2026
- LinearRAG: Linear Graph Retrieval Augmented Generation on Large-scale CorporaLuyao Zhuang, Shengyuan Chen, Yilin Xiao, Huachi Zhou 等ICLR 2026 · 被引用 54 次
- HyperRAG: Reasoning N-ary Facts over Hypergraphs for Retrieval Augmented GenerationWen-Sheng Lien, Yu-Kai Chan, Hao-Lung Hsiao, Bo-Kai Ruan 等WWW 2026
- Structure Is All You Need to Reuse: Accelerating GraphRAG via Meta-Structure-Aware KV CachingRuikun Luo, Changwei Gu, Jing Yang, Hongming Liang 等KDD 2026
