VietCheckMed: Explainable Regulatory Compliance Checking for Medical Advertisements on Vietnamese Social Media
Nguyen Thanh Tam, Khanh Quoc Tran, Dat Thanh Pham, Truong Phu Le, Nguyen Hoang Gia Han, Binh T. Nguyen
摘要
Regulatory compliance checking for online medical advertisements poses a critical public safety challenge distinct from traditional fact-checking, particularly in low-resource languages. Existing automated systems are ill-suited for the authorization-based, evidence-grounded, and explainable reasoning this task demands. To address this gap, we introduce VietCheckMed, a novel retrieval-augmented framework, and VietAestheticAds, the first large-scale, expert-validated benchmark for this task, comprising 8,329 advertisements paired with an authoritative regulatory corpus of 9,978 facilities. Comprehensive experiments demonstrate that our evidence-grounded approach is essential, substantially outperforming powerful unassisted LLM baselines by over 0.3805 F1-score. A detailed analysis reveals that the primary remaining challenges are nuanced failures in semantic and logical reasoning, defining a clear frontier for future research. To promote advances in regulatory technology and responsible AI, our dataset, code, and evaluation scripts will be made publicly available. This work contributes a foundational methodology and a vital public resource for developing responsible AI in high-stakes regulatory domains.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper6
- Chain-of-Thought Prompting Elicits Reasoning in Large Language ModelsJason Wei, Xuezhi Wang, Dale Schuurmans, Maarten Bosma 等NeurIPS 2022 · 被引用 22,562 次
- Generating Fact Checking ExplanationsPepa Atanasova, Jakob Grue Simonsen, Christina Lioma, Isabelle AugensteinACL 2020 · 被引用 130 次
- Fact-Checking Complex Claims with Program-Guided ReasoningLiangming Pan, Xiaobao Wu, Xinyuan Lu, Anh Tuan Luu 等ACL 2023 · 被引用 45 次
- Large Language Models are not Fair EvaluatorsPeiyi Wang, Lei Li, Liang Chen, Zefan Cai 等ACL 2024
- ReAct: Synergizing Reasoning and Acting in Language ModelsShunyu Yao, Jeffrey Zhao, Dian Yu, Nan Du 等ICLR 2023
相关 Paper
- ViFactCheck: A New Benchmark Dataset and Methods for Multi-Domain News Fact-Checking In VietnameseTran Thai Hoa, Tran Quang Duy, Khanh Quoc Tran, Kiet Van NguyenAAAI 2025
- Region-Grounded Report Generation for 3D Medical Imaging: A Fine-Grained Dataset and Graph-Enhanced FrameworkCong Huy Nguyen, Son Dinh Nguyen, Guanlin Li, Tuan Dung Nguyen 等ACL 2026
- Combining Evidence and Reasoning for Biomedical Fact-CheckingMariano Barone, Antonio Romano, Giuseppe Riccio, Marco Postiglione 等SIGIR 2025 · 被引用 3 次
- MIRA: A Novel Framework for Fusing Modalities in Medical RAGJinhong Wang, Tajamul Ashraf, Zongyan Han, Jorma Laaksonen 等ACM MM 2025 · 被引用 5 次
- MedMKEB: A Comprehensive Knowledge Editing Benchmark for Medical Multimodal Large Language ModelsDexuan Xu, Jieyi Wang, Zhongyan Chai, Yongzhi Cao 等AAAI 2026 · 被引用 1 次
