Mirror: A Universal Framework for Various Information Extraction Tasks
Tong Zhu, Junfei Ren, Zijian Yu, Mengsong Wu, Guoliang Zhang, Xiaoye Qu, Wenliang Chen, Zhefeng Wang, Baoxing Huai, Min Zhang
摘要
Sharing knowledge between information extraction tasks has always been a challenge due to the diverse data formats and task variations. Meanwhile, this divergence leads to information waste and increases difficulties in building complex applications in real scenarios. Recent studies often formulate IE tasks as a triplet extraction problem. However, such a paradigm does not support multi-span and nary extraction, leading to weak versatility. To this end, we reorganize IE problems into unified multi-slot tuples and propose a universal framework for various IE tasks, namely Mirror. Specifically, we recast existing IE tasks as a multi-span cyclic graph extraction problem and devise a non-autoregressive graph decoding algorithm to extract all spans in a single step. It is worth noting that this graph structure is incredibly versatile, and it supports not only complex IE tasks, but also machine reading comprehension and classification tasks. We manually construct a corpus containing 57 datasets for model pretraining, and conduct experiments on 30 datasets across 8 downstream tasks. The experimental results demonstrate that our model has decent compatibility and outperforms or reaches competitive performance with SOTA systems under fewshot and zero-shot settings. The code, model weights, and pretraining corpus are available at https://github.com/Spico197/Mirror . * Corresponding author Relation Extraction ADR muscle fatigue pain CEO of Tim Cook Apple Discontinuous NER [(ADR, muscle pain), (ADR, muscle fatigue)] [(Tim Cook, CEO of, Apple)]
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper5
- Enhancing Low-Resource Relation Representations through Multi-View DecouplingChenghao Fan, Wei Wei, Xiaoye Qu, Zhenyi Lu 等AAAI 2024 · 被引用 10 次
- Reliable Data Generation and Selection for Low-Resource Relation ExtractionJunjie Yu, Xing Wang, Wenliang ChenAAAI 2024 · 被引用 7 次
- EXCEEDS: Extracting Complex Events via Nugget-based Grid Modeling in Scientific DomainYi-Fan Lu, Xian-Ling Mao, Bo Wang, Xiao Liu 等ACL 2026 · 被引用 1 次
- Integrating Structural Semantic Knowledge for Enhanced Information Extraction Pre-trainingXiaoyang Yi, Yuru Bao, Jian Zhang, Yifang Qin 等EMNLP 2024 · 被引用 1 次
- Capability Decomposition for Unified Information Extraction via Hierarchical Mixture-of-ExpertsJing Zhou, Peng Wang, Wenjun Ke, Jiajun Liu 等ACL 2026
它引用的顶会 Paper15
- BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and ComprehensionMike Lewis, Yinhan Liu, Naman Goyal, Marjan Ghazvininejad 等ACL 2020 · 被引用 1,224 次
- DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding SharingPengcheng He, Jianfeng Gao, Weizhu ChenICLR 2023 · 被引用 394 次
- A Joint Neural Model for Information Extraction with Global FeaturesYing Lin, Heng Ji, Fei Huang, Lingfei WuACL 2020 · 被引用 376 次
- Unified Named Entity Recognition as Word-Word Relation ClassificationJingye Li, Hao Fei, Jiang Liu, Shengqiong Wu 等AAAI 2022 · 被引用 340 次
- CrossNER: Evaluating Cross-Domain Named Entity RecognitionZihan Liu, Yan Xu, Tiezheng Yu, Wenliang Dai 等AAAI 2021 · 被引用 201 次
相关 Paper
- UniEX: An Effective and Efficient Framework for Unified Information Extraction via a Span-extractive PerspectiveYang Ping, Junyu Lu, Ruyi Gan, Junjie Wang 等ACL 2023 · 被引用 4 次
- Unified Structure Generation for Universal Information ExtractionYaojie Lu, Qing Liu, Dai Dai, Xinyan Xiao 等ACL 2022
- UTC-IE: A Unified Token-pair Classification Architecture for Information ExtractionHang Yan, Yu Sun, Xiaonan Li, Yunhua Zhou 等ACL 2023 · 被引用 8 次
- Zero-Shot Information Extraction as a Unified Text-to-Triple TranslationChenguang Wang, Xiao Liu, Zui Chen, Haoyun Hong 等EMNLP 2021 · 被引用 37 次
- Universal Information Extraction as Unified Semantic MatchingJie Lou, Yaojie Lu, Dai Dai, Wei Jia 等AAAI 2023 · 被引用 96 次
