Generative Cooperative Networks for Natural Language Generation
Sylvain Lamprier, Thomas Scialom, Antoine Chaffin, Vincent Claveau, Ewa Kijak, Jacopo Staiano, Benjamin Piwowarski
摘要
Generative Adversarial Networks (GANs) have known a tremendous success for many continuous generation tasks, especially in the field of image generation. However, for discrete outputs such as language, optimizing GANs remains an open problem with many instabilities, as no gradient can be properly back-propagated from the discriminator output to the generator parameters. An alternative is to learn the generator network via reinforcement learning, using the discriminator signal as a reward, but such a technique suffers from moving rewards and vanishing gradient problems. Finally, it often falls short compared to direct maximum-likelihood approaches. In this paper, we introduce Generative Cooperative Networks, in which the discriminator architecture is cooperatively used along with the generation policy to output samples of realistic texts for the task at hand. We give theoretical guarantees of convergence for our approach, and study various efficient decoding schemes to empirically achieve state-of-the-art results in two main NLG tasks.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了最后一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper3
- QUARK: Controllable Text Generation with Reinforced UnlearningXiming Lu, Sean Welleck, Jack Hessel, Liwei Jiang 等NeurIPS 2022 · 被引用 290 次
- KCTS: Knowledge-Constrained Tree Search Decoding with Token-Level Hallucination DetectionSehyun Choi, Tianqing Fang, Zhaowei Wang, Yangqiu SongEMNLP 2023 · 被引用 10 次
- Branch-GAN: Improving Text Generation with (not so) Large Language ModelsFredrik Carlsson, Johan Broberg, Erik Hillbom, Magnus Sahlgren 等ICLR 2024 · 被引用 3 次
它引用的顶会 Paper8
- The Curious Case of Neural Text DegenerationAri Holtzman, Jan Buys, Li Du, Maxwell Forbes 等ICLR 2020 · 被引用 4,112 次
- Neural Text Generation With Unlikelihood TrainingSean Welleck, Ilia Kulikov, Stephen Roller, Emily Dinan 等ICLR 2020 · 被引用 683 次
- Language GANs Falling ShortMassimo Caccia, Lucas Caccia, William Fedus, Hugo Larochelle 等ICLR 2020 · 被引用 236 次
- Residual Energy-Based Models for Text GenerationYuntian Deng, Anton Bakhtin, Myle Ott, Arthur Szlam 等ICLR 2020 · 被引用 147 次
- Discriminative Adversarial Search for Abstractive SummarizationThomas Scialom, Paul-Alexis Dray, Sylvain Lamprier, Benjamin Piwowarski 等ICML 2020 · 被引用 37 次
相关 Paper
- To Beam Or Not To Beam: That is a Question of Cooperation for Language GANsThomas Scialom, Paul-Alexis Dray, Jacopo Staiano, Sylvain Lamprier 等NeurIPS 2021 · 被引用 23 次
- ColdGANs: Taming Language GANs with Cautious Sampling StrategiesThomas Scialom, Paul-Alexis Dray, Sylvain Lamprier, Benjamin Piwowarski 等NeurIPS 2020 · 被引用 19 次
- Meta-CoTGAN: A Meta Cooperative Training Paradigm for Improving Adversarial Text GenerationHaiyan Yin, Dingcheng Li, Xu Li, Ping LiAAAI 2020 · 被引用 24 次
- TextGAIL: Generative Adversarial Imitation Learning for Text GenerationQingyang Wu, Lei Li, Zhou YuAAAI 2021 · 被引用 54 次
- Improving GAN Training with Probability Ratio Clipping and Sample ReweightingYue Wu, Pan Zhou, Andrew Gordon Wilson, Eric P. Xing 等NeurIPS 2020 · 被引用 39 次
