BABOONS: Black-Box Optimization of Data Summaries in Natural Language
Immanuel Trummer
摘要
BABOONS (BlAck BOx Optimization of Natural language data Summaries) optimizes text data summaries for an arbitrary, user-defined utility function. Primarily, it targets scenarios in which utility is evaluated via large language models. Users describe their utility function in natural language or provide a model, trained to score text summaries in a specific domain. BABOONS uses reinforcement learning to explore the space of possible descriptions. In each iteration, BABOONS generates summaries and evaluates their utility. To reduce data processing overheads during summary generation, BABOONS uses a proactive processing strategy that dynamically merges current with likely future queries for efficient processing. Also, BABOONS supports scenario-specific sampling and batch processing strategies. These mechanisms allow to scale processing to large data and item sets. The experiments show that BABOONS scales significantly better than baselines. Also, they show that summaries generated by BABOONS receive higher average grades from users in a large survey.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper3
- BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and ComprehensionMike Lewis, Yinhan Liu, Naman Goyal, Marjan Ghazvininejad 等ACL 2020 · 被引用 1,224 次
- Context-aware Outstanding Fact Mining from Knowledge GraphsYueji Yang, Yuchen Li, Panagiotis Karras, Anthony K. H. TungKDD 2021 · 被引用 8 次
- Optimally Summarizing Data by Small Fact Sets for Concise Answers to Voice QueriesImmanuel Trummer, Connor AndersonICDE 2021 · 被引用 3 次
相关 Paper
- RLPF: Reinforcement Learning from Prediction Feedback for User Summarization with LLMsJiaxing Wu, Lin Ning, Luyang Liu, Harrison Lee 等AAAI 2025 · 被引用 12 次
- Beyond the Context Window: Scaling Agentic RL via End-to-end Optimized Context CompressionMiao Lu, Weiwei Sun, Weihua Du, Zhan Ling 等ACL 2026
- Q-learning with Language Model for Edit-based Unsupervised SummarizationRyosuke Kohita, Akifumi Wachi, Yang Zhao, Ryuki TachibanaEMNLP 2020 · 被引用 2 次
- OptimSyn: Influence-Guided Rubrics Optimization for Synthetic Data GenerationZhiting Fan, Ruizhe Chen, Tianxiang Hu, Ru Peng 等ICLR 2026 · 被引用 3 次
- M-RAG: Reinforcing Large Language Model Performance through Retrieval-Augmented Generation with Multiple PartitionsZheng Wang, Shu Xian Teo, Jieer Ouyang, Yongjun Xu 等ACL 2024
