PaSa: An LLM Agent for Comprehensive Academic Paper Search
Yichen He, Guanhua Huang, Peiyuan Feng, Yuan Lin, Yuchen Zhang, Hang Li, Weinan E
摘要
We introduce PaSa, an advanced Paper Search agent powered by large language models. PaSa can autonomously make a series of decisions, including invoking search tools, reading papers, and selecting relevant references, to ultimately obtain comprehensive and accurate results for complex scholar queries. We optimize PaSa using reinforcement learning with a synthetic dataset, AutoScholarQuery, which includes 35k fine-grained academic queries and corresponding papers sourced from top-tier AI conference publications. Additionally, we develop RealScholarQuery, a benchmark collecting real-world academic queries to assess PaSa performance in more realistic scenarios. Despite being trained on synthetic data, PaSa significantly outperforms existing baselines on RealScholarQuery, including Google, Google Scholar, Google with GPT-4o for paraphrased queries, ChatGPT (search-enabled GPT-4o), GPT-o1, and PaSa-GPT-4o (PaSa implemented by prompting GPT-4o). Notably, PaSa-7B surpasses the best Google-based baseline, Google with GPT-4o, by 37.78% in recall@20 and 39.90% in recall@50, and exceeds PaSa-GPT-4o by 30.36% in recall and 4.25% in precision. Model, datasets, and code are available at https://github.com/bytedance/pasa .
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper7
- Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM AgentsJiawei Wang, Jiacai Liu, Yuqian Fu, Yingru Li 等ICML 2026 · 被引用 38 次
- SciNet: Evaluating AI Agents in Relation-Aware Scientific Literature RetrievalChenyang Shao, Fengli Xu, Yong LiICML 2026 · 被引用 2 次
- PaperRegister: Boosting Flexible-grained Paper Search via Hierarchical Register IndexingZhuoqun Li, Xuanang Chen, Hongyu Lin, Yaojie Lu 等ACL 2026 · 被引用 1 次
- Not Search, But Scan: Benchmarking MLLMs on Scan-Oriented Academic Paper ReasoningRongjin Li, Zichen Tang, Xianghe Wang, Xinyi Hu 等ICLR 2026 · 被引用 1 次
- PaperAsk: A Benchmark for Reliability Evaluation of LLMs in Paper Search and ReadingYutao Wu, Xiao Liu, Yunhao Feng, Jiale Ding 等WWW 2026 · 被引用 1 次
它引用的顶会 Paper12
- Reflexion: language agents with verbal reinforcement learningNoah Shinn, Federico Cassano, Ashwin Gopinath, Karthik Narasimhan 等NeurIPS 2023 · 被引用 5,828 次
- Generative Agents: Interactive Simulacra of Human BehaviorJoon Sung Park, Joseph C. O'Brien, Carrie Jun Cai, Meredith Ringel Morris 等UIST 2023 · 被引用 1,882 次
- Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking AgentsWeiwei Sun, Lingyong Yan, Xinyu Ma, Shuaiqiang Wang 等EMNLP 2023 · 被引用 182 次
- AGILE: A Novel Reinforcement Learning Framework of LLM AgentsPeiyuan Feng, Yichen He, Guanhua Huang, Yuan Lin 等NeurIPS 2024 · 被引用 61 次
- A Setwise Approach for Effective and Highly Efficient Zero-shot Ranking with Large Language ModelsShengyao Zhuang, Honglei Zhuang, Bevan Koopman, Guido ZucconSIGIR 2024 · 被引用 60 次
相关 Paper
- REARANK: Reasoning Re-ranking Agent via Reinforcement LearningLe Zhang, Bo Wang, Xipeng Qiu, Siva Reddy 等EMNLP 2025 · 被引用 14 次
- ReSearch: Learning to Reason with Search for LLMs via Reinforcement LearningMingyang Chen, Linzhuang Sun, Tianpeng Li, Haoze Sun 等NeurIPS 2025 · 被引用 125 次
- AnyTool: Self-Reflective, Hierarchical Agents for Large-Scale API CallsYu Du, Fangyun Wei, Hongyang ZhangICML 2024 · 被引用 104 次
- AirQA: A Comprehensive QA Dataset for AI Research with Instance-Level EvaluationTiancheng Huang, Ruisheng Cao, Yuxin Zhang, Zhangyi Kang 等ICLR 2026 · 被引用 1 次
- KARL: Reinforcement Learning for LLM Agents on Multi-Turn Knowledge-Intensive Agentic TasksXueqiao Sun, Xiao Liu, Bowen Lv, Hanchen Zhang 等ACL 2026
