Expectation-Guided Self-Verification for Aligning Large Reasoning Models with Domain Knowledge
Han Zhang, Chen Zhao, Shasha Wang, Gang Chen, Chenghong Zhang
2026年份
问问这篇 Paper
问问你的智能体。
Lune 读过与它相关的顶会 Paper,每个回答都会注明依据哪几篇。
相关 Paper
- Thinking Out Loud: Do Reasoning Models Know When They're Right?Qingcheng Zeng, Weihao Xuan, Leyang Cui, Rob VoigtEMNLP 2025 · 被引用 1 次
- Beyond Oracle: Verifier-Supervision for Instruction Hierarchy in Reasoning and Instruction-Tuned LLMsSian-Yao Huang, Li-Hsien Chang, Che-Yu Lin, Cheng-Lin YangNeurIPS 2025 · 被引用 4 次
- Experience is the Best Teacher: Augmenting LLM Reasoning with Knowledge Learned from the PastMingjun Zhou, Weixin Zeng, Xiang ZhaoWWW 2026
- Incentivizing Agentic Reasoning Capability with Outcome Supervision for Knowledge Base Question AnsweringZhuo Chen, Fei Wang, Zixuan Li, Zhao Zhang 等WWW 2026
- Entailer: Answering Questions with Faithful and Truthful Chains of ReasoningOyvind Tafjord, Bhavana Dalvi Mishra, Peter ClarkEMNLP 2022 · 被引用 28 次
