CEAES: Bidirectional Reinforcement Learning Optimization for Consistent and Explainable Essay Assessment
Xia Li, Wenjing Pan
摘要
Most current automated essay quality assessment systems treat score prediction and feedback generation as separate tasks, overlooking the fact that scores provide a quantitative evaluation of quality, while feedback offers a qualitative assessment. Both aspects reflect essay quality from different perspectives, and they are inherently consistent and can reinforce each other. In this paper, we propose a novel bidirectional reinforcement learning framework that effectively utilizes this consistency constraint to jointly optimize score prediction and feedback generation, ensuring mutual reinforcement and alignment between them. In this way, our model is hope to obtain a simultaneous accurate ratings and consistent text feedback. We conducted extensive experiments on publicly available datasets. The results demonstrate that our approach surpasses the current state-of-theart models, enhancing both scoring accuracy and feedback quality.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper1
相关 Paper
- Autoregressive Multi-trait Essay Scoring via Reinforcement Learning with Scoring-aware Multiple RewardsHeejin Do, Sangwon Ryu, Gary Geunbae LeeEMNLP 2024 · 被引用 5 次
- Automated Cross-prompt Scoring of Essay TraitsRobert Ridley, Liang He, Xin-Yu Dai, Shujian Huang 等AAAI 2021 · 被引用 101 次
- Alternating Reinforcement Learning for Rubric-Based Reward Modeling in Non-Verifiable LLM Post-TrainingRan Xu, Tianci Liu, Zihan Dong, Tony Yu 等ICML 2026
- Aggregating Multiple Heuristic Signals as Supervision for Unsupervised Automated Essay ScoringCong Wang, Zhiwei Jiang, Yafeng Yin, Zifeng Cheng 等ACL 2023 · 被引用 4 次
- AnnotateGPT: Designing Human-AI Collaboration in Pen-Based Document AnnotationBenedict Leung, Mariana Shimabukuro, Christopher CollinsCHI 2026 · 被引用 1 次
