论文

倾听、纠正和反馈:口头教学反馈的生成

Listen, Correct, and Feed Back: Spoken Pedagogical Feedback Generation

模型训练监督微调与指令调优

摘要

语法错误纠正(GEC)和解释(GEE)取得了快速进展,但真实的教学场景还需要\emph{对学习者友好的教学反馈},即可操作的、适合水平的和令人鼓舞的。我们引入了 \textbf{SPFG} (\textbf{S}poken \textbf{P}edagogical \textbf{F}eedback \textbf{G}eneration),这是一个基于 Speak \& Improve Challenge 2025 语料库构建的数据集,将流利性转录与 GEC 目标和 \emph{人类验证} 教师风格反馈配对,包括用于偏好学习的首选/拒绝反馈对。我们研究了基于转录的口语语法错误纠正 (SGEC) 设置,并评估了三种指令调整的 LLM(Qwen2.5、Llama-3.1 和 GLM-4),将监督 微调 (SFT) 与基于偏好的对齐(使用 DPO 和 KTO)进行比较,以联合生成更正和反馈。结果表明,SFT 提供了最一致的改进,而 DPO/KTO 产生较小或混合的增益,并且校正质量和反馈质量是弱耦合的。我们的实现可以在 https://github.com/Skywalker-Harrison/spfg 上找到。