论文
视频模型是教育领域的零样本学习者和推理者吗? EduVideoBench,教育视频生成的知识技能态度基准
Are Video Models Zero-Shot Learners and Reasoners in Education? EduVideoBench, A Knowledge-Skills-Attitude Benchmark for Educational Video Generation
摘要
视频生成模型 (VGM) 正在迅速进入课堂,但现有基准仅评估感知质量、内在 忠实性、通用安全性或视频作为推理媒介,并且没有评估输出是否具有教育意义。在这项工作中,我们提出了 EduVideoBench,这是教育领域的第一个平衡基准,它基于知识-技能-态度 (KSA) 框架,以便对教学充分性和教育安全进行联合评估,而不是作为临时的质量维度。在五个前沿 VGM 中,我们的结果表明,在为课堂做好准备之前,知识、技能和态度方面还有很大的改进空间。我们通过对专家评论的定性分析来补充这一点,发现教育有效性是多方面的,其中单个未对准的元素(例如节奏、易读性或符号)可能会使原本正确的视频失效。我们希望 EduVideoBench 能够指导 VGM 的开发,使其在教学上扎根且对课堂安全。