论文
表征和减少 Linux 内核中的误报错误报告
Characterizing and Mitigating False-Positive Bug Reports in the Linux Kernel
摘要
误报错误报告代表了 Linux 内核开发和维护中的一个重大但尚未充分探索的挑战。当正确的系统行为被错误地标记为缺陷时,就会发生这种情况,消耗开发人员的精力而不会带来实际的代码改进。此类报告可能会误导开发人员、浪费调试资源并延迟真正错误的解决。在本文中,我们首次对 Linux 内核中的误报错误报告进行了全面的实证研究。我们手动构建了一个包含 2,006 个错误报告的数据集,其中包括从 Bugzilla 和 Syzkaller 收集的 1,509 个真实错误和 497 个误报。我们的分析表明,误报需要与真正的错误相当的努力,通常需要长时间的讨论和重要的关闭时间。它们出现在多个组件中,特别是文件系统和驱动程序中,主要是由于外部依赖性和语义误解。为了应对这一挑战,我们评估了 大语言模型 (LLM),以实现自动误报错误报告缓解。在各种提示策略中,检索增强生成(RAG)表现最好,实现了 91% 的召回率和 88% 的 F1 分数。这些发现强调了误报错误报告的不可忽视的成本,并显示了 LLM 在 Linux 内核中更有效地缓解误报的前景。