论文

通过多任务表示工程提高 LLM 生成代码的可读性

Towards the Readability of LLM-Generated Codes through Multitask Representation Engineering

模型推理解码与生成控制

摘要

正确性和可读性是代码质量的关键衡量标准,分别确保功能保真度和易于理解性。虽然大多数现有研究侧重于提高 大语言模型~(LLM) 生成代码的正确性,但可读性仍然没有得到解决。由于其主观性,通过有针对性的控制来增强可读性具有挑战性。在本文中,我们采用表示工程(RepE)作为目标控制方法,因为它具有低数据依赖性和低计算成本的特点。 RepE之前的工作主要集中在单个任务的针对性控制上,但提高代码可读性需要跨多个任务的控制。据此,我们提出了多任务RepE框架,并从理论上讨论了多任务引导方法对代码可读性和正确性之间权衡的影响。我们进一步提供全面的实验支持。所有相关的实现都是开源的,并且可根据要求提供。