论文
从整体式到模块化:片段级自动提示词优化
From Monolithic to Modular: Segment-level Automatic Prompt Optimization
摘要
自动提示词优化(APO)常常整体地重写提示词,这可能改善一种行为的同时损害其他行为。我们提出SAPO,一种片段级的APO方法:将提示词分解为角色、上下文、任务与输出格式,然后基于表现最好与最差的各5个示例施加针对性改进。优化循环使用单个大语言模型,配合静态元提示词与结构化输出来完成分段、弱点分析与候选生成。我们描述了一个训练/验证协议和一个两阶段生成过程:(1) 片段级诊断与建议提取,(2) 受弱/强片段信号约束的候选合成。在GPT-3.5-Turbo与GPT-4o-mini上、覆盖SQuADv2、TweetEval、XSUM、CommonGen与GSM8K的评测设置中,SAPO相对Zero-shot以及APE、OPRO、EvoPrompt、GEPA和StraGO等强APO基线取得了最佳平均分。
