论文
召回并不足够:个性化语言系统中的承诺约束
Recall Isn't Enough: Bounding Commitments in Personalized Language Systems
摘要
长上下文与记忆系统通常把个性化当作召回问题。实践中,许多失败发生在更晚的承诺环节:系统把噪声提示变成硬约束、丢弃罕见见证证据、遗忘下游义务,或在不可行的情况下仍然作答。我们提出合同约束的证据激活(Contract-Bounded Evidence Activation,CBEA)与词典序承诺验证(Lexicographic Commitment Validation,LCV)。CBEA利用类型化覆盖、尾部见证和后果债务激活一个有界证据集;LCV在生成正文前验证结构化承诺,并将不可行状态路由到修复、弃答或重新缔约。在360个测试夹具与三个生成后端上,CBEA+LCV在0.49-0.60的尝试运行可用率下达成验证器范围内的零失败。配备同一LCV门控的原始与长上下文基线,只有在可用率低至0.003-0.092时才能达到零失败。一个影子先知诊断标出了极限:CBEA+LCV仅召回0.012的未编译可见事实,而原始方式召回0.53。结果是一个有界的工作点:显式的承诺控制和中位输入负载降低74-75%,而非普适的记忆优势。