论文
SEAM:面向规模化短剧一致生成的镜头实体属性记忆
SEAM: Shot Entity-Attribute Memory for Consistent Short-Drama Generation at Scale
摘要
短剧生成已发展成庞大的工业化流水线,当它从孤立镜头扩展到剧集层面时,视觉连续性成为关键瓶颈。当前的智能体框架逐镜头孤立生成,导致上下文在镜头之间漂移,道具、人物姿态和场面调度变得不一致。一旦拼接起来,这些微小差异就会放大成严重的视觉断裂。我们提出SEAM(Shot Entity-Attribute Memory,镜头实体属性记忆),一个免训练、与模型无关的记忆图,完全在提示文本层修复连续性:为每个镜头提取多维状态,在所得图上只检索因果上先前的上下文,对其进行选择性过滤,并通过自然语言提示重写注入存留的约束。我们还发布了SEAM-Bench,一个双盲连续性分镜基准;在该基准上,SEAM将跨剧集连续性召回率从0.700提升到0.946,在六个主流文本模型上均能泛化,并在生成图像层带来一致但尚未显著的增益。SEAM作为强制环节部署于CreativeFitting的SEAM-Agent生产流水线中的201个镜头,达到96.5%的导演接受率且零不安全注入;一个保守的反事实归因将其中至少21.9个百分点归功于其跨剧集记忆。
