论文

宣传取证:还原一场AI驱动影响力行动的生成流水线

Propaganda Forensics: Recovering the Generation Pipeline of an AI-Driven Influence Campaign

模型评测安全与风险评测

摘要

我们对近期一场AI驱动影响力行动背后的生成流水线进行取证分析。我们提出PROPAGIA语料库,收录2,646篇法语宣传文章,来自VIGINUM与INSIKT GROUP于2025年披露的Storm-1516/CopyCop行动。作为对照,我们使用SIPA语料库,即同一时期人工撰写的法国主流媒体文章。利用主题建模、模糊性与情感分析,我们首先分离出宣传特有的说服技巧:PROPAGIA在模糊性、主观性与消极程度上远超SIPA,且引用的来源更少。随后,我们在PROPAGIA的84个网站中的50个上发现了提示词指令泄露,其中包括一份逐字记录的十点编辑规范,它可以解释上述若干差异,同时文章之间存在高度冗余。最后,我们表明基于改写的检测支持INSIKT GROUP将其归因于Llama 3系列,但也提示涉及了Mistral系列模型。

宣传取证:还原一场AI驱动影响力行动的生成流水线:论文配图
图1:SIPA 与 PROPAGIA 在前 20 个主题上的覆盖率比较