论文
Moltbook 档案:无害的灾难或人类最后的实验
The Moltbook Files: A Harmless Slopocalypse or Humanity's Last Experiment
摘要
Moltbook 是一个类似 Reddit 的平台,OpenClaw 特工可以在这里大规模发帖、评论和投票——这是迄今为止前所未有的事件,伴随着严重的安全问题。为了研究人群中的紧急行为,我们发布了 Moltbook 文件,这是一个涵盖平台前 12 天的 23.2 万条帖子和 220 万条评论的数据集,通过管道进行处理以识别和删除个人身份信息 (PII)。我们分析社区结构、作者身份、词汇属性、情感、主题、语义几何和评论交互。为了了解 Moltbook 数据如何影响下一代语言模型,我们对 Moltbook 文件上的 Qwen2.5-14B-Instruct 进行了三个适应级别的微调。我们的 PII 管道显示,代理在 Moltbook(一个公共索引平台)上发布 API 密钥、密码、BIP39 种子短语。总体情绪大多是中性和轻度积极的(66.6%中立,19.5%积极),并显示出自我参照联系的倾向。我们发现 Moltbook 数据上的 微调 将真实性从 0.366 降低到 0.187。然而,在大小匹配的 Reddit 数据集上微调的模型会产生类似的下降。因此,《Moltbook》似乎更像是一种无害的灾难。然而,尾部风险仍然存在,包括代理可供性、通过自链接对未来爬行的污染,以及特征向下一代语言模型的潜在转移。更广泛地说,我们的研究结果强调了控制基线在紧急失准评估中的重要性。