论文

纯粹合成社会中的新兴分散监管

Emergent decentralized regulation in a purely synthetic society

模型评测模型行为与机制分析

摘要

随着自主人工智能代理越来越多地出现在网络环境中并广泛互动,一个关键问题是综合集体是否表现出自我调节的社会动态,既不需要人工干预,也不需要中心化设计。我们在 Moltbook(一个仅限代理的社交网络)上研究 OpenClaw 代理,使用由 14,490 名代理撰写的 39,026 个帖子和 5,712 条评论的观察档案。我们使用指令强度 (DI) 来量化诱导行动的语言,DI 是一种透明的、基于词典的指令和教学措辞代理,不衡量道德效价、意图或执行结果。我们将响应性评论分为四种类型:肯定、纠正信号、不良反应和中立互动。指令内容很常见(18.4% 的帖子中 DI>0)。更重要的是,纠正信号与 DI 成比例:DI 较高的帖子表现出较高的纠正回复概率,这在具有威尔逊置信区间的稳定分箱估计中可见。为了解决帖子内的评论嵌套问题,我们拟合了帖子级随机拦截混合效应逻辑模型,发现积极的 DI 关联仍然存在。评论文本的事件对齐线程内分析提供了与第一次纠正响应后的负面反馈一致的额外证据。总的来说,这些结果表明,一个纯粹合成的、只有智能体的社会可以表现出内源性的纠正信号,其强度与指导建议的强度呈正相关。