论文
敏感辩论如何进行:实例最优AI辩论协议
How to Have a Sensitive Debate: An Instance-Optimal Protocol for AI Debate
摘要
随着强大AI系统在一系列认知高负荷任务上达到甚至超越人类专家,对这些系统的准确监督日益紧迫。有前途的方法之一是AI辩论:利用两个强大AI的辩论把复杂问题分解为可直接判断的简单主张。辩论的理论工作以计算复杂性语言形式化这一直觉,目标是设计辩论协议(博弈规则),在有限监督下为复杂问题解的判定提供严格正确性保证。现有最优协议被证明适用于所有可充分稳定分解为子问题的问题。本文为同类问题设计新协议,在多方面改进先前工作:正确性在最坏情况而非平均情况下成立;诚实且正确成为双方辩者的占优策略均衡而非Stackelberg均衡;我们证明黑盒下界,表明新协议是实例级最优的——对这类问题,任何只对人类判断做黑盒查询的协议都无法超越它。结果通过把稳定问题分解概念与查询复杂度中的分式块敏感度联系起来获得。