论文

以 Stevens 幂律检查 GPT-5.5 的视觉图表读取

A Stevens's Power Law Check-up of GPT-5.5's Image-Based Visualization Reading

模型评测评测方法与指标

摘要

我们采用史蒂文斯幂律来衡量人工智能模型读取可视化的先天能力,这可以揭示算法模型的内置感知机制。在我们的试点研究中,模型看不到传说。模型首先查看参考视觉表示并估计其大小,然后估计相同表示的每个后续图像相对于该参考的大小。我们对十二个视觉变量的评估使得算法模型如何读取视觉编码是可测量的,与人类感知相当,并且更容易被人类解释。

以 Stevens 幂律检查 GPT-5.5 的视觉图表读取:论文原图
图 4:测量方法 II:视觉变量之间的误差。点显示平均对数绝对误差,条形显示 95% bootstrap 置信区间。字母表示 Tukey HSD 组;共享一个字母的变量在误差上没有显着差异。