石头剪刀布数据
每个计数都需要一个分母;每个行为结果都需要一个人群和一套流程。
WRPSA 数据在实时 WRPSA 账本中分别统计记录行数、已进行的比赛、已结算的回合、参与者出场次数、真人对真人的比赛、真人对 AI 的比赛、质量异常,以及可用于研究的记录。已发表的研究回答的是更窄的问题:2014 年的一项实验研究了 360 名浙江大学学生在重复的六人小组中的对局,2019 年的一篇论文分析了来自 2007 年某 Facebook 应用的超过 260 万场比赛。这两个数据集都不能确立一个通用的开局手势,也不能对每一个对手做出预测。
现在就来一局:你对战电脑
选一手出出看!
想和认识的人玩?

WRPSA 最新数据
采用明确分母统计的对局记录
这些实时汇总来自权威台账。记录行不自动等同于已进行的对局,一个已结算回合不会被算作两局,机器人出拳也不是人类观察值。
当前台账总数暂时无法使用,方法和定义仍可查阅。
查看方法、排除项与更正数学基准
在单回合对称零和模型中,以各 1/3 的概率独立地出石头、布和剪刀是一个纳什均衡。面对这种混合策略,没有任何固定的替代打法能获得更高的期望收益。这是模型下关于期望值的陈述,而不是对有限场次比赛的保证。
人类数据集可能偏离独立性或均匀选择,但结果取决于人群、界面、激励、信息和实验流程。没有任何经审阅的研究支持“每个选手都可预测或可被利用”这一说法。
观察到的动作频率只适用于特定数据集
2014 年浙江实验中被保留的参与者,平均出石头 0.36、布 0.33、剪刀 0.32,报告的选手间标准差分别为 0.08、0.07 和 0.06。这些是重复的、有激励的实验室对局,并不是全体玩家的代表性样本。
频率估计只有在附带来源、样本、观察时段、界面和不确定性时才有用。它本身无法证明存在通用的开局手势、身体上的破绽,或面对新对手时的稳定优势。
两个不同的研究人群
1. 重复的实验室对局(浙江大学,2014)
该实验招募了 360 名浙江大学学生,分成 60 个六人小组,在与现金挂钩的收益下进行 300 轮随机配对的对局。排除一个小组后,保留下来的 354 名选手的平均动作频率为石头 0.36、布 0.33、剪刀 0.32,选手之间差异很大。作者用赢–输–平条件反应来建模群体层面的循环。这一实验流程并不能确立一条通用的下一手规则。
Wang, Xu & Zhou (2014), Scientific Reports, doi:10.1038/srep05830
2. 2007 年某 Facebook 应用数据集(2019 年发表)
该论文分析了 2007 年 5 月 23 日至 8 月 14 日期间在 Roshambull Facebook 应用中记录的 2,636,417 场比赛。选手能看到一张列有对手历史的侦察表。作者报告称,选手会使用这些信息,而经验更丰富的用户用得更有效,也更有可能获胜。这些结果只属于那个界面、激励机制、时期和被观察的用户人群。
Batzilis et al. (2019), Games, doi:10.3390/g10020018
早先一项实验报告了面对面对局中的自动模仿效应,但一项规模更大的重复研究并不支持这一结论。因此,模仿结果应被视为存在争议,而不是公认的普遍规律。
一个假设的稳定优势如何复利
假设每个分出胜负的回合相互独立,同一名选手赢下每个分出胜负回合的概率恒为 55%,平局重打且不计入计算。在这个模型下:
- 单轮:你有 55% 的胜率。
- 三局两胜:你的比赛胜率升到约 57.5%。
- 五局三胜:约 59.3%。
当分出胜负回合的概率恒为 60% 时,同样的独立回合模型给出先赢三局的系列赛胜率为 68.3%。这些是二项系列赛的计算,并不能证明更长的赛制只衡量实力或消除了运气。赛事指南把赛制视为一项事先公布的赛事规则。
三手动作的有序序列正好有 27 种,因为三个位置各有三种选择,相乘得到 27 种序列。27 种开局套路中的名称是 WRPSA 的编辑性助记名;这个数目并不赋予任何序列固有的优势。
这些数字能支持什么、不能支持什么
- 没有任何经审阅的数据集能确立一个面对新对手时普遍最优的盲开手。
- 浙江实验中出现了依赢局而定的重复,但论文并不保证某个特定对手会重复。关于针对具体对手的检验,参见策略指南。
- 依输局而定的换手是某一个实验室模型的组成部分。应把它视为特定人群和流程下的结果,而不是针对陌生对手的下一手指令。
- 对手建模会增加假设和不确定性。心理学综述让实验室发现始终与其样本和流程绑定。
WRPSA 如何发布自己的数据
上方的当前面板读取权威的 WRPSA 账本,并分别标注每一个分母。对局界面按照带版本的来源规则写入记录;World RPS Day 纪念活动并不产生单独的人群估计。研究发布需要一个冻结的、经审阅的版本,以及方法、排除标准、观察时段和更正沿革。
参考文献
- Wang, Z., Xu, B., & Zhou, H.-J. (2014). Social cycling and conditional responses in the Rock-Paper-Scissors game. Scientific Reports 4:5830(arXiv:1404.5199)。
- Batzilis, D., Jaffe, S., Levitt, S., List, J. A., & Picel, J. (2019). Behavior in Strategic Settings: Evidence from a Million Rock-Paper-Scissors Games. Games 10(2):18。
- Cook, R., Bird, G., Lünser, G., Huck, S., & Heyes, C. (2011). Automatic imitation in a strategic context: players of rock-paper-scissors imitate opponents' gestures. Proceedings of the Royal Society B。 另见已发表的重复研究与评论。
