RPS 心理学
你的大脑非常不擅长随机。下面说说为什么这很重要。
人无法按要求随手生成一段随机序列,而石头剪刀布是证明这一点最短的演示。选手往往会重复刚刚赢下的那一手,输了之后换到循环中的下一种手势;而当双方能看见彼此时,他们会不自觉地模仿对面正在成形的那个手势,这让平局出现的频率高于概率的预测。竞技石头剪刀布,就是在对手身上察觉这些倾向、同时在自己身上压住它们的功夫。

博弈论:数学基础
在博弈论中,石头剪刀布被归类为有限的、二人的、同时行动的零和博弈。约翰·纳什证明了这类博弈总是至少存在一个均衡策略。对 RPS 来说,那就是每种出手都以正好 ⅓ 的概率出。
这个纳什均衡是不可被利用的:无论对手做什么,你的长期期望结果都恰好是平局。但它同时也是无法去利用别人的。随机出手不会让你获得优势,只能让你不输。竞技 RPS 的整个战略空间,就存在于数学上的完美与人类实际行为之间的那道缝隙里。而那道缝隙非常大。
人类为什么无法真正随机
几十年的认知科学证实了一件有点难堪的事:人类无法生成随机序列。当被要求给出一串“随机”的 RPS 出手时,人们总是会:
- 回避重复——人们换手的频率高于真正随机应有的频率,因为重复“看起来不随机”。其实并不是。你的大脑在骗你。
- 过度使用轮换——石-布-剪-石-布-剪感觉很随机,其实是一个完全可预测的循环。你只是在背这个游戏的名字。
- 让短序列“扯平”——连出两次石头之后,人会觉得必须换点别的来“平衡一下”。但每一轮都是独立的,宇宙并不记账。
这就是赌徒谬误在手势游戏中的版本:错误地相信过去的事件会影响未来的独立事件。在赌场,它让你输钱;在 RPS,它让你输比赛。
RPS 中的认知偏差
赢了不变、输了就换(WSLS)
这是 RPS 中最重要的一条行为规律。赢了之后,选手会重复刚才赢的那一手;输了之后,他们会改出那个本可以赢下对手上一手的手势。这深深植根于强化学习:有效的就重复,无效的就改变。逻辑上完全说得通,但也完全可以被利用。
Wang 等人(2014)在数千局对局中证实了 WSLS。它不只是常见,在未受训练的选手中几乎是普遍现象。只要你玩过 RPS,你就干过这事。你现在光是想到它,就正在这么干。
石头偏好
石头是所有人群和文化中最常见的开局手势。心理学家把这归因于具身认知:握紧的拳头让人感到有力且安全,那是手的默认姿势。你必须主动张开手才能出布,或者伸出手指才能出剪刀。石头在身体上和心理上都最省力。它是一个还没开始思考的人会出的那一手。
情绪预设
选手的情绪状态会以可测量的方式影响他们的出手:
- 挫败会提高石头的出现频率。人一生气就会握拳。这一点毫不含蓄。
- 焦虑会增加剪刀。那是一个更谨慎、更精确的手势,属于想太多的那一手。
- 自信会增加出手的多样性,并减少“赢了不变、输了就换”。冷静的人更难读。
决策疲劳
在长时间的比赛中,出手质量会下降。打过 10 到 15 轮之后,规律变得更明显,换手也从策略性变成反射性,“赢了不变、输了就换”开始自动接管。你的大脑会厌倦在三样东西之间做选择——这多少说明了一点关于大脑的事。赛事选手用套路(预先规划好的序列)和赛间的心理休息来应对这一点。
上头、压力与发挥
上头——这个扑克术语指情绪烦躁导致发挥下滑——在竞技 RPS 中杀伤力极大。连输几局之后,选手会:
- 放弃策略,改凭直觉出手(而直觉通常是错的)
- 打得更有攻击性,也就意味着出更多石头
- 陷入更快、更容易预测的 WSLS 循环
- 冲动地换手,指望“换换手气”(手气不是这么运作的)
顶尖选手能察觉自己的上头,更有价值的是,还能察觉对手的上头。用出人意料的打法或从容的自信刻意诱使对手上头,是一种正当的心理战术。有争议,但正当。规则里可没说你必须保持一张扑克脸。
社会与文化因素
RPS 中的行为还会受到谁在旁观、以及你在和谁玩的影响:
- 性别差异:一些研究显示开局手势的分布存在细微差异,但效应很小,并会随经验消失。RPS 在挫人锐气这件事上一视同仁。
- 观众效应:有人围观时,选手会出更多石头。那是“强”的一手。没人愿意当着一群人的面用布输掉。
- 文化规范:在集体主义文化中,选手的轮换规律可能有所不同,但最基本的偏差(WSLS、石头偏好)在所有有手的人群中都会出现。
- 熟悉度:对朋友,你会想太多;对陌生人,你会打出自己的默认习惯。两者都可以被利用,只是原因不同。
关键研究
- Wang、Xu、Zhou(2014)——《石头剪刀布游戏中的社会循环与条件反应》(Scientific Reports)。在 360 名参与者、每人 300 轮的实验中确认 WSLS 具有普遍性。这是有史以来最重要的 RPS 研究——这句话是认真的。
- Cook 等人(2009)——证明选手会受到细微预设线索的影响,且即使在受控条件下,RPS 也并非纯粹随机。
- Dyson 等人(2016)——表明负面情绪会加剧可预测的出手规律,尤其是石头。科学证实了每个连输三局的人早就知道的事。
- Kanouse 与 Hanson(1987)——关于重复博弈中 WSLS 启发式的早期研究,后来在 RPS 上得到专门验证。
RPS 教会我们关于决策的什么
石头剪刀布是一面镜子。它告诉我们:即使在最简单的决策环境里(三个选项,没有信息优势),人类也是可预测地不理性。我们会在没有规律的地方看出规律,会重复成功,会情绪化反应。这些倾向在人生的大多数场合里对我们有好处,但在一个奖励纯粹随机的游戏里,它们就变成了可被利用的弱点。
这也是为什么 RPS 被用在课堂上教概率、在心理学实验室里研究决策、在竞技场合中检验心理纪律。这个游戏的简单剥掉了一切,只留下人类选择机制赤裸裸地摆在眼前。而事实证明,那套机制有一些 bug。
