RPS 心理學
你的大腦非常不擅長隨機。以下是這件事為何重要。
人沒辦法說隨機就隨機地產生一串序列,而剪刀石頭布是最簡短的證明。玩家傾向重複剛剛獲勝的那一手,輸了之後換成循環中的下一種手勢,而且在看得到彼此的時候,還會不自覺地模仿對面正在成形的手勢 - 這讓平手出現的頻率高於機率所預測的。競技剪刀石頭布,就是在對手身上看出這些傾向、同時在自己身上壓下它們的功夫。

賽局理論:數學基礎
在賽局理論中,剪刀石頭布被歸類為有限、雙人、零和、同時出手的賽局。約翰・納許證明了這類賽局至少存在一個均衡策略。對 RPS 來說,那就是三種手勢各以剛好 ⅓ 的機率出。
這個納許均衡無法被利用:不論對手怎麼打,長期下來你的期望結果剛好就是平手。但它同時也無法利用別人。你不可能靠隨機出拳取得優勢,你只能做到不輸。競技 RPS 的整片策略版圖,就活在數學上的完美與人類實際行為之間的落差裡。而那道落差大得驚人。
為什麼人類無法真正隨機
數十年的認知科學證實了一件難堪的事:人類無法產生隨機序列。當被要求生出一串「隨機」的 RPS 出拳時,人們總是會:
- 避免重複 - 人們換手的頻率高於真正隨機該有的水準,因為重複「看起來不隨機」。但它其實是。你的大腦在騙你。
- 過度使用交替 - 石-布-剪-石-布-剪 感覺很隨機,其實是一個完全可預測的循環。你只是在背這個遊戲的名字而已。
- 把短序列「湊平均」 - 連出兩次石頭之後,人們會覺得非得出別的來「平衡一下」。但每一回合都是獨立的。宇宙不會幫你記帳。
這就是套用在手勢遊戲上的賭徒謬誤 - 錯誤地相信過去的事件會影響未來的獨立事件。在賭場裡,它讓你賠錢;在 RPS 裡,它讓你輸掉比賽。
RPS 中的認知偏誤
贏了就留、輸了就換(WSLS)
這是 RPS 中最重要的單一行為模式。贏了之後,玩家會重複剛才獲勝的那一手;輸了之後,他們會改出原本能贏過對手剛才那一手的手勢。這深植於增強式學習:重複有效的,改掉無效的。完全合乎邏輯,也完全可以被利用。
Wang 等人(2014)在數千場對局中證實了 WSLS。它不只是常見,在未受訓練的玩家之間幾乎是普遍現象。只要你玩過 RPS,你就做過這件事。你現在光是想到它,就正在做這件事。
石頭偏好
石頭是所有族群與文化中最常見的開局手勢。心理學家把這歸因於體現認知:握緊的拳頭讓人感覺有力又安全,那是手的預設姿勢。要出布,你得主動張開手;要出剪刀,你得伸出手指。石頭在生理與心理上都最不費力。那是還沒開始思考的人會出的一手。
情緒促發
選手的情緒狀態會以可測量的方式影響他的出拳:
- 挫折會提高出石頭的頻率。人生氣的時候會握拳,這一點都不隱晦。
- 焦慮會增加剪刀。那是一個比較謹慎、精細的手勢,屬於想太多的那一手。
- 自信會提高出拳的多樣性,並減少 WSLS。冷靜的人比較難讀。
決策疲勞
在冗長的比賽中,出拳品質會下降。打完 10 到 15 回合後,模式會變得更明顯,換手變得不再是策略而是反射,WSLS 則自動接管。你的大腦會厭倦在三樣東西之間做選擇 - 這件事本身就很說明問題。賽事選手會用招式(預先排好的序列)與場間的心理休息來管理這一點。
上頭、壓力與表現
上頭是撲克術語,指情緒挫折導致表現下滑,在競技 RPS 中殺傷力極大。連輸幾場之後,玩家會:
- 放棄策略,改靠直覺(而直覺通常是錯的)
- 打得更有侵略性,也就是出更多石頭
- 掉進更快、更好預測的 WSLS 循環
- 衝動地換手,希望「改改運」(運氣不是這樣運作的)
頂尖選手能察覺自己上頭,更划算的是察覺對手上頭。透過出乎意料的打法或沉著的自信刻意誘使對手上頭,是一種正當的心理戰術。有爭議,但正當。規則裡可沒說你必須保持撲克臉。
社會與文化因素
RPS 的行為也會被「誰在看」以及「你在跟誰打」所形塑:
- 性別差異:部分研究指出開局出拳分布可能有些微差異,但效果很小,且會隨經驗累積而消失。RPS 是個機會均等的謙卑製造機。
- 觀眾效應:被人注視時,玩家會出更多石頭 - 那個「強壯」的手勢。沒有人想在一群人面前用布輸掉。
- 文化規範:在集體主義文化中,玩家的交替模式可能有所不同,但基本的偏誤(WSLS、石頭偏好)在所有有手的人類身上都會出現。
- 熟悉度:面對朋友,你會想太多;面對陌生人,你會出你的預設值。兩者都可以被利用,只是理由不同。
重要研究
- Wang、Xu、Zhou(2014) - 〈Social cycling and conditional responses in the Rock-Paper-Scissors game〉(Scientific Reports)。在 360 位受試者、每人 300 回合的實驗中證實 WSLS 具普遍性。史上最重要的 RPS 研究 - 這句話是認真的。
- Cook 等人(2009) - 證明玩家會受到細微促發線索的影響,且即使在受控條件下,RPS 也並非純粹隨機。
- Dyson 等人(2016) - 顯示負面情緒會提高出拳模式的可預測性,尤其是石頭。科學證實了任何連輸三場的人早就知道的事。
- Kanouse 與 Hanson(1987) - 關於重複賽局中 WSLS 捷思法的早期研究,後來在 RPS 上獲得專門驗證。
RPS 教會我們什麼關於決策的事
剪刀石頭布是一面鏡子。它讓我們看見,即使在最單純的決策環境裡(三個選項、沒有資訊優勢),人類依然可預測地不理性。我們在沒有規律的地方看見規律,我們重複成功,我們情緒化地反應。這些傾向在人生的多數場合都對我們有利,但在一個獎勵純粹隨機的遊戲裡,它們就成了可被利用的弱點。
這也是為什麼 RPS 被用在課堂上教機率、在心理學實驗室裡研究決策,以及在競技場合中測試心理紀律。這個遊戲的簡單把一切都剝除了,只留下人類選擇最原始的運作機制赤裸裸地攤在眼前。而事實證明,那套機制有一些 bug。
