囚徒困境計算器
分析雙人報酬矩陣、驗證經典困境條件,並找出納許均衡。
賽局報酬分析
輸入標準囚徒困境使用的四項對稱報酬。
關於囚徒困境計算器
囚徒困境是賽局理論的基礎模型。兩位參與者各自決定合作或背叛,行動前都無法觀察對方當前的選擇。四個報酬值描述可能的結果。雙方合作時,各自獲得獎勵 R。只有一方背叛時,背叛者得到誘惑報酬 T,合作方則得到受損報酬 S。雙方背叛時,各自得到懲罰報酬 P。本計算器檢查標準排序 T > R > P > S,這個排序形成了定義此困境的衝突。
排序成立時,對每位參與者而言,背叛都嚴格優於合作。如果對方合作,背叛可獲得 T,而非 R。如果對方背叛,選擇背叛可獲得 P,而非 S。因此,理性參與者無論預期對方如何行動,都會選擇背叛。雙方背叛的策略組合構成納許均衡,因為任何一方都無法只靠單獨改變策略來提高報酬。然而,由於 R 大於 P,雙方合作原本可以讓兩人都得到更多。個人誘因導致了對集體較差的結果。
計算器使用對稱報酬矩陣,亦即雙方共用相同的四個數值,遇到非對稱結果時則互換報酬位置。它會判斷輸入數值是否構成一般囚徒困境,並解釋均衡與合作結果。報酬可以代表免除的刑期年數、金錢、效用點數、市占率、演化適存度,或任何數值越大越好的統一尺度。基本分類只取決於數值排序。
單次賽局分析不表示現實生活中背叛永遠是明智選擇。在重複賽局中,參與者可以獎勵過去的合作並懲罰過去的背叛。當未來互動夠重要時,以牙還牙等策略可支持合作。溝通、可執行契約、聲譽、社會規範與不確定性也會改變誘因。請先用本工具檢視基礎的單回合賽局,再考慮實際情境是否包含簡單模型以外的重複互動或制度。
此模型常見於經濟學、政治學、生物學、資安、環境政策與談判。競爭企業可能都偏好穩定價格,卻各自有削價競爭的誘因。國家可能從相互裁軍中受益,卻各自擔心單方面克制。個人可能受益於保護共有資源,同時又能從過度使用獲取私利。將情境轉換為明確報酬,可以呈現策略衝突,協助區分真正的困境與一般協調問題。
囚徒困境範例
| 報酬 (T, R, P, S) | 分類 | 解讀 |
|---|---|---|
| 5, 3, 1, 0 | 經典困境 | 背叛是優勢策略,儘管雙方合作可獲得 3,而非 1。 |
| 10, 7, 2, -1 | 經典困境 | 即使單方合作的受損報酬為負,排序仍然成立。 |
| 3, 5, 1, 0 | 不構成困境 | 合作報酬高於單方面背叛,因此沒有背叛誘惑。 |
如何分析賽局
- 輸入雙方合作時每位參與者獲得的獎勵。
- 輸入誘惑報酬、單方合作的受損報酬與雙方背叛的懲罰報酬。
- 選取「分析賽局」,檢查標準報酬排序。
- 比較納許均衡與對整體較有利的合作結果。
囚徒困境常見問題
什麼樣的賽局是囚徒困境?
其報酬符合 T > R > P > S,因此背叛嚴格優於合作。然而,雙方合作對每個人都比雙方背叛更好。
納許均衡是什麼?
在單次對稱賽局中,雙方都背叛。當對方持續背叛時,任何一方改為合作都無法改善自身報酬。
報酬可以是負數嗎?
可以,因為報酬是相對效用值,也可代表成本或損失。決定分類的是排序,而非正負號。
重複互動的參與者為什麼可能合作?
未來的獎勵與懲罰可讓當前合作變得有價值。聲譽和依先前回合調整的策略,會改變單次賽局的誘因。
合作結果是均衡嗎?
在基本的單次困境中不是,因為任何一方都能透過單方面背叛獲利。外部約束或重複互動可能維持合作。