죄수의 딜레마 계산기

두 참여자의 보수 행렬을 분석하고 고전적 딜레마 조건을 확인하며 내시 균형을 찾습니다.

게임 보수 분석
표준 죄수의 딜레마에 사용되는 네 가지 대칭 보수를 입력하세요.

죄수의 딜레마 계산기 알아보기

죄수의 딜레마는 게임 이론의 기본 모형입니다. 두 참여자가 각자 협력 또는 배신을 선택하며, 행동하기 전에 상대의 현재 선택을 볼 수 없습니다. 네 보수값이 가능한 결과를 나타냅니다. 둘 다 협력하면 각자 보상 R을 받습니다. 혼자 배신한 사람은 유혹 보수 T를 얻고, 협력한 사람은 이용당한 보수 S를 받습니다. 둘 다 배신하면 각자 처벌 P를 받습니다. 이 계산기는 딜레마의 핵심 갈등을 만드는 표준 순서 T > R > P > S를 확인합니다. 이 순서가 성립하면 각 참여자에게 배신은 협력보다 엄격히 우월합니다. 상대가 협력하면 배신할 때 R 대신 T를 얻습니다. 상대가 배신하면 배신할 때 S 대신 P를 얻습니다. 따라서 합리적인 참여자는 상대가 무엇을 할 것으로 예상하든 배신을 선택합니다. 그 결과인 상호 배신은 어느 쪽도 혼자 전략을 바꿔 보수를 높일 수 없으므로 내시 균형입니다. 하지만 R이 P보다 크므로 상호 협력하면 두 사람 모두 더 많이 얻을 수 있습니다. 개인적 유인이 집단적으로 더 나쁜 결과를 낳습니다. 계산기는 대칭 보수 행렬을 사용합니다. 즉 두 참여자가 같은 네 값을 공유하고 비대칭 결과에서는 보수 위치가 서로 바뀝니다. 입력한 값이 전형적인 죄수의 딜레마를 이루는지 알려 주고 균형과 협력 결과를 설명합니다. 보수는 줄어드는 형량의 연수, 돈, 효용 점수, 시장 점유율, 진화적 적합도 등 값이 클수록 좋은 일관된 척도를 나타낼 수 있습니다. 기본 분류에서는 값의 순서만 중요합니다. 일회성 분석이 현실에서 언제나 배신하는 것이 합리적이라는 뜻은 아닙니다. 반복 게임에서는 과거의 협력에 보상하고 과거의 배신을 처벌할 수 있습니다. 미래 상호작용이 충분히 중요하면 팃포탯 같은 전략이 협력을 뒷받침할 수 있습니다. 의사소통, 강제력 있는 계약, 평판, 사회 규범과 불확실성도 유인을 바꿀 수 있습니다. 먼저 이 도구로 기초가 되는 단일 라운드 게임을 살펴본 뒤, 실제 상황에 단순 모형 밖의 반복이나 제도가 포함되는지 고려하세요. 이 모형은 경제학, 정치학, 생물학, 사이버 보안, 환경 정책과 협상에 등장합니다. 경쟁 기업은 모두 안정적인 가격을 원하면서도 가격을 낮출 유인이 있을 수 있습니다. 국가들은 상호 군축에서 이익을 얻지만 각자 일방적 자제를 두려워할 수 있습니다. 개인은 공유 자원 보전으로 이익을 얻는 동시에 과잉 사용으로 사적 이익을 얻을 수 있습니다. 상황을 명시적인 보수로 바꾸면 전략적 갈등이 드러나고 진정한 딜레마와 일반적인 조정 문제를 구별하기 쉬워집니다.

죄수의 딜레마 예제

보수 (T, R, P, S)분류해석
5, 3, 1, 0고전적 딜레마상호 협력하면 1 대신 3을 얻지만 배신이 우월 전략입니다.
10, 7, 2, -1고전적 딜레마혼자 협력했을 때의 보수가 음수여도 같은 순서가 성립합니다.
3, 5, 1, 0딜레마가 아님협력이 일방적 배신보다 보수가 높으므로 배신 유혹이 없습니다.

게임 분석 방법

  1. 둘 다 협력할 때 각 참여자가 받는 보상을 입력합니다.
  2. 배신 유혹 보수, 혼자 협력했을 때의 보수와 상호 배신 처벌을 입력합니다.
  3. 게임 분석을 선택해 표준 보수 순서를 확인합니다.
  4. 내시 균형과 사회적으로 더 나은 협력 결과를 비교합니다.

죄수의 딜레마 자주 묻는 질문

어떤 게임이 죄수의 딜레마인가요?

보수가 T > R > P > S를 따라 배신이 협력보다 엄격히 우월한 게임입니다. 그래도 상호 협력이 상호 배신보다 두 참여자 모두에게 더 좋습니다.

내시 균형은 무엇인가요?

일회성 대칭 게임에서는 둘 다 배신합니다. 상대가 계속 배신하는 동안 어느 쪽도 협력으로 바꿔 이익을 높일 수 없습니다.

보수가 음수여도 되나요?

네. 보수는 상대적인 효용값이며 비용이나 손실을 나타낼 수도 있습니다. 분류를 결정하는 것은 부호가 아니라 순서입니다.

반복해서 만나는 참여자는 왜 협력할 수 있나요?

미래의 보상과 처벌이 현재 협력을 가치 있게 만들 수 있기 때문입니다. 평판과 이전 라운드에 따른 전략이 일회성 유인을 바꿉니다.

협력 결과도 균형인가요?

기본적인 일회성 딜레마에서는 아닙니다. 어느 쪽이든 혼자 배신하면 더 많은 보수를 얻을 수 있기 때문입니다. 외부 강제력이나 반복 상호작용은 협력을 유지할 수 있습니다.