# 囚徒困境

> 囚徒困境（英语：Prisoner's dilemma）、囚犯两难是博弈论的非零和博弈中具代表性的例子，反映个人最佳选择并非群体的最佳选择，且在一个群体中，个人做出理性选择却往往导致集体的非理性。虽然这是一个理论上的情境，但现实中的价格竞争等也会出现类似情况。 单次发生的囚徒困境，和多次重复的囚徒困境结果不会一样。 在重复的囚徒困境中，博弈被反复地进行。因而参与者都有机会去“惩罚”另一个参与者前一回合的不合作行为。这时，合作可能会作为均衡的结果出现。欺骗行为被受到惩罚的威胁所制止，从而导向一个较好的结果。当次数接近无限，纳什均衡趋向于帕累托最优。 当囚徒们可以互相沟通时，彼此合作可为全体带来最佳…

- ID: m04626
- 分类: decide
- 领域: 博弈论

## 定义

两个共谋犯罪的人被分开审讯。如果两人都保持沉默（合作），各判1年；如果一人背叛而另一人沉默，背叛者获释，沉默者判3年；如果两人都背叛，各判2年。个体理性选择导致集体非最优结果。脚手架作用： 信任机制的试金石。它解释了为什么即使合作对双方都有利，个体仍可能选择背叛。在商业合作、国际关系、环境保护中，建立长期重复博弈（声誉机制、惩罚机制）是破解囚徒困境的关键。

## 机制

囚徒困境是两人各自选择“合作”或“背叛”的博弈：对个体而言背叛是占优策略，但双方都背叛的结果比都合作更差，揭示个人理性导致集体非理性。

## 练习

识别情境中是否存在“单方背叛有益、双方背叛更糟”的结构；通过重复博弈、声誉、契约改变激励；引入惩罚或奖励使合作成为稳定均衡；设计制度让合作者不吃亏。

## 脚手架用法

信任机制的试金石。它解释了为什么即使合作对双方都有利，个体仍可能选择背叛。在商业合作、国际关系、环境保护中，建立长期重复博弈（声誉机制、惩罚机制）是破解囚徒困境的关键。

[阅读网页](https://thinkingmodels.site/entries/detail/m04626)
