囚徒困境

2023-02-28 10:29:14   文档大全网     [ 字体: ] [ 阅读: ]

#文档大全网# 导语】以下是®文档大全网的小编为您整理的《囚徒困境》,欢迎阅读!
囚徒,困境
囚徒困境(Prisoner's dilemma)

1.囚徒困境简介

囚徒困境是博弈论中具有代表性的例子,反映个人最佳选择并非团体最佳选择。虽然困境本身只属模型性质,但现实中的价格竞争、环境保护等方面,也会频繁出现类似情况。

囚徒困境最早是由美国普林斯顿大学数学家阿尔伯特·塔克(Albert tucker1950年提出来的。他当时编了一个故事向斯坦福大学的一群理学们解释什么是博弈论,这个故事后来成为博弈论中最著名的案例。故事内容是:两个嫌疑犯(AB)作案后被警察抓住,隔离审讯;警方的政策是坦白从宽,抗拒从严,如果两人都坦白则各判8 年;如果一人坦白另一人不坦白,坦白的放出去,不坦白的判10年;如果都不坦白则因证据不足各判1年。

囚徒困境的主旨为,囚徒们虽然彼此合作,坚不吐实,可为全体带来最佳利益(无罪开释),但在资讯不明的情况下,因为出卖同伙可为自己带来利益(缩短刑期),也因为同伙把自己招出来可为他带来利益,因此彼此出卖虽违反最佳共同利益,反而是自己最大利益所在。但实际上,执法机构不可能设立如此情境来诱使所有囚徒招供,因为囚徒们必须考虑刑期以外之因素(出卖同伙会受到报复等),而无法完全以执法者所设立之利益(刑期)作考量。

2.经典的囚徒困境

1950年,由就职于兰德公司的梅里尔·弗拉德(Merrill Flood)和梅尔文·德雷希尔(Melvin Dresher)拟定出相关困境的理论,后来由顾问阿尔伯特·塔克(Albert Tucker)以囚徒方式阐述,并命名为囚徒困境。经典的囚徒困境如下:

警方逮捕甲、乙两名嫌疑犯,但没有足够证据指控二人入罪。于是警方分开囚禁嫌疑犯,分别和二人见面,并向双方提供以下相同的选择:



若一人认罪并作证检举对方(相关术语称背叛对方),而对方保持沉默,此人将即时获释,沉默者将判监10年。

若二人都保持沉默(相关术语称互相合作),则二人同样判监半年。 若二人都互相检举(互相背叛),则二人同样判监2年。

表格概述如下:

甲沉默(合作) 甲认罪(背叛) 甲即时获释;乙服刑10

乙沉默(合作) 二人同服刑半年

乙认罪(背叛) 甲服刑10年;乙即时获释 二人同服刑2

如同博弈论的其他例证,囚徒困境假定每个参与者(即囚徒)都是利己的,即都寻求最大自身利益,而不关心另一参与者的利益。参与者某一策略所得利益,如果在任何情况下都比其他策略要低的话,此策略称为严格劣势策略,理性的参与者绝不会选择。另外,没有任何其他力量干预个人决策,参与者可完全按照自己意愿选择策略。

囚徒到底应该选择哪一项策略,才能将自己个人的刑期缩至最短?两名囚徒由于隔绝监禁,并不知道对方选择;而即使他们能交谈,还是未必能够尽信对方不会反口。就个人的理性选择而言,检举背叛对方所得刑期,总比沉默要来得低。试设想困境中两名理性囚徒会如何作出选择:




若对方沉默、背叛会让我获释,所以会选择背叛。

若对方背叛指控我,我也要指控对方才能得到较低的刑期,所以也是会选择背叛。

二人面对的情况一样,所以二人的理性思考都会得出相同的结论——选择背叛。背叛是两种策略之中的支配性策略。因此,这场博弈中唯一可能达到的纳什均衡,就是双方参与者都背叛对方,结果二人同样服刑2年。 这场博弈的纳什均衡,显然不是顾及团体利益的帕累托最优解决方案。以全体利益而言,如果两个参与者都合作保持沉默,两人都只会被判刑半年,总体利益更高,结果也比两人背叛对方、判刑2年的情况较佳。但根据以上假设,二人均为理性的个人,且只追求自己个人利益。均衡状况会是两个囚徒都选择背叛,结果二人判决均比合作为高,总体利益较合作为低。这就是困境所在。

3.囚徒困境的应用

许多行业的价格竞争都是典型的囚徒困境现象,每家企业都以对方为敌手,只关心自己的利益。在价格博弈中,只要以对方为敌手,那么不管对方的决策怎样,自己总是以为采取低价策略会占便宜,这就促使双方都采取低价策略。如可口可乐公司百事可乐公司之间的竞争、各大航空公司之间的价格竞争等等。

在国内的家电大战中,虽然不是两个对手之间的博弈,但由于在众多对手当中每一方的市场份额都很大,每一个主体人的行为后果受对手行为的影响都很大,因此,其情景大概也是如此。如果清楚这种前景,双方勾结或合作起来,都制定比较高的价格,那么双方都可以因为避免价格大战而获得较高的利润。但是往往这些联盟处于利益驱动的囚徒困境,双赢也就成泡影。五花八门的价格联盟总是非常短命,道理就在这里。

并不是每次个人的理性选择都能让自我利益最大化,也许会让你陷入一个囚徒困境大量例子说明,徒困境中,常常是先动手的一方会占一些优势。那么,先下手为强吧。

现实的例子

现实中,无论是人类社会或大自然都可以找到类似囚徒困境的例子,将结果划成同样的支付矩阵 社会科学中的经济政治社会,以及自然科学动物行动学进化生物学学科,都可以用囚徒困境分析,模拟生物面对无止境的囚徒困境博弈。囚徒困境可以广为使用,说明这种博弈的重要性。以下为各界例子:

政治学例子:军备竞赛

政治学中,两国之间的军备竞赛可以用囚徒困境来描述。两国都可以声称有两种选择:增加军备(背叛)或是达成削减武器协议(合作)。两国都无法肯定对方会遵守协议,因此两国最终会倾向增加军备。似乎自相矛盾的是,虽然增加军备会是两国的「理性」行为,但结果却显得「非理性」(例如会对经济造成都有损坏等)。这可视作遏制理论推论,就是以强大的军事力量来遏制对方的进攻,以达到和平。

经济学例子:关税战

两个国家,在关税上可以有以两个选择: 1)提高关税,以保护自己的商品。 (背叛)

2)与对方达成关税协定,降低关税以利各自商品流通。 (合作)

当一国因某些因素不遵守关税协定,而独自提高关税(背叛)时,另一国也会作出同样反应(亦背叛),这就引发了关税战,两国的商品失去了对方的市场,对本身经济也造成损害(共同背叛的结果)。然后二国又重新达成关税协定。 (重复博弈的结果是将发现共同合作利益最大。)

商业例子:广告

商业活动中亦会出现各种囚徒困境例子。以广告竞争为例。


本文来源:https://www.wddqxz.cn/4f6455c033687e21af45a9b6.html

相关推荐