导图社区 重复博弈思维导图
经济博弈路第三章重复博弈,知识内容有概念理解、有限重复博弈、无限次重复博弈等,希望梳理的内容对你有所帮助!
提示: 本内容由社区用户上传并分享。平台不对内容的真实性、合法性、知识产权归属及是否侵害第三方权利进行事前审核或保证。本内容可能包含受版权保护的图片、字体或其他第三方素材,使用前请自行确认授权范围。
经管类学生公司治理课程期末复习总结,包括内容为:机构投资者的种类和特点、机构投资者参与公司治理的机理分析、机构投资者在公司治理中的作用
经管类学生公司治理课程期末复习总结,包括内容为:公司科层契约、公司治理的基本框架与边界、公司治理的目标及理论
经管类学生公司治理课程期末复习总结,包括内容为:外部控制主导型公司治理模式、内部控制主导型公司治理模式、家族控制型公司治理模式
社区模板帮助中心,点此进入>>
管理学
【毛概】第三章 社会主义改造理论
计算机
中国近代史
14章企业经营战略的实施和控制
管理学第一章
美术生所能报考专业
社会学概论新修
计算机专业信息资源管理
第三章 领导的职能和原则
第三章 重复博弈
概念理解
重复博弈是在每一周期中参与人面对相同的博弈,经典的重复博弈理论中,相同的博弈,是指相同的参与人集合、相同的可行行为空间或策略空间、相同的支付函数
重复博弈属于动态博弈,因为它不是一次性的选择,而是分阶段有先后次序的一个动态选择过程,但每个阶段本身都能构成一个完整的静态博弈
在重复博弈中,可信性是非常重要的概念,即子博弈完美性,仍是判断均衡是否稳定可靠的重要判断依据,由于重复博弈中有长期利益对短期行为的制约作用,因此有些在一次性博弈中不可置信的威胁或诺言,在重复博弈中会变为可信的,从而使博弈的均衡、结果出现更多的可能性
君子报仇,十年不晚
意义
重复博弈会迫使博弈方考虑未来、长期的利益,对博弈方的行为造成约束影响博弈方的策略选择和博弈结果
有限重复博弈
定义
给定一个博弈G,重复进行T次G,并且在每次重复前,各方都能观察到以前博弈的结果,此博弈过程称为G的一个“T次重复博弈”,记为G(T),而 G为G(T)的原博弈,G(T)中的每次重复称为G(T)的一个阶段。
注释(一些概念的扩张)
(1)子博弈的概念是从某一阶段(不包含第一阶段)开始,包括此后所有阶段的原重复博弈的一部分仍是重复博弈或就是原博弈
(2)策略的概念是指各博弈方在每个阶段针对每种情况如何行动的计划
(3)在重复博弈中,“路径”则是由每个阶段的博弈结果依次连接而成,同样也是各博弈方相应的策略组合所对应的结果
有限重复猜硬币博弈
猜硬币博弈是一个零和博弈
重复零和博弈,不会创造出新的利益
重复进行猜硬币博弈,不管两个博弈方如何选择,每次重复的结果都是一方赢、一方输数,得益相加为0
它不存在纯策略解,而具有唯一的混合纳什均衡(0.5,0.5),相应的期望收益均为0,因此双方合作的可能性根本不存在,即使重复多次博弈也不会改变,即他们不会顾及对方的利益而变得合作,所以有猜硬币博弈作为原博弈构成的重复博弈中,每博弈方的唯一正确的策略,是在每次重复时都采用一次性博弈中所采取的纳什均衡策略,即各以0.5概率随机选择正、反面的混合策略。双方每次重复的平均期望得意与期望总得益都为0。
在零和博弈中,不存在双方合作的可能性
含义
所有以零和博弈为原博弈的重复博弈与猜硬币博弈所构成的重复博弈一样,各博弈方的正确策略就是在每次重复中都采用一次性博弈中的纳什均衡策略
唯一纯策略纳什均衡博弈的有限次重复博弈
首先,容易理解的是
如果原博弈唯一的纯策略纳什均衡本身是帕累托效率意义上的最佳策略组合,能够实现所有博弈方的最大利益,重复博弈显然不会改变博弈方的行为方式
值得关心的是原博弈唯一的纳什均衡没有达到帕累托效率,存在通过合作提高效率可能性的囚徒困境型博弈,是否能通过重复博实现合作结果
有限重复囚徒困境型博弈
此博弈构成二次重复博弈,两博弈方先进行第一次博弈,之后双方看到第一次的结果,然后进行第二次博弈 因为重复博弈的全过程是一种动态博弈过程,故可以用逆向归纳法来分析双方在各阶段的选择 第二阶段,前一阶段的结果已成为事实,之后又不存在任何后续阶段,因此实现自身在本阶段的最大利益是双方在该阶段决策的唯一原则,这样第二阶段博弈的唯一结果就是原博弈的一次性博弈的唯一的纳什均衡(L1,L2),双方的得益为(1,1)
第一阶段,双方都知道在第二阶段的博弈结果,因此,整个两次重复博弈的结果,就是在双方在本阶段的得益各+1,此重复博弈,等价于下列矩阵所表示的一次性博弈
这样,两次重复博弈的囚徒困境型博弈的第一阶段,双方的策略与原博弈一次性博弈的策略也是一样的
两次重复博弈的囚徒困境型博弈,相当于独立进行两次一次性的囚徒困境博弈,然后再把两次独立博弈的得益相加,这个结果具有一般意义
定理
设原博弈G有唯一的纯策略纳什均衡,则对任意正整数,重复博弈G(T)有唯一的子博弈完美的解,即各博弈方每个阶段都采用G的纳什均衡。各博弈方在G(T)中的总得益为在G中得益的T倍,平均每阶段的得益等于原博弈的得益
有两个纳什均衡的重复博弈P142
如果两市场重复博弈的次数进一步增加,到3次或者更多次,可能使博弈结果进一步改善
民间定理P146
在有多个纯策略纳什均衡的博弈以及其重复博弈有着多种均衡的、子博弈完美均衡的结果,我们能指出重复博弈时所有可能均衡路径及相应的得益,但无法指出哪一条均衡路径必然出现,这就存在着结果的不确定性
然而,我们至少可以对博弈方不管其他方的行为如何,只要自己的行为合理就能保证获得收益——“个体理性得益”进行考察,以确定能实现得益的分布范围
设原博弈的一次性博弈有均衡M,那么在该博弈的多次重复中,所有的个体理性得益和可实现得益都至少有一个子博弈完美纳什均衡的平均得益来实现它
其中,Mi为博弈方i在一次性博弈中最差的均衡得益,M为各博弈方的Mi构成的得益数组
多种选择策略的博弈的重复博弈 (针尖对麦芒策略)
触发策略
先试探合作,一旦发觉对方不合作就用不合作报复得策略
两次重复博弈的路径中包括的子博弈完美纳什均衡中可在第一阶段采用非原博弈的均衡策略组合
你不让我好,我就不让你好
连锁店悖论
无限次重复博弈
特征
不存在作为最后一阶段得最后一次重复
分析存在的困难
1.逆向归纳法无法直接运用
2.各博弈方的各阶段的得益总和可能趋于无穷大
民间定理
两个概念
可实现的得益
阶段博弈中各纯策略组合得益的加权平均所构成的得益数组,其中权数非负且总和为1
平均得益
无限次重复博弈及其得益
无限次重复博弈囚徒困境型博弈
你对我好,我也对你好
但如果构成重复博弈的原博弈有多于一个的纯策略纳什均衡,则重复博弈就可能有多个子博弈的完美纳什均衡
如果造价成本很高,则造假数量会大幅减少
零和博弈与囚徒困境型博弈的重复博弈不能给博弈方带来比一次性博弈更好的结果,每阶段的平均得益与一次性博弈的得益相同
在管理中,给一定的自由,但是自由是有范围的
零和博弈
如果一个国家的所有事情都是零和博弈,则无法发展,别人发展好,别人财富增加了,自己也会得到好处,人与人需要合作