b2科目四模拟试题多少题驾考考爆了怎么补救
b2科目四模拟试题多少题 驾考考爆了怎么补救

纯策略纳什均衡(2)

电脑杂谈  发布时间:2016-05-23 11:00:54  来源:网络整理

从上述的例子我们可以看出,有多个纯策略纳什均衡的博弈重复两次的子博弈完美纳什均衡路径是,第一阶段采用(H,H),第二阶段采用原博弈的纳什均衡(M,M).

如果这个重复博弈重复三次,或者更多次,结论也是相似的,仍然用触发策略,它的子博弈完美纳什均衡路径为除了最后一次以外,每次都采用(H,H),最后一次采用原博弈的纳什均衡(M,M).

[编辑]

存在纯策略纳什均衡的无限次重复博弈

与有限次重复博弈一样,无限次重复博弈也是基本博弈的简单重复,但是无限次重复博弈没有最后一次重复,因此无限次重复博弈与有限次有一些不同.

任何博弈中博弈方策略选择的依据都是得益的大小,这在重复博弈中仍然是成立的.但是重复博弈又与一次性博弈有所不同,因为在重复博弈中,每一阶段都是一个博弈,并且各博弈方都有得益,因此对于重复博弈,我们要计算的就是博弈结束时的一个总的得益.由于前一次博弈和后一次博弈之间会有损失,因此我们采用一种方法,就是将后一阶段的得益折算成当前阶段得益的(现在值)的贴现系数δ.有了贴现系数δ,那么在无限次重复博弈中,某博弈方各阶段得益为π1,π2,...,则该博弈方总得益的现在值为:

对于存在惟一纯策略纳什均衡博弈的无限次重复博弈,我们从下面的例子来看:

其中博弈方1和博弈方2分别表示两个厂商,H和L分别表示高价和低价.显然,该博弈的一次性博弈有惟一的纯策略纳什均衡(L,L),但是这个纳什均衡并不是最佳策略组合,因为策略组合(H,H)的得益(4,4)比(1,1)要高的多.但是由于(H,H)不是该博弈的纳什均衡,所以在一次性博弈中不会被采用.根据上面的分析,此博弈在有限次重复博弈并不能实现潜在的合作利益,两博弈方在每次重复中都不会采用效率较高的(H,H).为了实现效率较高的合作利益(H,H),假设两博弈方都采用触发策略,也即报复性策略:第一阶段采用H,在第t阶段,如果前t-l阶段的结果都是(H,H),则继续采用L.假设博弈方1已经采用了这种策略,现在我们来确定博弈方2在第一阶段的最优选择.如果博弈方2采用L,那么在第一阶段能得到5,但这样会引起博弈方1一直采用L的报复,自己也只能一直采用L,得益将永远为1,总得益的现在值为

如果博弈方2采用H,则在第一阶段他将得4,下一阶段又面临同样的选择.若记V为博弈方2在该重复博弈中每阶段都采用最佳选择的总得益现在值,那么从第二阶段开始的无限次重复博弈因为与从第一阶段开始的只差一 阶段,因而在无限次重复时可看作相同的,其总得益的现在值折算成第一阶段的得益为,因此当第一阶段的最佳选择是H时,整个无限次重复博弈总得益的现在值为

时,博弈方2会采用H策略,否则会采用L策略.也就是说当时,博弈方2对博弈方1触发策略的最佳反应是第一阶段采用H.这时我们就说双方采用上述触发策略是一个纳什均衡.


本文来自电脑杂谈,转载请注明本文网址:
http://www.pc-fly.com/a/shenmilingyu/article-6004-2.html

相关阅读
    发表评论  请自觉遵守互联网相关的政策法规,严禁发布、暴力、反动的言论

    热点图片
    拼命载入中...