第686章 职场小建议 失败是成功之母从失败中学习总结从新开始(第17页)
都沉默:各判1年;
?
一人坦白:坦白者释放,沉默者判10年;
?
都坦白:各判5年。
最优策略是坦白(尽管结果对双方都不好),这个策略组合就是一个纳什均衡。
3.2
支配策略与支配均衡
?
强支配策略:无论对方怎么选,这个策略始终给自己带来更高的收益。
?
如果所有玩家都有强支配策略,那么组合后的结果就是“支配均衡”
。
3.3
混合策略博弈
在有些博弈中,没有纯策略纳什均衡,玩家采用概率策略组合。
例如石头剪刀布,每个选择的概率为13
是一个混合策略均衡。
3.4
重复博弈与声誉机制
现实中的很多博弈是反复进行的,比如商业竞争、人际互动。
?
单次博弈容易出现投机行为;
?
重复博弈中,玩家为了长期收益,可能选择合作;
?
声誉机制鼓励“好行为”
,惩罚“背叛者”
。
这解释了为什么在现实社会中合作比理论中更容易实现。
?
四、博弈论的扩展模型
4.1
不完全信息博弈:贝叶斯博弈
引入信念系统(belief
system):
?
玩家不清楚对手的具体类型(比如风险偏好、资金状况),但可以基于概率分布做判断;
?
贝叶斯纳什均衡是在信念给定的前提下,每个人选择对自己最优的策略。
本章未完,点击下一页继续阅读