Learning
VOL. XXX · NO. 05 · Evolutionary Psychology & Game Theory · 01 JAN 1970

博弈论基础:纳什均衡与均衡选择

进化心理学与博弈论 · 01 JAN 1970 · 5 min read · 1,289 words
· · ·

策略互动的基本框架——每个玩家最优策略的交叉点

**预计时间:**25 分钟读 + 10 分钟做习题 = 35 分钟。

本课方法论承诺
读完这节课,你将掌握: 博弈论的基本要素——玩家/策略/收益; 纳什均衡——每个玩家给定对手策略时的最优响应; 多重均衡与均衡选择——协调问题与 focal point。

一、核心概念定义

博弈论的基本要素

博弈(Game)

  • 玩家(Players):决策主体
  • 策略(Strategies):每个玩家的可选行动集合
  • 收益(Payoffs):每个策略组合对应的结果(效用/金钱)

表示方法:收益矩阵( normal form )或博弈树( extensive form )。

纳什均衡(Nash Equilibrium)

定义:策略组合 s* 是纳什均衡,如果给定其他玩家的策略,没有玩家愿意单方面偏离

公式:对所有 i, ui(si, s-i) ≥ ui(si, s*-i) 对所有 si ∈ Si

通俗理解:每个玩家都在做”给定对手选择时的最优反应”→ 没人有动力单方面改变。

多重均衡与均衡选择

囚徒困境:单一纳什均衡(都背叛) 协调博弈:多重均衡(如开车靠左 vs 靠右)

均衡选择机制

  • 焦点均衡(Focal Point, Schelling):显著/自然的均衡被选择(如”12 点见面”)
  • 历史路径:历史先例锁定均衡
  • 制度/规范:外部规则强制均衡

二、学科直觉

  1. 纳什均衡 ≠ 最优结果:PD 中(都背叛)是纳什均衡但不是帕累托最优(都合作更好)。这是博弈论最反直觉的洞见——稳定 ≠ 好
  2. 均衡选择是博弈论的核心难题:如果有多个纳什均衡,玩家如何协调到”正确”的?现实中的协调通常通过先例/惯例/制度完成——这些都是”过去的均衡选择”。
  3. 博弈论是”策略互动的通用语言”:从国际关系(核威慑)到商业(定价博弈)到生物学(进化稳定策略 ESS )——所有涉及”我的选择取决于你的选择”的场景都可以用博弈论建模。

三、跨学科应用

商业:定价博弈

两家公司定价:

  • 都高价:各赚 100
  • 都低价:各赚 30
  • 一高一低:高价亏 20,低价赚 80

纳什均衡:都低价(30+30)→ 类似 PD,都高价(100+100)是帕累托最优但不是均衡。

制度解决方案
定价困境的解决方案:(1) 价格领导(一家定高价,另一家跟随);(2) 合谋(卡特尔——但违法);(3) 产品差异化(避免直接竞争)。这些都是"把 PD 变成非 PD 博弈"的制度创新。

国际关系:核威慑

美苏冷战:

  • 都裁军:各得 100(和平)
  • 都扩军:各得 20(军备竞赛)
  • 一扩一裁:扩军得 80,裁军亏 50

纳什均衡:都扩军(20+20)→ 囚徒困境。

解决方案:信任机制(核查条约)+ 重复博弈(多次谈判)+ 焦点均衡(“共同安全”)

练习题

单选题

1

博弈论的基本要素不包括?

2

纳什均衡的核心是?

3

囚徒困境的纳什均衡是?

4

帕累托最优 vs 纳什均衡的关系是?

5

多重均衡的"选择"机制是?

6

协调博弈的例子是?

7

ESS(进化稳定策略)是?

案例分析

C1

C1. 案例:两家互联网公司同时决定是否进入新市场。都进入:各亏 100;都不进:各赚 50;一家进一家不进:进者赚 200,不进者亏 50。纳什均衡?

反事实思考题

T1

T1. 反事实:如果所有博弈都有唯一的帕累托最优纳什均衡(没有多重均衡/效率损失)。社会形态?

下一步:Lesson 0006 · 零和博弈与谈判理论