纳什均衡
NASH EQUILIBRIUM // 谁都不想先动的那一点
> 给定其他所有人的策略,没有任何人能靠单方面改变自己的策略而获益——这个状态就叫纳什均衡。它不保证幸福,只保证稳定:一个谁都不想先动的僵局。价格战停火线、军备竞赛对峙、办公室内卷,都停在某条均衡线上——不是因为谁满意,而是因为谁先动谁吃亏。
Principle — 原理与来源
人物:约翰·纳什(John Forbes Nash Jr.,1928–2015)——美国数学家。1950 年在普林斯顿完成博士论文《非合作博弈》(Non-Cooperative Games),以不动点定理证明:任意有限博弈至少存在一个(混合策略)均衡。这篇论文只有 28 页,却是博弈论从"零和工具"变成"社会科学通用语言"的分水岭。
定义三拆:① 非合作——参与者不能签订有约束力的同盟(靠的是算计,不是契约);② 互为最优反应——每个人的策略都是对其他人策略的最佳回应;③ 单方面偏离无利——注意,是"单方面":多人同时改变可能人人受益,但没人能协调、也没人敢先动。
为什么它重要:在纳什之前,博弈论基本只解零和博弈(冯·诺依曼–摩根斯坦 1944);纳什均衡把"解"推广到任意利益冲突结构——从此经济学、政治学、演化生物学、计算机科学都有了分析"策略互动"的通用坐标系。
Apply — 均衡在哪儿运转
Simulate — 收益矩阵探测器:点击格子,找出均衡
Personal Takeaways — 个人启示 · 03
均衡 ≠ 好结果
囚徒困境的稳定点对双方都是坑。"大家都这么干"可能恰恰说明集体被困在一个坏均衡里,而不是这件事正确。先辨认你身处哪种博弈——坏均衡里的道德抱怨没有用,因为每个人的选择在他的信息下都是"对的"。
别劝人善良,去改收益结构
均衡由规则决定,不由愿望决定。想让行为改变,就去改 payoff:合同、惩罚、声誉、重复博弈(背叛的未来代价)——让合作的均衡比背叛的均衡更稳。机制设计就是这个思路的工程学:先想清楚要什么均衡,再反推游戏规则。
多重均衡时,预期会自我实现
协调博弈告诉你:选哪个均衡,靠的是共同预期(谢林焦点)。所以标准、惯例、叙事不是虚的——它们把人群协调到某条均衡线上。共识一旦形成便自我强化:相信它的人越多,它越是真的。