本节摘要:回推法要求每个决策者都看得见对方已走的每一步,现实常常不满足:你看不见对方抽了哪张牌,也不知道他成本高低。本节引入信息集把"看不见"写进树,区分不完美与不完全两种信息缺陷,再用信念把断掉的分析链重新接上——完美贝叶斯均衡的两条件由此登场,并用一个扩产威慑的数字案例把信念更新完整算出来。
第一章见过信息集的脸,本节正式启用它。信息集是同一参与者无法区分的决策节点的集合,画成虚线圈。轮到你在某个信息集行动时,你知道自己坐在圈里,却不知道坐在圈中哪个点上。完美信息博弈里每个信息集只装一个节点,回推畅通;一旦信息集装了多个节点,"该节点的后续最优"这种说法失去定义——你连在哪个子博弈里都不知道,怎么从终点回推?
先分清两种信息缺陷,术语上差一个字,建模上差一整章。对照表如下:
| 维度 | 不完美信息 | 不完全信息 |
|---|---|---|
| 看不见什么 | 对方已采取的动作 | 对方的类型(成本、估值、能力) |
| 规则与收益结构 | 公共知识 | 分布公共,类型私有 |
| 标准例子 | 打牌看不见底牌 | 拍卖不知对手估值 |
| 分析工具 | 信息集与子博弈精炼 | 类型、先验与贝叶斯均衡 |
| 归属 | 本章 | 第 4 章 |
海萨尼的处理办法是把右列归约成左列:虚构一个"自然"玩家先抽你的类型,只有你看得见抽签结果——不完全信息由此变成带类型抽签的不完美信息。本章处理前者,第 4 章处理翻译之后的世界。
信息集一旦含多个节点,当事人需要给"我实际在哪个节点"押一个主观概率,这个分布就叫信念。有了信念,回推的工具升级为序贯理性:在每个信息集上,给定信念,选择期望收益最高的行动。信念也不是随便押——它们必须与策略相容:若信息集被到达的概率为正,信念必须按贝叶斯法则从对方的实际策略算出来。这两条合起来就是完美贝叶斯均衡(PBE)的定义:策略在信念下序贯理性,信念在策略下贝叶斯一致。它们互相咬合:策略造出信念,信念又反过来支撑策略。
贝叶斯更新值得用数字走一遍,因为它是最容易被想错的一步。设面试池里能力强者占三成。能力强者八成会刷履历,能力弱者两成会刷。现在收到一份光鲜履历,能力强的后验概率是多少?按贝叶斯法则:分子是 P 强 × P 刷 given 强 = 0.3 × 0.8 = 0.24;分母再加 P 弱 × P 刷 given 弱 = 0.7 × 0.2 = 0.14,合计 0.38。后验 = 0.24 ÷ 0.38 ≈ 0.63。履历把判断从三成拉到六成三——证据有用,但远非决定性,因为弱者也学会了刷。这正是 4.2 节信号博弈要精确化的直觉:信号的价值取决于模仿成本。
背景。市场里有一个在位者与潜在进入者。在位者可能强势(扩产成本每单位 4)也可能虚弱(扩产成本 9),先验各半。进入者先看在位者的行动:在位者可以宣布并实际预建产能(扩产姿态),也可以维持现状;然后进入者决定进入与否。进入收益:对手不扩产时得 200;对手扩产且价格战时得 −80。在位者的收益:无进入且未扩产 400;无进入但扩产 400 减去成本;有进入且未扩产 150;有进入且扩产 150 减成本。
操作。分类推演。类型给定时行动是可回推的:虚弱在位者扩产成本 9,若进入仍发生,扩产后得 141 对不扩产 150——虚弱者扩产得不偿失;强势者扩产成本 4,扩产威慑若能挡住进入,得 396 对被进入后 146,值得。于是问题变成进入者的信念推断:看到扩产,遇到强势的概率多大?按分离信号推演:强势者扩产、虚弱者不扩产——此时扩产就是身份证明,进入者见到扩产信念更新为强势概率 1,退出;见到不扩产即虚弱,进入。检验无动机偏离:虚弱者若模仿扩产要花 9,且进入者仍会进入(因为一旦模仿成为习惯,信号失灵,信念回落),当期得 150 减 9 加后续信号崩塌损失——不划算。
结果。分离均衡成立:强势扩产、虚弱不扩产,进入者见扩产退、见空仓进。两类在位者各得其所:强势 396 或 400 量级,虚弱 150 加 400 的组合;进入者只在虚弱市场进入。
解读。信念计算的要点全在分母:看到扩产后强势概率 = P 强 × P 扩 given 强 ÷ 总概率。分离世界里 P 扩 given 弱 = 0,后验直接跳到 1;若虚弱者也偶尔扩产(比如三成),后验变成 0.5 × 1 ÷ (0.5 × 1 + 0.5 × 0.3) ≈ 0.77,信号变浊,威慑与放行都会动摇。信号的效力是稀缺性的函数——人人都发得起的信号一文不值,这条原理将在 4.2 节长成完整的信号博弈理论。
变式。把扩产成本改成两类都 6,分离不再自动成立,混同均衡(谁都摆姿态或谁都不摆)成为候选,均衡选择取决于进入者的偏离收益——这类多重均衡的裁决需要 4.2 节的完整工具。再把时序反过来(进入者先动、在位者后应),就回到 3.1 的完全信息进入博弈:信息结构与时序结构共同决定谁能唬住谁。
不是所有信号都要花钱。廉价磋商指免费、可撒谎、无执行力的沟通:员工自述"我可以加班"、候选人自荐"我学习能力强"。它何时可信?基准结论是利益一致时可信、利益冲突时无效。若双方对结果有完全相同的偏好(两个部门都想把项目排期谈顺),夸大与隐瞒没有任何好处,空谈会信息量十足——沟通的价值来自"说真话已是均衡"。若利益冲突,空谈的每一句都要过"他为什么要告诉我实话"的检验:卖方说"这房采光极好",你信不信取决于他的收益是否与你的判断挂钩。中间地带最微妙:偏好部分重叠时,空谈能传递粗粒度的信息(把类型分成几档),但传不了精细信息——顾问与客户的关系是标准样本:顾问想让项目变大(收入挂钩),客户想买对不买贵,于是顾问的话按"方向可信、幅度打折"处理,客户自己掌握折算系数。给管理者的操作建议:想听真话,先改收益,让说真话者的分成与真实信息值挂钩;只想听方向,空谈够用,别为精度付溢价。