反过来做题
前十二章我们一直在做同一件事:给定一张表,找出人们会停在哪。这一章把题目倒过来——给定你想让人们停在哪,反推那张表该怎么写。这个方向有个名字叫机制设计,也被人半开玩笑地叫做「反向博弈论」。它是这本书从「看懂」转向「能做」的地方,也是母题翻转的地方:横杠竖杠不再是你要找的东西,而是你要挪的东西。
两个人分一块蛋糕。你是规则制定者,你希望的结果是他们平分。两个人都自私,都想多拿,而且你不在场——你只能事先定一条规则,然后走开。
问:定什么规则?
这道题几乎人人都知道答案。这一章要做的,是把这个人人都知道的答案拆开,看清楚它凭什么管用——然后把这套拆法用到不那么显然的地方去。
「一人切一人挑」凭什么管用
先看它不是靠什么管用的:
- 不靠道德——切的人可以完全不在乎公平;
- 不靠监督——你走开了,没人盯着;
- 不靠惩罚——规则里没有任何处罚条款;
- 不靠信息——你不需要知道谁更饿、谁更想吃。
它靠的是一件事:切的人切完之后,会拿到两块里较小的那一块。于是「切得平均」变成了他自己的最优应对。
用这本书的语言说:这条规则重写了收益表,让你想要的那个结果,恰好落在「没人后悔」那一格上。
机制设计的全部工作,就是把因果链倒过来接:
正着做(前十二章): 规则 ──▶ 收益表 ──▶ 均衡 ──▶ 结果 反着做(后十二章): 想要的结果 ──▶ 均衡必须落这儿 ──▶ 表该怎么写 ──▶ 规则
而反着做有一条硬约束,是整个下半本书的中心:你想要的那个结果,必须是参与者自己愿意去的地方。因为你不在场,你管不住他们;你唯一能做的是让他们自己想去。
三个必须满足的条件
一个机制要真的能用,得同时过三关。这三关值得单独记住,因为现实里失败的机制,几乎总是栽在其中一关上。
第一关:激励相容
每个参与者按你希望的方式行动,对他自己是最优的。切蛋糕的人认真切,是因为认真切对他最好,不是因为他答应过。
大多数机制死在这一关。「请大家如实填写工作量」「请诚实评估风险」——如果如实填写会让自己吃亏,这条规则就不是机制,只是愿望。
第二关:个人理性
参与者愿意参加。一个机制哪怕再精妙,如果参加它不如不参加,人们就会走开。
这一关经常被忽视,后果是机制在纸上完美、在现实里没人用。比如一个设计得很严谨的内部举报流程,如果举报人的预期收益是负的,流程本身再公正也不会有人走进来。
第三关:预算平衡(或者可行性)
你付得起。有些机制在数学上很美,但需要设计者自己往里贴钱。第 20 章会给你看一个具体的例子:有一套非常漂亮的机制能让所有人如实报出自己对公共品的估值,代价是它一定收不抵支——这不是实现得不好,是被证明了的。
把这套东西用到囚徒困境上
现在拿第 1 章那张表来练手。目标:让「一起合作」成为均衡。
先看清楚问题出在哪。囚徒困境的四个数是 T=5 > R=3 > P=1 > S=0。均衡在右下角,是因为两条不等式同时成立:
T > R ⇒ 对方合作时,我背叛更好 P > S ⇒ 对方背叛时,我背叛更好
要把均衡挪到左上角,只需要打破第一条。(第二条不用管——只要第一条破了,「一起合作」就是均衡,虽然「一起背叛」可能还在。)
而打破 T > R 有三种改法,它们改的是表里不同的位置:
| 改法 | 动的数 | 现实里长什么样 | 代价 |
|---|---|---|---|
| 压低背叛的好处 | T ↓ | 罚款、没收押金、违约金、封号 | 要有执法能力 |
| 抬高合作的好处 | R ↑ | 合作分成、团队奖金、联合采购折扣 | 要花钱 |
| 兜住被背叛的下场 | S ↑ | 保险、托管、平台赔付、七天无理由 | 要花钱,但只在出事时花 |
注意第三种:它不能单独打破 T > R,所以它一个人解决不了囚徒困境。但它有另一个作用——它能把囚徒困境变成猎鹿(第 3 章那张表),而猎鹿是个便宜得多的病。这一点常被忽略:很多机制的价值不是「解决问题」,而是「把问题换成一个更好治的问题」。
最小的那一处改动
用上面那台改表器试一下:只拖第一根滑杆(罚款),拖到 3 的时候,背叛得手从 5 掉到 2,低于一起合作的 3。这时候两道杠一起挪到左上角,均衡变成「一起合作」,两人合计从 2 分变成 6 分。
请注意这里发生了什么,和没发生什么:
- 没有人被说服;
- 没有人变得更信任对方;
- 没有人需要牺牲;
- 整个过程只动了一个数。
这就是这本书后半程的手感。它一开始会让人觉得有点冷血——不谈价值观,只谈数字。但它有一个很大的好处:它可以被检验。你说「加强沟通能解决这个问题」,没法验证;你说「把违约金提到 X,合作就会成为均衡」,可以当场算出 X 是多少,也可以事后看它对不对。
机制这个词在这里指的是一套规则:谁能做什么、什么时候做、做了以后各自得到什么。拍卖是机制,选举是机制,公司的绩效考核是机制,一个开源项目的 PR 合并流程也是机制。
与之相对,策略是参与者在给定机制下的行为。这本书前半讲策略,后半讲机制。
这门学问的开创者之一 Leonid Hurwicz 有一句常被引用的话,大意是:经济学的传统问题是「给定制度,人们会怎么做」,而机制设计问的是「要达到某个结果,需要什么样的制度」。这个方向在 2007 年拿了诺贝尔经济学奖(Hurwicz、Maskin、Myerson)。
代码评审。第 1 章说过它是囚徒困境:认真评审的成本一个人出,好处全组分。用上面三种改法看一遍——「压低 T」对应把「随便点通过」的成本抬上去(比如线上事故要追溯到评审人);「抬高 R」对应把评审质量算进绩效;「兜住 S」对应让被坑的人可以低成本地把问题打回去。三种都可行,成本和副作用完全不同。
公司报销与预算。「年底不花完明年就砍预算」是一条制造浪费的规则,因为它让「花光」成为每个部门的最优应对。改法不是号召节约(那是在跟均衡讲道理),而是改规则:允许结余部分留用,或者按实际需要而非历史支出定预算。
为什么很多「倡议」没用。倡议试图改变的是人们的意愿,而人们回应的是收益表。倡议唯一真正管用的场合,是第 3 章那种协调问题——那里大家本来就想合作,只是不知道别人会不会动。这也是为什么分清这四张表如此重要:选错了病,连解药的种类都是错的。
「设计规则就是把想要的行为写进规定,再配上处罚。」
写进规定只是宣布了你想要什么,它本身不改变任何人的最优应对——除非那条规定真的会被执行,而「会不会被执行」本身又是一个博弈(第 5 章那个查岗模型就是在算这件事)。
好的机制有一个特征:它不需要有人盯着。一人切一人挑,你走开了它照样管用。而依赖执法的机制,你必须同时设计执法者的收益表,否则第 5 章那笔账会把你的处罚力度悄悄换成执法者的松懈。
一个实用的检验:把执法者从你的方案里拿掉,它还成立吗?成立的是机制,不成立的是规定。
正确答案是 B:一人切,另一人先挑。
它是唯一一个不依赖任何外部力量的方案:既不需要你在场,也不需要任何一方讲道德。
A 「写进合同 + 罚款」——这是「规定」不是「机制」。它需要有人判定「切得平不平」,需要有人执行罚款,还需要那个执行者本人有动力去执行。你把一个问题换成了三个问题。 C 「抽签决定谁分,另一个只能接受」——这是第 8 章的最后通牒博弈。逆向归纳的答案是分的人拿走几乎全部。抽签只让不公平变得「程序上公平」,结果一点没变。这个错误很值钱:程序公平不等于结果公平,很多制度设计栽在这一步。 D 「自己商量」——这是把问题原样退回去。商量的结果取决于双方的耐心、外部选项和谈判技巧(第 24 章会给你一个公式),但绝不会自动落在平分上。三个人分蛋糕,还能用「一人切一人挑」吗?
两人版:切的人拿剩下那块 ⇒ 切平是他的最优应对。 三人版这一招直接失效——切成三块之后,切的人拿的是第三块,而前两个人挑走的未必是他预期的那两块。真正可行的三人方案要复杂得多(有一套叫「移动刀」的连续机制,也有离散的三步法)。这是机制设计里非常典型的一件事:两个人的漂亮解法,到三个人就崩了。后面几章你会反复遇到这个模式——两人的讨价还价有干净的公式,两人的匹配有干净的算法,而到了多人,各种不可能定理就开始一个接一个地冒出来。
这一章的一句话
你管不住别人的选择,你能改的是他们面前那张表;而好的机制有一个标志——你走开之后它照样成立。
下一章给你看这门学问最漂亮的一个例子。有一种拍卖规则,能让「照实报价」成为每个人的占优策略——不是「大家最好都诚实」,是「不管别人怎么出,诚实对你都最好」。它的做法荒谬得像个玩笑:让赢家付第二名的价钱。下一章会把这件事穷举一遍证明给你看:偏离照实报价,你最好也只是打平,最坏是亏。