卷 IV · 定价CH 13深度 13/24

反过来做题

前十二章我们一直在做同一件事:给定一张表,找出人们会停在哪。这一章把题目倒过来——给定你想让人们停在哪,反推那张表该怎么写。这个方向有个名字叫机制设计,也被人半开玩笑地叫做「反向博弈论」。它是这本书从「看懂」转向「能做」的地方,也是母题翻转的地方:横杠竖杠不再是你要找的东西,而是你要挪的东西。

机制设计激励相容母题翻转

▷ 轮到你

两个人分一块蛋糕。你是规则制定者,你希望的结果是他们平分。两个人都自私,都想多拿,而且你不在场——你只能事先定一条规则,然后走开。

问:定什么规则?

A 规定必须平分,写进合同,违者罚款 B 让一个人切,另一个人先挑 C 抽签决定谁来分,另一个人只能接受 D 让他们自己商量,商量不成就都别吃

这道题几乎人人都知道答案。这一章要做的,是把这个人人都知道的答案拆开,看清楚它凭什么管用——然后把这套拆法用到不那么显然的地方去。

「一人切一人挑」凭什么管用

先看它不是靠什么管用的:

  • 不靠道德——切的人可以完全不在乎公平;
  • 不靠监督——你走开了,没人盯着;
  • 不靠惩罚——规则里没有任何处罚条款;
  • 不靠信息——你不需要知道谁更饿、谁更想吃。

它靠的是一件事:切的人切完之后,会拿到两块里较小的那一块。于是「切得平均」变成了他自己的最优应对。

用这本书的语言说:这条规则重写了收益表,让你想要的那个结果,恰好落在「没人后悔」那一格上

◆ 这一章的核心

机制设计的全部工作,就是把因果链倒过来接:

正着做(前十二章):  规则 ──▶ 收益表 ──▶ 均衡 ──▶ 结果
反着做(后十二章):  想要的结果 ──▶ 均衡必须落这儿 ──▶ 表该怎么写 ──▶ 规则

而反着做有一条硬约束,是整个下半本书的中心:你想要的那个结果,必须是参与者自己愿意去的地方。因为你不在场,你管不住他们;你唯一能做的是让他们自己想去

三个必须满足的条件

一个机制要真的能用,得同时过三关。这三关值得单独记住,因为现实里失败的机制,几乎总是栽在其中一关上。

第一关:激励相容

每个参与者按你希望的方式行动,对他自己是最优的。切蛋糕的人认真切,是因为认真切对他最好,不是因为他答应过。

大多数机制死在这一关。「请大家如实填写工作量」「请诚实评估风险」——如果如实填写会让自己吃亏,这条规则就不是机制,只是愿望。

第二关:个人理性

参与者愿意参加。一个机制哪怕再精妙,如果参加它不如不参加,人们就会走开。

这一关经常被忽视,后果是机制在纸上完美、在现实里没人用。比如一个设计得很严谨的内部举报流程,如果举报人的预期收益是负的,流程本身再公正也不会有人走进来。

第三关:预算平衡(或者可行性)

你付得起。有些机制在数学上很美,但需要设计者自己往里贴钱。第 20 章会给你看一个具体的例子:有一套非常漂亮的机制能让所有人如实报出自己对公共品的估值,代价是它一定收不抵支——这不是实现得不好,是被证明了的。

把这套东西用到囚徒困境上

现在拿第 1 章那张表来练手。目标:让「一起合作」成为均衡。

先看清楚问题出在哪。囚徒困境的四个数是 T=5 > R=3 > P=1 > S=0。均衡在右下角,是因为两条不等式同时成立:

T > R   ⇒ 对方合作时,我背叛更好
P > S   ⇒ 对方背叛时,我背叛更好

要把均衡挪到左上角,只需要打破第一条。(第二条不用管——只要第一条破了,「一起合作」就是均衡,虽然「一起背叛」可能还在。)

而打破 T > R 有三种改法,它们改的是表里不同的位置:

改法动的数现实里长什么样代价
压低背叛的好处T ↓罚款、没收押金、违约金、封号要有执法能力
抬高合作的好处R ↑合作分成、团队奖金、联合采购折扣要花钱
兜住被背叛的下场S ↑保险、托管、平台赔付、七天无理由要花钱,但只在出事时花

注意第三种:它不能单独打破 T > R,所以它一个人解决不了囚徒困境。但它有另一个作用——它能把囚徒困境变成猎鹿(第 3 章那张表),而猎鹿是个便宜得多的病。这一点常被忽略:很多机制的价值不是「解决问题」,而是「把问题换成一个更好治的问题」。

最小的那一处改动

用上面那台改表器试一下:只拖第一根滑杆(罚款),拖到 3 的时候,背叛得手从 5 掉到 2,低于一起合作的 3。这时候两道杠一起挪到左上角,均衡变成「一起合作」,两人合计从 2 分变成 6 分。

请注意这里发生了什么,和没发生什么:

  • 没有人被说服;
  • 没有人变得更信任对方;
  • 没有人需要牺牲;
  • 整个过程只动了一个数。

这就是这本书后半程的手感。它一开始会让人觉得有点冷血——不谈价值观,只谈数字。但它有一个很大的好处:它可以被检验。你说「加强沟通能解决这个问题」,没法验证;你说「把违约金提到 X,合作就会成为均衡」,可以当场算出 X 是多少,也可以事后看它对不对。

✎ 术语正名

机制这个词在这里指的是一套规则:谁能做什么、什么时候做、做了以后各自得到什么。拍卖是机制,选举是机制,公司的绩效考核是机制,一个开源项目的 PR 合并流程也是机制。

与之相对,策略是参与者在给定机制下的行为。这本书前半讲策略,后半讲机制。

这门学问的开创者之一 Leonid Hurwicz 有一句常被引用的话,大意是:经济学的传统问题是「给定制度,人们会怎么做」,而机制设计问的是「要达到某个结果,需要什么样的制度」。这个方向在 2007 年拿了诺贝尔经济学奖(Hurwicz、Maskin、Myerson)。

▸ 在现实里

代码评审。第 1 章说过它是囚徒困境:认真评审的成本一个人出,好处全组分。用上面三种改法看一遍——「压低 T」对应把「随便点通过」的成本抬上去(比如线上事故要追溯到评审人);「抬高 R」对应把评审质量算进绩效;「兜住 S」对应让被坑的人可以低成本地把问题打回去。三种都可行,成本和副作用完全不同。

公司报销与预算。「年底不花完明年就砍预算」是一条制造浪费的规则,因为它让「花光」成为每个部门的最优应对。改法不是号召节约(那是在跟均衡讲道理),而是改规则:允许结余部分留用,或者按实际需要而非历史支出定预算。

为什么很多「倡议」没用。倡议试图改变的是人们的意愿,而人们回应的是收益表。倡议唯一真正管用的场合,是第 3 章那种协调问题——那里大家本来就想合作,只是不知道别人会不会动。这也是为什么分清这四张表如此重要:选错了病,连解药的种类都是错的。

✗ 这个直觉是错的

「设计规则就是把想要的行为写进规定,再配上处罚。」

写进规定只是宣布了你想要什么,它本身不改变任何人的最优应对——除非那条规定真的会被执行,而「会不会被执行」本身又是一个博弈(第 5 章那个查岗模型就是在算这件事)。

好的机制有一个特征:它不需要有人盯着。一人切一人挑,你走开了它照样管用。而依赖执法的机制,你必须同时设计执法者的收益表,否则第 5 章那笔账会把你的处罚力度悄悄换成执法者的松懈。

一个实用的检验:把执法者从你的方案里拿掉,它还成立吗?成立的是机制,不成立的是规定。

◇ 摊牌

正确答案是 B:一人切,另一人先挑。

它是唯一一个不依赖任何外部力量的方案:既不需要你在场,也不需要任何一方讲道德。

A 「写进合同 + 罚款」——这是「规定」不是「机制」。它需要有人判定「切得平不平」,需要有人执行罚款,还需要那个执行者本人有动力去执行。你把一个问题换成了三个问题。 C 「抽签决定谁分,另一个只能接受」——这是第 8 章的最后通牒博弈。逆向归纳的答案是分的人拿走几乎全部。抽签只让不公平变得「程序上公平」,结果一点没变。这个错误很值钱:程序公平不等于结果公平,很多制度设计栽在这一步。 D 「自己商量」——这是把问题原样退回去。商量的结果取决于双方的耐心、外部选项和谈判技巧(第 24 章会给你一个公式),但绝不会自动落在平分上。
◆ 换你定规则

三个人分蛋糕,还能用「一人切一人挑」吗?

两人版:切的人拿剩下那块 ⇒ 切平是他的最优应对。 三人版这一招直接失效——切成三块之后,切的人拿的是第三块,而前两个人挑走的未必是他预期的那两块。真正可行的三人方案要复杂得多(有一套叫「移动刀」的连续机制,也有离散的三步法)。

这是机制设计里非常典型的一件事:两个人的漂亮解法,到三个人就崩了。后面几章你会反复遇到这个模式——两人的讨价还价有干净的公式,两人的匹配有干净的算法,而到了多人,各种不可能定理就开始一个接一个地冒出来。

这一章的一句话

你管不住别人的选择,你能改的是他们面前那张表;而好的机制有一个标志——你走开之后它照样成立。

下一章给你看这门学问最漂亮的一个例子。有一种拍卖规则,能让「照实报价」成为每个人的占优策略——不是「大家最好都诚实」,是「不管别人怎么出,诚实对你都最好」。它的做法荒谬得像个玩笑:让赢家付第二名的价钱。下一章会把这件事穷举一遍证明给你看:偏离照实报价,你最好也只是打平,最坏是亏。