第 19 章

机制之外

2007年,周杰伦在台北开了一家意大利餐厅,名字叫“Mr.J义法厨房”。投资额600万元新台币。开店的理由既不复杂也不商业:电影《不能说的秘密》刚上映,他想把电影里的场景搬到现实中来,让朋友们有个可以聚会的地方。

如果你用机制之眼分析这个决策,结论会很清楚——品牌延伸超出了核心能力范围,餐饮业利润率低,明星光环消退后客流自然下降,边际收益递减。这些分析在技术层面上都是对的。但周杰伦做这件事的时候,想的不是这些。他想的是“有个地方可以让朋友坐下来”。这个动机不在任何一本经济学教科书的解释范围之内。

餐厅经营了六年。2013年,宣布歇业。

餐厅经营了六年,2013年宣布歇业。故事到这里还没结束。那个店址后来的命运,比餐厅本身更能说明问题。先是周杰伦的妻子昆凌在那里开了一家宠物咖啡店“Machi Doggie”,2019年2月结束营业。紧接着,同一个店面变成了手摇饮料店“麦吉machi machi”,品牌归属在周杰伦母亲叶惠美名下。周杰伦在社交媒体上频繁推荐这家奶茶店,歌曲《说好不哭》的音乐录影带选在日本原宿店拍摄,直接拉动了上海新店开业时的排队热潮。

从私人聚会空间到宠物咖啡店,再到社交媒体驱动的网红奶茶品牌——这条演变轨迹不是任何人事先规划出来的。但如果你回头看,每一步都踩在了某种激励的节点上。最初的餐厅是一个“非经济”行为,它被创造出来的理由和市场逻辑无关。但它一旦被放到公开市场中,就自动进入了经济激励的网络。消费者会来,媒体会报道,品牌价值会累积,商业机会会浮现。即使最初的动机不是赚钱,机制本身也会把赚钱的可能性推到你的面前。而一旦你开始利用这种可能性——哪怕只是在社交平台上发一条推荐——你就已经从“机制之外”走进了“机制之内”。

这不是一个关于明星副业的故事。这是一个关于机制如何捕获行为的故事。而同样的捕获过程,在另一个完全不同的领域里上演得更彻底,更系统,也更难逆转。

1997年,一个名叫马特·米哈利的美国游戏制作人遇到了麻烦。他运营的古典奇幻文字MUD游戏《阿凯亚》正在经历衰退期——这是整个MUD游戏类型共同的命运,图形化网络游戏正在崛起,纯文字界面的沉浸感越来越难以留住玩家。玩家数量下滑意味着传统的点卡付费模式难以为继。当时的网络游戏标准商业模式是月费制或点卡制,玩家花钱买游戏时间,简单直接。但《阿凯亚》的玩家基数太小了,按这个模式走下去就是死路一条。

米哈利做了一个在当时看来相当边缘的决定:把游戏改成免费游玩,但允许玩家付费购买虚拟道具和升级角色。这个决定的初衷是生存,不是战略。它甚至没有被当成一种“商业模式创新”来看待。早期的免费游戏主要是独立开发者和小型网站用来吸引用户的手段,主流游戏公司根本看不上。

但机制一旦被释放出来,它的演化就不由最初的设计者说了算了。

2003年以后,韩国游戏公司开始大规模采用免费游玩模式。2004年Nexon推出的《洛奇》在韩国大获成功,东亚各地的游戏开发商纷纷效仿。到2008年,中国市场上九成的主要网络游戏都采用了免费模式。从1997年一个濒死MUD的求生之举,到十年后成为东亚网游的主流商业模式——这不是某个天才设计出来的路径,而是无数参与者在机制中不断试错、互相博弈、彼此模仿之后涌现出来的结果。

免费游戏的逻辑听起来很简单:先让玩家进来,再想办法从他们身上赚钱。但“想办法”这三个字里藏着一整套精心设计的激励结构。游戏设计师发现,如果直接卖影响游戏平衡的装备,玩家会觉得不公平,付费玩家碾压免费玩家会导致后者大量流失。但如果卖的是“节省时间”的道具或者纯外观装饰,玩家的抵触情绪就小得多——前者被理解为“我时间值钱”,后者被理解为“我花钱买好看”,都不涉及公平性问题。

他们还发现了一些更微妙的心理机制。如果把价格标成游戏代币而不是真实货币,玩家的消费意愿会显著提高。因为代币模糊了“花钱”的感觉——你花出去的是“300钻石”而不是“30块钱”,而钻石是虚拟的,它和真实货币之间的兑换关系被刻意设计得不那么直观。如果把付费点设计成“跳过等待”而不是“获得胜利”,玩家会觉得自己是在买时间而不是在作弊——尽管在某些游戏里,跳过等待本身就意味着更快的成长速度,间接等同于获得了优势。

这些发现不是一蹴而就的。它们是游戏公司和玩家之间持续博弈的产物。公司推出一种付费设计,玩家做出反应——有人付费,有人抗议,有人找到绕过付费的方法,有人在论坛上写长篇分析拆解付费陷阱。公司根据这些反应调整设计,玩家再做出新的反应。这个循环每转一圈,免费游戏的商业模式就变得更精密、更隐蔽、更难以抗拒。

然后出现了儿童内购的问题。2011年,苹果公司收到了家长的集体诉讼,指控应用商店里的免费游戏诱导儿童进行高额内购消费。那些标着“免费下载”的游戏里,孩子们被引导购买虚拟道具——他们不一定理解那些闪闪发光的宝石和金币对应的是真实的美元,而家长的信用卡就绑定在账户上。2013年4月,英国公平贸易署对游戏内购商业模式展开了正式调查。同年11月发布的调查报告措辞严厉:游戏付费内容的预告“普遍缺乏透明度和准确性”,游戏刻意混淆了虚拟代币和现金之间的区别,宣传手法存在鼓励儿童消费的倾向。

这是机制博弈的又一个回合。免费模式的设计者创造了一套激励结构来最大化收入。消费者——包括那些还不具备完整判断力的儿童——在这套结构中做出了设计者希望他们做出的选择。然后监管机构介入,要求改变这套结构的规则。而游戏公司的反应是什么?他们调整了内购的呈现方式,增加了确认步骤,在某些地区限制了儿童账户的消费额度。但免费增值模式的核心逻辑纹丝未动。因为这套逻辑太有效了,有效到任何一个理性的市场竞争者都不可能主动放弃它。如果你的竞争对手还在用这套模式赚钱,而你因为道德顾虑放弃了,你的市场份额就会被吃掉。

这就是机制的反身性在起作用。一个商业模式被公开运行之后,所有参与者都会开始理解它的逻辑。设计者理解,所以他们优化付费点的位置和形式,把“付费诱导”包装得越来越自然。成年玩家理解,所以他们学会了在免费框架内最大化自己的体验——有人给自己设定了“零氪”的身份标签,以不花一分钱为荣;有人精确计算每一笔内购的性价比,只买那些“划算”的项目。

监管者理解,所以他们制定规则来限制最恶劣的诱导行为,要求明示爆率、限制未成年人消费。甚至连那些还不完全理解金钱概念的孩子,也在用自己的方式参与这场博弈——他们点击购买按钮,因为他们想要那个闪闪发光的东西,而这个“想要”正是整个商业模式赖以运转的心理燃料。博弈不会停止。它只会进入下一轮。

同样的循环在航空公司常旅客计划里运行了几十年。如果你最近兑换过里程票,你可能注意到了一件事:规则一年比一年苛刻。热门航线的里程票越来越少,兑换所需的里程数越来越高,伙伴航空公司的兑换表被反复修改,里程的有效期从“永久”变成了“三年”再变成“十八个月”。这不是因为航空公司突然变贪婪了——它们的贪婪程度大致恒定,作为企业的利润最大化动机从来没有变过。

真正的原因是一批被称为“里程黑客”的人。这些人用数学建模找到了里程兑换的漏洞。他们发现某些航线的里程票兑换价值远高于其他航线——比如用同样的里程数,飞东京的票可能值800美元,飞某个冷门目的地的票可能只值300美元。他们发现某些伙伴航空公司的兑换表存在套利空间——用A航空的里程兑换B航空的航班,再通过复杂的转机组合,可以用远低于市场价的成本飞出头等舱。他们发现信用卡开卡奖励和里程过期规则之间存在可以被利用的时间窗口——在奖励提高时集中申请,在里程过期前通过小额购买“续命”。

他们把这些发现写成攻略,发布在论坛和博客上。标题通常是这样的:“如何用3万里程飞出价值5000美元的头等舱”“里程兑换的七个隐藏技巧”“航空公司不想让你知道的五件事”。这些攻略被大量转发、讨论、优化,于是越来越多的人开始用同样的方法最大化自己的里程价值。

航空公司当然注意到了。他们的应对方式是修改规则:提高热门航线的兑换门槛,限制伙伴兑换的灵活性,缩短里程有效期,增加燃油附加费。黑客们则开始寻找新的漏洞——比如利用航空公司合并时系统对接的间隙,比如发现某些小众航线的里程票仍然划算。航空公司再修补。黑客再寻找。这场军备竞赛已经持续了二十多年,没有任何结束的迹象。每一轮修补都会改变激励结构,而改变后的激励结构又会催生新的策略。没有终点,只有下一个回合。

电商平台的比价插件也经历了同样的命运。这类插件的初衷很简单:帮消费者找到最低价。你在浏览一个商品页面时,插件会自动扫描其他电商平台的同款商品价格,弹出一个提示框告诉你“京东便宜30元”或者“拼多多同款半价”。这是一个透明度的胜利——信息不对称被打破了,消费者获得了更多权力。经济学教科书会告诉你,价格透明度的提高会加剧竞争、降低价格、提升消费者剩余。完美的帕累托改进。

但卖家不是傻子。他们很快学会了在插件抓取的价格上做手脚。最常见的做法是设置一个极低的“引流价”——比如把商品标成1元。插件抓取到这个价格后会兴高采烈地显示给消费者:“这里只要1块钱!”但当消费者点进去准备购买时,会发现这个价格对应的商品已经“售罄”,或者需要满足各种复杂条件才能享受——比如“满1000元可用”“限前10名”“需购买指定搭配商品”。真正的售价藏在另一个选项里,而这个选项的价格可能比竞争对手还高。

比价插件本来是为了让价格更透明,结果反而催生了一整套让价格重新变得不透明的技术。卖家们发明了“SKU迷宫”——同一个商品链接下有几十个不同规格的选项,价格从低到高排列,插件只能抓取最低的那个,但最低的那个永远买不到。他们发明了“限时折扣”“闪购”“会员专享价”这些插件难以实时追踪的定价形式。他们甚至学会了根据用户是否安装了比价插件来显示不同的价格——这个技术实现的难度不高,但它让比价的意义大打折扣。

平台当然也在反击。他们更新算法来识别和过滤虚假标价,惩罚违规卖家——降权、罚款、封店。卖家则开发出更精细的规避策略:用不同的账号开设多个店铺,分散风险;把引流价设置得“看起来合理”以避开算法的阈值;在插件抓取频率较低的时段上线虚假价格。平台再升级算法。卖家再调整策略。又一个没有终点的循环。

餐厅点评网站的故事更容易让人感同身受,因为它离我们的日常生活最近。这类平台最初的愿景是美好的:食客们分享真实的用餐体验,帮助其他人做出更好的选择。信息来自真实的消费者,而不是商家的广告宣传。这是一个自下而上的信任机制。Yelp、大众点评、TripAdvisor——它们的早期用户都带着一种社区建设者的热情在写评价,那种热情是真实的,评价也是真实的。

然后餐厅老板发现了五星好评与客流之间的因果关系。最开始的手段很温和。“好评送小菜”——你在点评网站上给餐厅写一条五星好评,服务员就送你一份免费小菜,或者打个小折扣。这算贿赂吗?严格来说是,但大多数人不觉得有什么问题。小菜值不了几个钱,写条好评也花不了多少时间,大家都开心。餐厅得到了好评,食客得到了小菜,平台得到了内容,三赢。

问题是当足够多的餐厅都开始这么做的时候,评分系统就开始失真了。一家口味平平的餐厅靠送小菜刷到了四星半,那些坚持不送小菜的好餐厅反而在排名上吃了亏。于是后者也被迫加入这场游戏。“好评送小菜”从一个可选项变成了一个生存必需项——你不送,你的评分就比别人低;你送了,你的评分才能回到公平竞争的起跑线。但这个起跑线本身已经被抬高了,所有人都付出了额外的成本,而评分所传递的信息质量却下降了。

然后手段开始升级。出现了专业的“刷评”公司,他们雇佣真人去餐厅消费并撰写正面评价——消费是真实的,小票是真实的,所以平台很难识别这些评价是“虚假”的。从技术上讲,它们不是虚假的,写评价的人确实吃了那顿饭。但他们吃那顿饭的唯一原因是有人付钱让他们去吃并写好评。出现了“差评勒索”——有人故意给餐厅写一星差评,然后联系老板说付钱就删。出现了竞争对手之间的恶意差评攻击——A餐厅雇人给B餐厅批量刷差评,手段低劣但有效。

平台的反应是一轮又一轮的算法升级。他们训练机器学习模型来识别可疑的评价模式:评分时间是否集中在某个短时段内、评价者的历史行为是否异常——比如一个账号注册三年没有动静,突然一天之内写了十条好评、文字风格是否雷同。他们给“可信用户”更高的权重,降低疑似刷评账号的影响力。他们甚至开始分析评价文本的语义特征——研究发现,真实的评价往往包含更多具体的细节描述,比如“第三桌靠窗的位置灯光太暗”,而虚假评价倾向于使用笼统的形容词,比如“环境很好”“服务很棒”。

然后刷评公司开始用更高级的手段应对。他们让写手模仿真实用户的写作风格,在评价中加入具体的菜品名称和用餐细节——“椒盐排骨炸得稍老,但糖醋里脊的挂糊很到位”——这种句子读起来和真实评价几乎没有区别。他们要求写手真的去餐厅拍照以增加可信度,照片里要有菜品、有环境、有小票。他们控制评价发布的时间节奏,避免集中在同一时段触发算法警报。算法和刷评之间的技术竞赛已经进入了深度学习对抗生成网络的领域——这听起来像科幻小说,但它是正在发生的现实。有些刷评公司已经开始使用AI生成评价文本,而这些AI生成的文本在盲测中比真人写的评价更难被识别。

这些案例的共同逻辑清晰得令人不安:机制一旦公开运行,就变成了一个博弈场。设计者发布规则,参与者寻找漏洞,设计者修补漏洞,参与者再寻找新的漏洞。这个循环没有终点。

这里面有一个更深层的问题值得追问:为什么这个循环没有终点?为什么设计者不能一劳永逸地设计出一个完美的、无法被博弈的机制?

答案藏在机制本身的特性里。任何一个运行中的激励机制都包含三个要素:目标、规则和信号。目标是机制想要实现的东西——比如点评网站想要真实的评价,航空公司想要常旅客计划的客户忠诚度,免费游戏想要最大化收入。规则是实现目标的手段——用户可以自由发表评价但商家不能删除差评,里程可以兑换机票但要遵守兑换表,游戏免费但道具收费。信号是参与者用来判断如何行动的信息——评分高低、排名先后、里程兑换表的条款、付费点的位置和价格。

这三个要素之间永远存在张力。目标决定了规则的设计方向,但规则一旦确定就会发出信号,而信号会引导参与者调整行为来最大化自己的利益。这个“最大化自己利益”的行为不一定与机制的原始目标一致。点评网站的目标是收集真实评价,但“好评送小菜”这个行为最大化的是餐厅的利益而不是信息的真实性。航空公司常旅客计划的目标是培养客户忠诚度,但里程黑客的行为最大化的是个人里程价值而不是对航空公司的忠诚——他们哪家里程划算就飞哪家,哪家信用卡开卡奖励高就申请哪家。

当不一致出现时,设计者修改规则来重新对齐目标和行为。但修改后的规则会发出新的信号,引导出新的行为调整。航空公司提高热门航线兑换门槛,黑客就转向冷门航线;平台过滤集中刷评,刷评公司就分散发布时间;比价插件过滤虚假标价,卖家就设计更精细的SKU迷宫。

这不是一个可以被“修好”的漏洞。这是机制本身的固有属性。就像你不可能设计出一个完全没有摩擦力的机械系统一样,你也不可能设计出一个完全不被博弈的激励机制。摩擦力不是机械系统的缺陷,它是物理定律的必然结果。同理,博弈不是激励机制的缺陷,它是人类理性的必然结果。只要机制的目标和参与者的个体利益之间存在任何偏差——而这样的偏差永远存在——参与者就会利用规则来追求自己的利益而非机制的目标。

这个结论把我们带回了本书的核心问题:如果机制永远会被博弈,那我们学会用机制之眼看世界到底有什么用?

答案可能需要从另一个角度来寻找。

回到周杰伦的餐厅。2013年Mr.J义法厨房歇业的时候,如果有人用机制之眼分析这个结果,他会说这是一个必然——品牌延伸超出了核心能力范围,餐饮业的利润率本来就低,明星光环消退之后客流自然下降。这些分析在技术层面上都是成立的。但它们漏掉了一些东西。它们漏掉了2007年那个决定背后的东西:一个人想为朋友们创造一个可以聚会的地方。这个动机不“理性”,不“最优”,但它真实存在。它真实到足以让一个人从自己的口袋里掏出600万,去做一件在商业逻辑看来注定不划算的事。

机制之眼是一套强大的分析工具。它让你看到激励如何塑造行为,看到表面现象背后的结构性原因,看到那些你习以为常却从未真正理解的事物的运作逻辑。这套工具可以解释为什么航空公司收紧里程兑换规则——因为里程黑客在套利。它可以解释为什么电商卖家操纵比价插件——因为引流价能带来点击。它可以解释为什么餐厅刷好评——因为评分和客流之间存在因果关系。它甚至可以解释为什么免费游戏要从儿童身上赚钱——因为儿童是付费转化率最高的用户群体之一,而免费增值模式的整个数学基础就建立在少数高消费用户补贴大多数免费用户的结构上。

但它解释不了为什么一个人会在巅峰时期花600万开一家不以赚钱为目的的餐厅。

这不是说机制之眼“错”了。工具不会错,工具只会有限。一把螺丝刀不能用来锯木头,这不叫错,这叫适用范围。机制之眼的适用范围是人类行为中那些可以被激励结构解释的部分——这个部分很大,大到覆盖了我们日常生活中绝大多数的经济现象。但它不是全部。

人类行为中有一部分是由“想试试”驱动的。不是计算过的冒险,不是预期效用最大化的选择,就是单纯的“想试试”。还有一部分是由“这样做好像不对”驱动的——明明可以合法避税但还是足额缴纳,明明可以钻规则漏洞但还是选择遵守规则的精神而非字面,明明可以在点评网站上接受商家的贿赂写好评但还是写了真实体验。还有一部分是由“我不知道为什么但就是想这么做”驱动的——那些连当事人自己都说不清楚的冲动和偏好,那些在理性选择模型里被归为“误差项”的东西。

这些不在机制之眼的解释范围之内。不是因为它们不重要,而是因为它们不遵循激励结构可以捕捉的规律。它们是噪音吗?从模型的角度看也许是。从统计显著性的角度看,它们是可以被忽略的残差。但从人的角度看,它们恰恰是我们不愿意把自己完全交给模型的原因。

这大概是全书最诚实的一个段落。一本花了十八章教你用机制之眼拆解世界的书,在倒数第二章承认这套工具存在边界。不是那种“当然任何工具都有局限”的客套话式的承认——那种话谁都会说,说完就可以继续假装局限不存在。而是一种更具体的、带着后果的承认:当你学会了用机制之眼看世界之后,你会倾向于把所有行为都解释成激励的结果。这种倾向本身就会变成一个认知陷阱。

你会开始忽略那些不能被激励解释的东西,或者更糟,你会强行把它们解释成某种你不了解的激励——你说“他做好事一定是为了名声”“她坚持原则一定是因为违反的成本太高”“那个慷慨的举动背后一定有自私的动机”。

经济学家有时候会犯这个错误。他们看到一个现象——比如人们给餐厅写真实评价而不是接受商家的贿赂——然后试图用激励来解释:也许是因为诚实带来的心理效用大于贿赂的收益?也许是因为长期声誉的价值超过了短期收益?这些解释可能在技术上是自洽的,逻辑上没有漏洞,模型可以跑通。

但它们绕了一个大圈子去回避一个更简单的可能性:有些人就是不愿意说谎。不是因为激励结构让他们不愿意——不是因为他们计算过诚实的净现值大于说谎的净现值——而是因为他们觉得说谎不对。

这个“觉得不对”不需要被翻译成激励语言才能成立。它本身就是一个完整的解释。

这就是本章标题“机制之外”的含义。它不是说这一章要讲一些超越机制的玄妙事物,也不是要否定前十八章建立起来的分析框架的有效性。它是说,在机制之眼的视野范围之外,还存在着人类行为的广阔领域。这些领域不是机制的对手或替代品,不是某种更高级的“反机制”逻辑,它们就是单纯地不在机制的射程之内。就像望远镜可以看到遥远的星系,但它看不到显微镜下的细胞——这不叫望远镜的失败,这叫工具的边界。

而认识到这一点很重要。因为当你把机制之眼当成唯一的认知工具时,你会逐渐失去看到那些“机制之外”的事物的能力。你会变成一个只会用激励解释一切的人。

那种人往往不太讨人喜欢。他们会在你表达善意的时候告诉你这背后一定有自私的动机,在你做出慷慨举动的时候告诉你这一定是某种形式的印象管理,在你坚持原则的时候告诉你这一定是因为违反原则的成本太高。他们在技术层面上可能是对的——人类行为中确实混杂着大量的自利动机,否认这一点是天真。

但他们在人的层面上错过了最重要的东西:人不仅仅是激励的响应器。人的行为有一部分确实是对激励的反应,但还有一部分不是。那部分不是的东西,和那部分是的东西一样真实。

这本书教给你的机制之眼是一套工具。工具是用来用的,不是用来信仰的。你可以在需要分析一个经济现象的时候拿起它——当你看到奶茶店扎堆开业时,当你困惑于演唱会门票为什么不涨价时,当你被免费模式的隐性成本困扰时——然后在你和朋友吃饭的时候放下它。你可以用它来理解为什么三家奶茶店挨着开,然后关掉这个思维模式去享受一杯奶茶本身的味道。

这听起来很简单,但做起来比想象中难。一旦你习惯了用机制之眼看世界,你会发现自己很难再回到“没看到”的状态。你会不由自主地分析每一个现象背后的激励结构——超市的货架摆放不是商品陈列,是冲动消费的陷阱设计;同事的行为模式不是个性,是绩效考核的激励产物;社交媒体的推荐算法不是技术,是注意力提取机制的工程实现;伴侣的家务分工不是生活习惯,是谈判博弈的均衡解。

这种分析本身是有趣的,它让你看到别人看不到的东西,它给你一种智识上的优越感。但它也会让你疲惫。它会让你觉得整个世界就是一张巨大的激励之网,而你只是网上的一个节点,你的每一个选择都是对某种激励的响应,你的每一次“自由意志”都不过是约束条件下的最优化。

你不是网上的一个节点。

你是那个在2007年花600万给朋友开餐厅的人——即使那家餐厅最终会关门,即使那个决定在机制分析面前显得不理性,即使所有商学院教材都会把它当作一个失败案例。你是那个在点评网站上认真写下真实评价的人——那道菜好在哪不好在哪,你写得清清楚楚,没有小菜作为回报,只是因为你想让下一个走进这家餐厅的陌生人知道该点什么。你是那个看到规则漏洞但选择不利用的人——不是因为利用的成本太高,不是因为被抓住的概率太大,而是因为你觉得那样做不对。

这个“觉得不对”不需要被翻译成任何更复杂的理论语言。它就是你。

机制之眼可以解释很多。它可以解释航空公司为什么收紧里程规则,可以解释游戏公司为什么设计付费陷阱,可以解释卖家为什么操纵比价插件,可以解释餐厅为什么刷好评。它可以解释奶茶店为什么三家挨着开,便利店为什么不打烊,演唱会门票为什么明知会被黄牛扫光也不涨价。它是一把锋利的刀,切开表面现象,露出下面的激励结构。

但它解释不了你。

而你不是一个需要被解释的变量。