第 16 章
大数据的精准投喂
这看似自由的金融选择,实则是一场精心设计的认知测量。所谓投资者在比较产品、行使选择权,不过是平台算法眼中的数据生产行为——每一次点击都在标注风险敏感度,每一次页面切换都在计算价格弹性,每一次跳过协议都在量化认知懒惰。
这种将选择行为转化为问卷填写的技术范式,其源头可追溯至2000年代初互联网广告业的精准投放革命。以Google收购DoubleClick(2007年)为标志的实时竞价系统,以及Google Analytics对用户鼠标轨迹的毫秒级追踪,共同构建了基于行为数据的盈利模式。到2006年,Google超过98%的收入来自广告,证明了该模式的商业有效性。
然而当同样的测量技术从广告系统迁移至2015年后的金融平台,本质差异便显现:广告促成消费决策,后果即时且轻微;金融产品促成投资决策,后果延迟且严重。此时的行为追踪不再只是“精准营销”,而成为对认知盲区的精确制导。
第四类用户被标注为“从众倾向型”。这类用户的行为特征包括:频繁查看“热门产品”“大家都在买”等排行榜页面、在社交裂变活动中成为被邀请方而非主动邀请方、购买决策与平台推送的“爆款”产品高度一致。
针对这类用户,推送策略的核心是“社会证明饱和”——在App首页显著位置展示“已有多少万用户选择本产品”的实时滚动数字;在产品详情页嵌入“某用户刚刚购买了10万元”的动态弹窗——这份方案坦率地承认,弹窗中的用户姓名和金额是基于真实用户数据的脱敏化模拟,即并非真实的实时交易;在推送消息中使用“你的朋友也在投”的话术——这正是第15章所述社交裂变机制的直接延续。

第五类用户被标注为“高净值型”。这类用户的行为特征包括:单笔投资金额超过平台平均值的五倍、使用过“大额认购”专属通道、在非工作时间——晚上10点至凌晨6点——的活跃度显著高于其他用户。
针对这类用户,推送策略切换到人工模式——系统自动将用户信息推送给专属客户经理,由客户经理通过电话或微信进行一对一沟通。方案要求客户经理在沟通中避免使用“风险”“亏损”等词汇,如果用户主动问及风险,客户经理的应答话术为:“我们的产品都有严格的风控审核,到目前为止还没有出现过本金亏损的情况”——这是一个严格为真的陈述,因为平台尚未暴雷,但它系统性地省略了“未来可能亏损”这一关键信息。
这份方案在2016年第四季度开始在全平台部署实施。实施后的首月数据显示,差异化推送策略将整体转化率提升了23.7个百分点。分用户类型看,“认知懒惰型”用户的转化率提升最为显著,达到41.2个百分点;“风险敏感型”用户的转化率提升幅度最小,为11.8个百分点——但这11.8个百分点恰恰是此前被风险信息“吓退”的那部分用户。
更关键的指标是平均投资金额的变化:在差异化推送实施前,五类用户的平均投资金额差异不大,标准差在15%以内;
实施后,“价格敏感型”用户的平均投资金额上升了34%,“高净值型”上升了28%,“认知懒惰型”上升了19%。这意味着精准投喂不仅在扩大用户基数,而且在挖掘每个用户的资金潜力。
但最致命的后果不在转化率的数字上。最致命的后果在于,差异化推送策略在每一个用户周围构建了一个信息茧房——用户看到的永远是被算法筛选过的、最可能击穿其心理防线的信息组合,而任何可能触发警觉的负面信息都被算法自动过滤到视野之外。
一个“风险敏感型”用户,如果他在搜索引擎中输入平台名称加上“逾期”关键词,算法会优先向他展示平台获得“合规经营奖”的新闻稿。一个“价格敏感型”用户,如果他在产品详情页停留时间过长——表明他在犹豫——算法会立即弹出一张“限时加息0.5%”的优惠券。一个“认知懒惰型”用户,从注册到完成首笔投资,整个过程中唯一看到的文字是“收益”和“确认”这两个按钮标签。
一个“从众倾向型”用户,他的App首页永远在滚动播放“已有多少万用户选择”——但他永远不会知道,这个数字包含了多少已经亏损但尚未赎回的用户。
这就是大数据精准投喂与传统的广撒网式营销之间的本质区别。在广撒网模式下,设计者只能依赖统计概率来猜测用户的弱点——他们知道大约有30%的人对风险敏感,大约有20%的人对价格敏感,但他们无法知道坐在屏幕对面的这一个具体用户属于哪一类。因此,传统营销的话术必须覆盖所有可能的弱点,结果往往是信息的平均化——每个用户看到的都是同一套页面、同一种话术、同一条风险提示。这种平均化虽然不能最大化转化率,但它至少保留了用户接触完整信息的可能性。
一个风险敏感的用户在阅读了风险提示之后,仍然可以选择退出。在精准投喂模式下,这种可能性被系统性地消灭了。算法在用户看到风险提示之前,就已经判断出这个用户可能对风险敏感,并因此决定不向他展示风险提示——或者将风险提示的视觉权重降到用户几乎不可能注意到的程度。
用户的选择权在形式上仍然存在——他仍然可以点击“查看风险提示”的链接,仍然可以阅读产品协议,仍然可以在购买之前犹豫——但这些行为发生的概率已经被算法精确地压到了最低。
这里需要切换到受害者视角。一个被标注为“风险敏感型”的用户,他的真实心理状态是什么?他之所以在风险提示页面停留更长时间,恰恰是因为他对风险的感知更敏锐,他的信任门槛更高。他在用更谨慎的行为保护自己。但在差异化推送系统中,这种谨慎行为被反向利用——系统识别出他的谨慎,然后向他投喂更多“安全信号”以瓦解他的谨慎。他在详情页停留的那8秒钟,不是让系统意识到“这个用户需要更充分的风险披露”,而是让系统决定“这个用户需要更多的信任背书”。他的自我保护行为,变成了系统攻破他防线的突破口。
一个被标注为“认知懒惰型”的用户,他的真实处境更加隐蔽。他从不阅读协议文本,可能是因为他缺乏足够的金融知识来理解那些术语;他快速完成注册和购买,可能是因为他相信“国家监管”意味着“国家担保”;
他从未使用过在线客服,可能是因为他不知道该问什么问题。他的“认知懒惰”不是一种人格缺陷,而是一种信息劣势的自然表现。但在差异化推送系统中,这种信息劣势被当作可开采的资源——系统识别出他“不阅读”,然后确保他永远不会在购买路径上遇到可能触发他阅读行为的障碍。
这就是行为工程在2016年之后进入的新阶段。设计者不再需要猜测受害者的心理弱点,因为大数据可以精确测量每一个个体的认知盲区。设计者的认知优势从统计概率优势升级为个体锁定优势。在统计概率模式下,设计者知道“有一部分用户会忽略风险提示”,但他们无法预知哪一个用户会忽略。因此,他们仍然需要在页面上放置风险提示——哪怕只是为了满足合规要求。
在个体锁定模式下,设计者不仅知道哪一个用户会忽略风险提示,而且可以主动确保这个用户不会看到任何可能引起他注意的风险信息。从系统视角来看,算法本身在这一过程中获得了一种准制度性的权力。
在传统的金融产品销售中,信息披露的规则是由监管机构制定的——监管要求所有产品页面必须包含哪些信息、风险提示必须使用多大的字号、必须放置在页面的什么位置。这些规则是静态的、统一的、可检查的。监管人员可以打开一个产品页面,检查风险提示是否在“显著位置”,字号是否符合规定。
但在差异化推送系统中,产品页面不再是静态的——它在每一个用户面前呈现出不同的形态。监管人员打开页面时看到的风险提示,与一个“认知懒惰型”用户打开页面时看到的风险提示,可能位于不同的位置、使用不同的字号、搭配不同的话术。监管的静态文本检查,在面对千人千面的动态页面时,已经失去了实质性的效力。
2017年初,某地方金融监管机构对前述平台进行了一次例行现场检查。检查人员按照标准流程,在测试设备上打开平台App,逐一核查产品页面的信息披露合规情况。核查结果:合格。风险提示在显著位置展示,字号符合规定,协议文本完整。
检查人员没有发现任何问题——因为他们看到的,是系统专门为“监管检查IP地址”推送的标准化页面。而同一时间,一个被标注为“价格敏感型”的用户打开同一个产品页面时,他看到的是巨大的红色收益率数字、闪烁的“限时抢购”倒计时、以及被压缩到页面最底部的灰色风险提示小字。
这种差异不是技术漏洞,而是系统设计的固有特征。平台的推送策略文档中明确包含“监管合规模式”——当系统识别到来自监管机构IP地址的访问请求时,自动切换到标准化页面模板,关闭所有差异化推送规则。这个设计在技术层面完全合规:平台确实拥有符合监管要求的标准页面,监管检查也确实看到了这个标准页面。
但它在实质上架空了监管检查的意义——因为没有任何一个真实用户会看到监管人员看到的东西。数据记录显示,在2017年全年,该平台“认知懒惰型”用户中,能够在购买后24小时内再次打开产品详情页查看完整风险提示的比例,仅为0.7%。
换句话说,99.3%的认知懒惰型用户在整个投资周期中,从未看到过监管要求必须披露的风险信息。他们看到的只是算法为他们定制的、经过信息过滤的“安全版本”。
这个0.7%的数字不是设计者的疏忽——它恰恰是设计者追求的目标。如果这个数字太高,意味着系统在信息过滤上做得不够彻底;如果这个数字太低——比如降到0——则可能触发合规风险,因为平台需要保留用户“可以”查看风险提示的形式可能性。0.7%是一个精确计算过的平衡点:足够低以确保绝大多数用户不会接触到负面信息,又足够高以在监管质疑时证明“用户是有机会看到风险提示的”。
精准投喂的自我强化机制在2017年下半年进一步升级。平台的数据团队发现,用户在平台上的行为模式会随着时间推移而发生变化——但这种变化的方向不是随机的。
一个最初被标注为“风险敏感型”的用户,在连续接收到数月的“安全信号饱和”推送后,他在风险提示页面的停留时间会逐渐缩短。他的行为模式正在向“认知懒惰型”漂移。
系统会自动捕捉到这种漂移,并相应调整他的用户画像和推送策略——他开始收到更少的风险信息和更多的默认勾选。
信息茧房不仅是一个静态的过滤机制,它还是一个动态的收窄过程。用户在茧房内待得越久,茧房的墙壁就越厚,他能看到的信息范围就越窄。
一个典型的漂移路径可以在平台的数据日志中被追踪。2017年3月,用户A完成了注册。他的初始行为数据显示:在风险提示页面停留12秒,平台平均值为7秒;在首次购买时选择了最小金额1000元试水;在购买后第三天进行了首次赎回操作,测试资金流动性。系统将他标注为“风险敏感型”,并开始向他推送安全信号密集型内容。
到2017年6月,用户A的风险提示页面停留时间下降到5秒,低于平台平均值。他的单笔投资金额上升到5000元。系统将他的画像调整为“风险敏感度降低”。到2017年9月,用户A的风险提示页面停留时间进一步下降到2秒,他开始跳过产品详情页直接进入购买确认页。系统将他的画像更新为“认知懒惰型”。
平台内部的数据分析报告显示,用户行为标签系统在2016年第三季度完成了一次关键升级。在此之前,用户分类依赖的是传统的人口统计学变量——年龄、性别、地域、注册时填写的收入区间。这些变量的预测能力有限,一个35岁、男性、居住在一线城市、填写年收入20万的用户,可能是一个极度谨慎的保守投资者,也可能是一个偏好高风险高回报的进取型投资者。人口统计学标签无法区分这两种截然不同的决策模式。
2016年第三季度的升级改变了这一点。新的标签系统不再依赖用户“说”了什么——他们在注册表单中填写的数字——而是依赖用户“做”了什么:他们在平台上的每一次点击、每一次页面切换、每一次停留、每一次返回、每一次在输入框中键入又删除的金额数字。这些行为数据被实时回传至数据仓库,经过清洗、特征提取、聚类分析,最终形成每个用户专属的“认知画像”。这份画像不是静态的,它随着用户每一次新的行为而实时更新。
一个用户在某个产品详情页的“犹豫时长”——从进入页面到点击“立即购买”的时间间隔——如果超过5秒,系统会自动在该用户的画像中增加一个“风险敏感度+1”的标记。如果同一个用户在同一页面反复滚动查看“安全保障”栏目,标记变为“风险敏感度+2”。如果他在点击“立即购买”后,又在支付确认页面停留超过3秒,标记升级为“风险敏感度+3”。
这些标记不是人工设定的规则,而是机器学习模型从历史数据中自动挖掘出的行为模式。模型发现,最终未购买的用户在支付确认页面的平均停留时间比完成购买的用户长2.7秒;最终购买但在一个月内赎回的用户,在产品详情页的滚动深度比长期持有用户浅40%;最终亏损后投诉的用户,在注册环节填写个人信息的速度比未投诉用户快22%。这些差异在单次行为中无法被人类观察者察觉,但在数十万次行为记录的聚合分析中,它们呈现出统计上高度显著的规律。
数据标注团队的工作是将这些统计规律翻译成可操作的推送策略。一份内部培训文档记录了标注工作的标准流程。
第一步是“行为特征提取”——数据工程师从用户行为日志中提取出47个关键行为指标,包括但不限于:首次访问到注册完成的时间间隔、注册表单每个字段的填写速度、首次浏览产品页面的滚动速度、在产品详情页各模块的停留时长分布、是否使用过收益计算器、是否查看过风险提示的完整文本、是否点击过“常见问题”中的风险相关条目、在支付确认页面的停留时长、是否在支付前修改过投资金额、修改金额的方向是增加还是减少、修改的幅度。
第二步是“认知维度映射”——将47个行为指标映射到五个认知维度:风险敏感度、价格敏感度、认知投入度、社会证明依赖度、决策速度。每个维度分为高、中、低三个等级。一个在风险提示页面停留超过10秒、反复查看“资金保障”栏目、使用过收益计算器但最终选择最低金额试水的用户,他的“风险敏感度”标注为“高”,“决策速度”标注为“低”。
一个从未打开过风险提示页面、在3秒内完成从产品浏览到支付确认全流程、投资金额为预设选项最大值的用户,他的“认知投入度”标注为“低”,“决策速度”标注为“高”。第三步是“推送策略匹配”——将标注完成的用户画像与预设的话术配方库进行匹配。话术配方库在2016年第四季度共包含五套主配方和十二套变体配方。每套配方规定了该类型用户在打开App时看到的首页布局、产品排序逻辑、推送消息的话术风格、风险提示的视觉权重、优惠券的类型和触发条件。
一份标注为“内部使用-策略文档V2.3”的文件详细记录了五类用户画像的定义和对应推送策略。第一类用户被标注为“认知懒惰型”。定义条件包括:注册流程完成时间低于平台平均值的50%、从未点击过任何协议或风险提示的展开链接、在产品详情页的停留时间低于平台平均值的30%、购买决策中从未使用过“在线客服”功能。
针对这类用户,推送策略的核心是“决策路径最短化”——App首页直接展示最高收益产品的购买按钮,省略产品详情中间页;支付确认页面默认勾选“同意协议”复选框;风险提示以折叠形式置于页面底部,默认不展开;推送消息仅包含产品名称、收益率数字和“立即抢购”按钮,不含任何风险相关词汇。
第二类用户被标注为“风险敏感型”。定义条件包括:在风险提示页面的停留时间超过平台平均值的150%、点击过“资金保障”“银行存管”等安全相关栏目的展开链接、首次投资金额为平台最低档、在购买后24小时内再次打开产品详情页查看风险提示。
针对这类用户,推送策略的核心是“安全信号饱和”——在App首页显著位置展示“银行存管”“国资背景”“合规经营奖”等信任背书标识;在产品详情页优先展示“资金流向透明”“多重风控审核”等内容模块;推送消息的话术强调“本息保障”“历史兑付率100%”——这里的“历史”指的是平台尚未暴雷的时间段;风险提示仍然展示,但被嵌入在一系列安全信号的包裹之中,其视觉冲击力被前后相邻的信任背书内容稀释。
第三类用户被标注为“价格敏感型”。定义条件包括:反复使用收益计算器比较不同产品的预期收益、在“加息券”或“限时抢购”活动页面的停留时间超过平台平均值的200%、在支付确认页面修改投资金额的方向为增加、修改幅度超过初始金额的50%。
针对这类用户,推送策略的核心是“收益最大化暗示”——App首页优先展示收益率最高的产品,收益率数字使用放大字号和红色字体;在产品详情页嵌入“收益对比”模块,将本平台产品与银行定期存款、货币基金的收益率进行视觉化对比,对比图中银行定期存款的柱状图被压缩到几乎不可见的程度;推送消息的话术围绕“加息”“限时”“抢购”“最后机会”等稀缺性暗示展开;优惠券的触发条件被设置为“用户在支付确认页面停留超过3秒”——这个停留被系统解读为“用户在犹豫是否增加投资金额”,此时弹出一张“限时加息0.3%”的优惠券,有效期为15分钟。
到2017年12月,用户A的单笔投资金额达到20000元,他的App首页已经不再显示任何风险提示入口。从注册到完全的信息茧房化,这个用户经历了九个月。
用户A的损失发生在2018年7月。平台暴雷时,他的在投本金为86000元,相当于他所在城市当年城镇居民人均可支配收入的2.4倍。他在维权群中反复说的一句话是:“我从来不知道这个产品有风险。”
这个陈述在事实层面是真实的——在他使用平台的整个过程中,算法确实从未让他看到过完整的风险提示。但它在法律层面是无效的——平台可以证明,产品页面上确实放置了风险提示,用户协议中确实包含了风险条款,用户在购买时确实点击了“同意”。法律要求的信息披露,平台都做了。只是算法确保了用户不会注意到它们。
这就是大数据精准投喂将行为工程推到的新的精度。设计者不再需要违反任何一条监管规则。他们只需要精确地知道每一个用户在什么条件下会忽略规则要求披露的信息,然后用算法创造出那个条件。
合规文本仍然存在,风险提示仍然在页面上,协议条款仍然完整——它们在形式上是完美的。但它们被放置在一个经过精确计算的、用户几乎不可能注意到的位置、时间点和视觉层级上。形式合规与认知合规之间的鸿沟,被算法扩大到了极限。
截至2017年底,前述平台的活跃用户中,被系统标注为“认知懒惰型”的比例为41%,被标注为“价格敏感型”的比例为28%,被标注为“风险敏感型”的比例为19%,其余为混合类型。平台暴雷后,按用户画像分类统计的亏损数据显示:“认知懒惰型”用户的平均亏损金额为7.2万元,“价格敏感型”用户为8.9万元,“风险敏感型”用户为4.1万元。
“风险敏感型”用户的亏损之所以相对较低,不是因为他们做出了更明智的决策——他们同样处于信息茧房中——而是因为他们在初始阶段投资更谨慎,单笔金额更小。但他们的谨慎被算法缓慢而坚定地瓦解了。
当收割效率被量化到每一个用户画像的维度,当0.7%的查看率成为设计者精确计算过的合规安全边际,监管的静态文本还剩下多少防御力,这个问题已经不再需要回答。