第 8 章

看不见的边界

走廊尽头的会议室门还关着。陈默站在门前,手里捏着那份改了七遍的策划案,封面标题从“算法友好型策划”换成了“基于用户行为数据与内容调性平衡的专题策划方案”,一行字挤在A4纸的窄边距里,像某种不敢声张的妥协。

她推门进去时,长桌两侧已经坐满。运营团队在左边,算法团队在右边,中间空着两把椅子,像一道被刻意留出的缓冲带。

投影幕布上还亮着上一场会的残留画面,一条陡峭的日活曲线从百万量级一路攀升,拐点处被红笔圈了三遍。没人说话。空调出风口的嗡鸣填满房间。

梁汝波坐在长桌中段。他面前摊着一份打印出来的内容审核日志,纸张边缘被手指反复摩挲得起了毛边。

日志记录了上周被算法推荐进入热门池的一批视频,其中十七条在二十四小时内被用户举报,举报理由集中在“低俗”和“不适”。运营团队会前做了逐条标注,每一条旁边都贴着黄色便签,密密麻麻,像某种病态的花。

“先过数据。”梁汝波开口,声音不高,房间里的嗡鸣立刻退到背景里。运营负责人点开第一页幻灯片。

两条曲线并排出现:左边是运营团队人工精选的“体面”内容,完播率、互动率、分享率都稳定在基准线附近,曲线平滑得像被熨过的领带;右边是算法自然推荐的高互动内容,完播率曲线剧烈震荡,峰值是前者的一点七倍,评论区却充斥着“辣眼睛”“举报了”“这也能上热门”的留言。“体面内容的数据不差。”运营负责人说,“但算法不认。”

这句话落下去,没人接。算法团队的人交换眼神,有人把笔记本电脑屏幕掀开又合上。朱文佳坐在靠窗位置,手指转着一支圆珠笔。他的技术直觉告诉他,那十七条被举报的视频在特征空间里与正常内容的重叠度超过百分之八十。模型没有能力区分“猎奇”和“有趣”,它只认互动概率。“算法没有审美。”朱文佳终于开口,语气像在陈述一条物理定律,“它只有目标函数。你给它什么目标,它就优化什么。”

“所以是我们的目标函数错了?”运营负责人反问。“目标函数没有对错。完播率和互动率是你们定的,算法只是执行。”朱文佳停了一下,“执行结果和你们想要的结果出现偏差。偏差不在算法,在定义目标的人。”

梁汝波把审核日志翻到最后一页。那里夹着一张手写便签,字迹潦草,像凌晨时分写下的:“推荐池里的内容,我们自己都不愿意看第二遍。”他没有把便签举起来,只用拇指按住它,指节微微发白。

这是2017年下半年。抖音的日活刚刚越过千万量级,增长曲线陡峭得让整个行业侧目。外部看到的是数字,是融资,是“下一个现象级产品”的标签。内部感受到的是另一种东西,一种在数据飙升中逐渐浮现的失控感。算法推荐的效率越高,内容池的边界就越模糊。运营团队精心策划的选题在数据上被自然推荐的高互动内容碾压,那条被反复争论的“调性”边界,此刻正以一种更正式的方式被提上台面。

会议持续将近三个小时。争论焦点从“算法是否应该加入人工干预”滑向“人工干预的边界在哪里”,又从“边界”滑向“谁来定义边界”。运营团队坚持平台需要守住某种底线,算法团队反复强调任何人工干预都会损害推荐精准度,而精准度是抖音增长的命脉。两边的立场在数据面前都站得住脚,数据本身却无法裁决这场争论。

最终,梁汝波做了一个决定。他让算法团队继续跑数据,运营团队继续做人工精选,两套内容池并行运行,一周后复盘。这个决定在会议记录里被写成“让数据再跑一段时间”,措辞中性,像一份没有结论的实验报告。

陈默收拾会议室时,看到梁汝波把那张手写便签从审核日志里抽出来,折了两折,放进衬衫口袋。走廊里的灯已经暗了一半。

陈默抱着笔记本电脑往工位走,经过算法团队办公区时,看到朱文佳还坐在工位上。屏幕上是一张特征空间散点图,密密麻麻的点被染成两种颜色,中间有一条模糊的分界线。他盯着那条线看了很久,然后新建一个文档,开始写第一版审核模型的迭代方案。文档标题栏里只有一行字:“边界定义问题——待解决。”

约谈来得比预期早。通知由行政团队转达,措辞克制,只说需要“就近期内容生态情况做一次沟通”。没有点名具体视频,没有列举具体违规条目,但字节跳动内容运营团队的人都知道,这类沟通从来不会无缘无故。

张一鸣当天下午临时取消原定的产品评审会。他把梁汝波和朱文佳叫到办公室,门关上那一刻,走廊里几个正准备汇报的年轻人交换了一下眼神。没人说话。

约谈的具体内容没有留下详细记录。可以确认的是,字节跳动随后启动了一系列内部动作:重新梳理内容审核流程、扩编审核团队、与监管机构建立更频繁的沟通机制。这些动作在当时的内部邮件和会议纪要中留下了痕迹,但具体到某一次谈话的措辞、某一位官员的表情、某一句被反复引用的原话,这些不在可查证范围内。能查证的是结果。

张一鸣在那次约谈之后,第一次在内部提出一个判断。他说,全球化是下一个十年。这句话后来被反复引用,成为字节跳动国际化战略的起点。

但在当时,它更像一个从危机中生长出来的对冲逻辑:如果国内的内容边界日益收紧,增长的下一个出口必须在更广阔的市场里寻找。这个判断的背面是一个更沉重的问题:如果抖音在国内必须承担内容生态的公共责任,它在海外的扩张是否也会遭遇同样的边界?

梁汝波被推到前台。他被要求牵头搭建一套后来被称为“内容安全中台”的体系。这个体系的核心任务,是在算法推荐的效率和内容合规之间找到一条可行路径。

梁汝波很快发现,他撞上的悖论没有技术解:审核越严,算法推荐的精准度越受损;审核越松,产品生存的合法性就越脆弱。

悖论两端站着两种完全不同的逻辑。一种是工程的逻辑,追求可量化、可优化、可规模化;另一种是治理的逻辑,追求可解释、可问责、可边界化。

梁汝波在接下来几周里密集约人谈话。他找运营团队的人,找算法团队的人,找法务,找政府关系,甚至找几个早期用户做深度访谈。他试图从这些碎片中拼出一张完整图景,但每次拼到边缘地带,图景就变得模糊。

大量边缘内容无法被简单归类:一段配着低俗音乐的舞蹈视频,在算法看来是高互动内容,在运营看来是低俗内容,在法务看来是灰色内容,在用户看来可能只是“好玩”。每一种视角都成立,每一种视角都无法覆盖全部。

朱文佳在这个阶段主导第一版审核模型的迭代。他的技术理性告诉他可以量化一切:把内容拆解成特征向量,用分类器标注风险等级,用阈值控制推荐范围。

第一版模型上线后,日均处理视频数量迅速攀升,误判率同样居高不下。模型会把一些正常舞蹈视频标记为“低俗”,因为背景音乐里出现敏感词;也会漏掉一些明显违规内容,因为视觉特征与正常内容高度重叠。朱文佳在内部复盘会上说了一句话:“模型能学会区分猫和狗,但学不会区分‘有趣’和‘低俗’。因为‘低俗’的定义在变,猫和狗的定义不变。”

这句话被记录在会议纪要里,后来被反复引用。在当时,它只是又一条无法落地的技术判断。

真正的撕裂发生在一次通宵会议上。会议起因是一批被算法推荐进入热门池的违规内容。数量不大,性质敏感。

运营团队当晚八点发现问题,九点开始逐条下架,十点通知梁汝波,十一点张一鸣到了会议室。没有人通知他,他自己来的。他推门进来时,手里拿着一杯已经凉透的咖啡,衬衫袖口卷到小臂中段,像刚从某个更长的会议里脱身。

会议室里的人比平时多。运营、算法、法务、政府关系,四条线的人挤在长桌两侧。投影幕布上轮播被下架的视频截图,每一张都打了红框。

梁汝波坐在长桌一端,面前摊着三份不同的处理方案,分别对应三种审核尺度。朱文佳坐在另一端,笔记本电脑屏幕上跑着模型实时数据,误判率和漏判率两条曲线在同一个坐标系里交叉。争论从十一点持续到凌晨两点。

运营团队要求提高人工审核比例,算法团队警告这会拖慢推荐速度,法务团队提出需要建立更明确的内容分级标准,政府关系团队反复强调“合规是底线,没有商量余地”。每一条意见都有道理,每一条意见都指向不同方向。梁汝波试图整合,每次整合到关键节点就会卡住。效率和安全在根子上是两种目标,它们可以在短期内共存,却无法在同一个决策框架里被同时最大化。

凌晨两点四十分,朱文佳展示第一版审核模型的实时数据。屏幕上跳出一行数字:模型当日处理视频数量、误判率、漏判率、人工复核比例。数字是冷的,房间里的人都读出了它的含义。模型正在以人力无法企及的速度处理内容,判断精度远远不够。它像一台高速运转的机器,吞进去海量视频,吐出来概率。概率无法为“边界”负责。

张一鸣一直没怎么说话。他坐在长桌靠墙的位置,手指搭在咖啡杯杯沿上,眼睛盯着投影幕布上的数据。他的表情看不出情绪,熟悉他的人知道,这种沉默意味着他在做一种更深的计算。不是算数据,是算方向。凌晨三点,他开口了。

他没有针对任何一条具体意见,也没有评价任何一个方案。他问了一个问题。声音不大,在凌晨三点的会议室里,每个字都落得很清楚。“我们到底是在做工具,还是在做媒体。”

没有人回答。工具的逻辑是:我们提供技术,内容由用户创造,责任由用户承担。媒体的逻辑是:我们选择内容,我们定义边界,我们承担公共后果。两种逻辑对应两种完全不同的组织形态、成本结构、生存策略。

抖音从上线第一天起就在两种逻辑之间摇摆。它用工具的效率获取增长,又用媒体的方式运营内容。摇摆有代价。代价就是当边界问题真正浮现时,团队发现自己既没有工具公司的免责空间,也没有媒体公司的责任能力。

朱文佳在沉默中合上笔记本电脑。梁汝波把三份方案叠在一起,推到桌子中央。运营负责人摘下眼镜,用拇指和食指捏了捏鼻梁。

没有人试图给出答案,因为所有人都知道,这个问题没有单一答案。技术方案解决不了它。它是一个必须被组织长期承受的张力。

会议在凌晨四点结束。没有形成决议,没有发布邮件,没有指定责任人。每个人都带着某种东西离开会议室。梁汝波带走了那张手写便签,朱文佳带走了模型迭代的下一步计划,张一鸣带走了那个问题。

那个问题后来在内部被反复提及,每次提及都会引发新一轮争论,但争论焦点逐渐从“什么是正确答案”转向“我们如何在这个问题下继续工作”。内容安全中台的建设在接下来几个月里加速推进。审核团队从最初几十人迅速扩张,招聘标准从“有内容经验”转向“有风控意识”,培训流程从“熟悉产品”转向“熟悉法规”。第一版审核模型经历三次重大迭代,误判率逐步下降,始终无法归零。朱文佳在内部技术分享会上说了一句话:“模型可以做到百分之九十九的准确率,剩下的百分之一才是真正的边界。那百分之一里藏着所有无法被量化的东西——语境、意图、文化、时代。”

梁汝波把这句话记在笔记本上。他的笔记本里还记着另一句话,是张一鸣在那次通宵会议后单独跟他说的:“效率优先的逻辑,从今天开始要改。不是不要效率,是效率不能再排在第一。”

这句话后来被写进内容安全中台的内部章程,措辞更正式,内核没有变。字节跳动从这一天开始,第一次把“安全”作为一项独立成本列入组织预算。审核团队扩张、模型迭代投入、法务和政府关系编制增加,所有这些在财务报表上都是成本,在增长曲线上都是拖累。它们被接受了,因为不接受就意味着更大的风险。

这是“组织进化”的第一次真正落地。公司为了适应规模扩大和外部压力,不得不改变原有的管理方式、结构和文化。这个过程痛苦,因为它意味着承认:增长不是唯一目标,效率不是唯一逻辑,算法不是唯一裁判。

陈默在那次通宵会议后的第三天,重新提交那份策划案。标题又改了一次,从“基于用户行为数据与内容调性平衡的专题策划方案”改成更简洁的“专题策划方案”。她在提交邮件里写了一句话:“不追求算法友好,只追求内容本身值得被看见。”这句话没有被回复,策划案被通过了。运营团队后来做了一期专题,主题是“城市夜归人”。

内容是一组记录深夜街头普通人的短视频,没有强音乐,没有快剪辑,没有互动诱导。数据很平,完播率只有基准线的六成,互动率不到平均值的四成。这期专题没有被下架,没有被举报,没有被约谈。它在内容池里安静地存在着,像一块被放进急流里的石头。

算法没有给它流量。运营团队把它留在首页推荐位,人工置顶七十二小时。

这是妥协,也是抵抗。妥协的是数据逻辑,抵抗的是“只有数据能定义好内容”的信念。

陈默后来在团队内部复盘时说了一句话:“我们可能改变不了算法,但我们可以决定自己创造什么。”这句话没有被写进任何正式文件,它成了运营团队内部的一种默契:在算法定义的边界之内,保留一块人工可以呼吸的空间。

这是抖音早期的一个零件时刻。陈默把标题改到第七遍,把自己对内容的主张压成中性词;审核员被编入三班倒,成为模型之外的人工补丁;梁汝波把三份方案叠在一起,像把三种立场压成一张纸。没有人被正式宣布为零件,但每个人都感到自己正在被某种更大的机器重新安排位置。

零件时刻不是比喻。它发生在具体的人身上:一个人改掉自己写下的标题,一个人把便签折进口袋,一个人盯着特征空间里那条模糊的分界线,知道它永远不会变得清晰。

截至2017年底,抖音内容审核团队从几十人扩张到数百人,分布在北京、成都、西安三个审核基地。第一版审核模型日均处理视频达到百万条量级,误判率从最初的两成降到一成左右,边缘内容的误判率仍超过三成。因合规要求而下线或限流的视频内容累计超过百万条量级,占同期内容池总量的百分之三到五。

这些数字在内部被称为“安全成本”。它们不产生增长,不贡献日活,却决定了这台增长机器能否继续运转。

张一鸣在那年年底的一次内部讲话中提到一句话。他说,抖音从一个工具变成了一个需要承担公共责任的产品。这句话没有回答“工具还是媒体”的问题,它承认了问题的存在。

承认问题是解决问题的第一步,第一步之后的路更长。边界不是一条可以被画出来的线,而是一片必须被持续探索的区域。

那片区域里没有算法可以优化的目标函数,没有数据可以验证的最优解。只有一群人,在深夜的会议室里,反复争论那些无法被量化的东西。梁汝波把那张手写便签一直留在衬衫口袋里。便签上的字迹已经模糊,那行字他记得很清楚:“推荐池里的内容,我们自己都不愿意看第二遍。”

这句话后来被他写进内容安全中台的第一版培训材料,作为案例讨论的开场。讨论没有标准答案,每个参与讨论的人都知道,这个问题本身就是答案的一部分。边界不是被发现的,是被建设的。建设边界的人,必须首先承认自己站在边界之内。

凌晨三点的那个问题,最终没有被回答。它被留在那里,像一块嵌入组织骨骼的钢钉,不显眼,但承重。每一次产品跃迁、每一次组织扩张、每一次算法迭代,都会牵动这根钢钉,提醒所有人:效率的另一面是代价,增长的另一面是责任,算法的另一面,永远站着人。如果只看结果,很容易把这一切归功于推荐系统、增长中台和全球化资本。换一批同样理性的人,也许也能做出一个高日活产品。

工程可以复制,模型可以迭代,资本可以再找。但换一批人,不会在凌晨三点问出那个问题,不会把一张手写便签留进口袋,不会把标题改七遍。那些动作不产生日活,不进入融资材料,却决定了组织在压力下选择成为什么。幸存者叙事会浪漫化随机过程,组织记忆却记录下具体选择。

抖音后来的路径依赖,就藏在这些选择里。到2017年底,内容安全中台成为独立成本中心。审核团队实行三班倒,模型每日处理量维持在百万条量级,人工复核比例居高不下。因合规要求下线或限流的视频累计超过百万条量级,占同期内容池总量的百分之三到五。

这些数字与日活增长并列在同一页年度总结上。它们标志着“效率优先”逻辑第一次被系统性地折损,也标志着“内容安全”作为一个沉重的成本中心和组织机能,被永久地植入这台增长机器之中。会议室白板上还留着那晚的讨论痕迹。有人用红笔写了一行字,字迹潦草,像凌晨时分的产物:“边界之内,才有自由。”没有人承认是自己写的,也没有人把它擦掉。

它留在那里,和那些数据、问号、曲线一起,成为下一次争论的起点。走廊尽头的灯已经全暗。只有算法团队办公区还亮着一盏台灯。朱文佳坐在灯下,屏幕上跑着第二版审核模型的测试数据。误判率曲线在缓慢下降,那条模糊的分界线依然存在。他盯着屏幕看了一会儿,然后新建一个文档,标题栏里写了一行字:“边界之内——第二版模型设计原则。”

文档第一行是一句话:“模型不能定义边界,但可以帮助人看见边界。”

约谈之后第二周,梁汝波把内容安全中台的筹备会定在早上八点。会议室还是那间,白板上留着上一场会的残留字迹,有人把“日活”“完播率”“互动率”圈在一起,旁边画了一个问号。梁汝波没有擦掉它,而是在问号下面画了一条横线,写上“合规”。

这个动作很小,却改变了会议的方向。过去内容审核是运营团队的事后补救,现在它被拆成流程:机器初审、人工复审、高风险抽检、监管反馈回填、应急下架、申诉复核。每一步都要有人签字,每一步都要留下记录。

审核团队不再只是“看视频的人”,他们被编入三班倒,成为模型之外的人工补丁。招聘标准从“有内容经验”转向“有风控意识”,培训材料里开始出现法规条目、案例复盘和边界讨论。梁汝波发现,内容安全中台不是技术项目,而是组织项目。

它要重新分配权力:算法团队让渡一部分推荐权重,运营团队让渡一部分选题自由,增长团队让渡一部分速度,法务和政府关系获得前置话语权。这种让渡在报表上表现为成本,在会议上表现为争吵,在组织记忆里表现为一种新的默认规则——任何方案在讨论增长之前,先要回答“如果出问题,我们怎么解释”。

朱文佳的模型迭代也在同一时间进入深水区。第一版审核模型上线后,日均处理量迅速攀升到百万条量级,误判率从最初的两成降到一成左右,但边缘内容的误判率仍超过三成。

模型能识别重复、暴力、明显色情,却无法识别语境。一个词在歌词里和在标题里风险不同,一段舞蹈在健身标签下和在软色情标签下风险不同,一段低俗音乐配上的正常舞蹈,在算法看来是高互动,在运营看来是低俗,在法务看来是灰色,在用户看来可能只是好玩。朱文佳在技术分享会上说,模型可以做到百分之九十九的准确率,剩下的百分之一才是真正的边界。那百分之一里藏着语境、意图、文化、时代。技术理性告诉他可以量化一切,但现实是大量边缘内容无法被简单归类。

于是审核模型必须和人工审核、用户举报、监管反馈形成闭环。模型不能定义边界,但可以帮助人看见边界。这句话后来被他写进第二版模型设计原则,在当时,它只是又一条无法落地的技术判断。

张一鸣的“全球化是下一个十年”在这个阶段被反复提及。它最初像一句从危机中生长出来的对冲逻辑:如果国内的内容边界日益收紧,增长的下一个出口必须在更广阔的市场里寻找。

但梁汝波很快意识到,这个判断没有让团队松一口气,反而让内容安全中台的任务变得更重。如果中台只为国内监管设计,它可能无法应对海外更复杂的合规环境;如果中台要可迁移、可审计、可解释,它就必须从第一天起就按更高标准建设。这意味着更多成本、更慢的迭代、更复杂的决策链条。

张一鸣没有在公开场合回答“工具还是媒体”的问题,但他开始在一些内部会议上改变提问方式。以前他问“这个方案能不能增长”,后来他问“这个方案如果出问题,我们能不能解释”。这个变化没有写进任何正式文件,却逐渐成为核心团队的默认议程。

合规压力制造了第一批被牺牲的方案。纯算法推荐实验被叫停,运营与算法并行内容池的实验被收编进安全中台,增长团队提出的激进互动诱导功能被搁置,海外复制国内增长打法的计划被标记为高风险。这些方案在上一年的增长逻辑里都曾被视为理所当然,现在它们必须让位于一个更沉重的目标:让产品活下去。

热账还在增长,日活、时长、互动率依然漂亮,但制度性坏账开始出现。下架、限流、审核成本、误判导致的创作者流失、监管沟通的人力投入,这些不贡献日活,却决定了增长机器能否继续运转。它们被记入预算,也被记入组织记忆。

陈默的“城市夜归人”专题通过后,数据很平,完播率只有基准线的六成,互动率不到平均值的四成。它没有被下架,没有被举报,没有被约谈,在内容池里安静地存在着。算法没有给它流量,运营团队把它人工置顶七十二小时。这是妥协,也是抵抗。妥协的是数据逻辑,抵抗的是“只有数据能定义好内容”的信念。

他保存文档,合上电脑,站起来走向门口。走廊里很安静,只有空调的低频嗡鸣。他经过运营团队办公区时,看到陈默工位上还亮着一盏小灯,屏幕上是一份新的策划案,标题栏里写着:“城市夜归人·第二期。”

他继续往前走,经过会议室门口。门关着,白板上的字还在。他停了一下,没有推门进去,只是站在门外看了一会儿那行模糊的红字。然后他转身走向电梯,去参加下一场会。那场会上他们要讨论另一个议题,另一个决策,另一个可能被数据否决的方案。电梯门打开时,他听到身后传来键盘敲击声,密集、连续,像某种被压缩到极限的节拍器,从算法团队办公区传出来,穿过走廊,穿过紧闭的会议室门,穿过那行留在白板上的红字,一直传到电梯口。门关上了。声音被隔在外面。但节拍器还在响。