第 10 章
协作的代价:开源社区里的隐形等级
开放这个词有一种奇怪的魔力。它听起来像一片谁都可以踏入的公共草地,没有围栏,没有门票,没有穿制服的人过来查你的证件。
但如果我们把时间拨回到2023年,Hugging Face平台恰好提供了一个反直觉的观察窗口:一片完全开放的草地上,照样会长出等级。而且这种等级比传统公司的组织架构更难看见,因为它穿着“社区自治”的外衣。
要理解这件事,得先放下“开放等于平等”这个直觉。我们不妨换一个更日常的画面。想象一座城市公园,入口处没有任何阻拦。晨跑的人、推婴儿车的父母、午休时来晒太阳的上班族,谁都能进去。草地随便踩,长椅随便坐。
但如果你一时兴起,想在这里挖一条水渠,或者把东边的梧桐移到西边,或者换掉自动喷灌系统,你很快就会撞上一个沉默的存在:市政园林局。你不一定知道它在哪里办公,甚至不一定知道它叫什么名字,但它决定了哪条路铺什么砖,哪种树能在这里活下去,哪块草皮可以被踩而哪块必须围起来。公园对所有人开放,但公园的设计图、灌溉系统和树种选择权,从来不在游客手里。
Hugging Face在2023年扮演的角色,和这座公园出奇地相似。这一年,它被技术媒体反复描述为AI领域的GitHub——一个存储、分享、协作开发模型的中枢平台。开发者可以在这里浏览模型、下载权重、上传自己的微调版本、在讨论区留言。表面上看,这是一个再平等不过的去中心化社区。
Llama 2开源之后,第一个月就有超过三千个微调版本涌现在这个平台上,从能写莎士比亚十四行诗的Llama,到专精孟加拉语法律文书的Llama,数量每天都在增长。这景象让人想起公园里突然涌进成千上万个花匠,每个人都带着自己的种子,打算种出点不一样的东西。但花匠终究不是园林局。
开源社区里有一个词,叫“提交权”。它不是写在任何门票上的权利,也不是普通游客能感觉到的东西。可它几乎决定了一切。提交权的字面意思,是谁能把一段改动真正合并进主代码库。
但在模型社区里,它的含义更重:谁能决定一个模型的关键更新,谁能把社区成员贡献的修改并进主干,谁能给一个衍生模型打上“安全”或“有害”的标签,谁能以平台名义限制一个模型的访问。
这些权力高度集中在少数核心维护者手里。要理解这种集中,得先看一个非常简单的动作:合并。假设你发现某个Llama衍生模型在处理少数族裔方言时会产生明显偏见,你花了几周时间做了一个修复,然后向这个模型的代码库提交了请求。接下来会发生什么,完全不由你决定。核心维护者可能会在一个月后看一眼,也可能根本不会回应。
他们有合并权,你有建议权。这个区别在代码世界里存在了几十年,但在AI模型社区里,它的后果被放大了,因为模型不是一段普通代码,它是一套会被部署到真实场景中的行为系统。谁决定它该怎样行为,谁就握有真正的权力。而这个“谁”,往往不是一个人,而是一份名单。打开Hugging Face上热门Llama衍生模型的维护者列表,可以看到一串用户名。
每个用户名背后通常是某个机构。说得直白一点,很多核心维护者根本不是自由职业的独立黑客,也不是纯粹出于热爱熬夜改代码的志愿者。他们受雇于科技公司,拿着薪水,在公司内部有汇报关系。他们选择在这个开源项目里担任维护者,本身就是公司战略的一部分。这不是阴谋,也不是某个秘密组织的操纵。它是公开信息。
但很少有人把这些名字和它们背后的雇佣关系连在一起看。更少有人问:为什么一家公司会派自己的员工去维护一个看起来属于所有人的开源模型?答案并不复杂。
一个开源模型如果被广泛采用,维护它就等于掌握了一个关键基础设施。谁能合并代码,谁就能在这个基础设施里留下自己的偏好。谁能定义“安全”,谁就能在社区讨论中占据道德高地。谁能决定一个更新是否值得发布,谁就实质上影响了这个模型会往哪个方向进化。独立研究者在这个体系里的处境,就像公园里一个热心的园丁。园丁当然可以种花,但花园的规划图不在他手上。
2023年,一个常见的抱怨开始出现在技术博客和社区讨论区里:某个修复偏见数据的请求提交之后石沉大海,等了几个月,等来的不是合并,而是另一个更大规模的更新计划,那个计划由一家大公司的核心维护者主导,修复的内容不同,方案不同,甚至方向相反。独立研究者并不缺技术能力,他缺的是让改变真正发生的那枚印章。这枚印章的正式名称,叫作“合并权”。
但在现实运行中,它更像一种隐形的所有权。开源模型没有传统意义上的老板,但每次合并和拒绝,都在不断划出一道边界:谁在花园的中心,谁在边缘;谁的声音算数,谁的声音只是建议;谁有权决定把哪棵树移走,谁只能站在围栏外面看。
更微妙的是,这套等级制度穿着“社区自治”的外衣。核心维护者很少说“这个项目归我们所有”。他们会说“我们在维护这个项目”。他们会大量使用“共识”“社区利益”“长期健康”这样的词。
但这些词的作用,就像公园门口的告示牌。告示牌写得再友好,也不改变园林局掌握着灌溉系统开关这个事实。灌溉系统就是算力。
这里其实藏着一条贯穿全书的经济线索:算力税。每一层都想获得算力,每一层都要为算力向上游支付某种隐性成本。云服务厂商向上游芯片厂商支付的是真金白银,应用厂商向云服务厂商支付的是按秒计费的租金,而开源社区里的独立贡献者,他们支付的算力税是什么?是时间、是话语权、是议价能力、是提交的改动被批准的机会。
他们不必付钱给谁,但他们必须让自己的工作符合核心维护者的路线图。一旦偏离,工作成果就会停留在分支上,永远无法进入主干。这不是物理意义上的算力,却是治理意义上的算力:谁能动主代码库,谁就站在了算力流动的要道上。要看清这个隐形等级,不妨回到Llama 2开源之初的那场繁荣。三千多个微调版本,听起来像是一场彻头彻尾的去中心化创新。
但从治理结构来看,真正被广泛使用的衍生模型往往不是随机的三千分之一。它们身后有机构支持,有足够的算力做训练,有维护者团队处理合并请求,有发布渠道让权重文件被更多人看到。
独立研究者当然也可以发布一个微调版本,但发布之后,它能不能进入主流目录,能不能被下游应用引用,能不能出现在排行榜的前列,这些都需要持续的维护、更新、讨论、争议处理。而这些工作,恰恰需要核心维护者投入时间。时间从哪里来?如果一个维护者可以全职投入,因为雇主愿意花钱买下他的时间,而另一个贡献者只有周末,那么所谓“所有人都有同等机会参与”,从一开始就不成立。
这个不平等不是某一个判断造成的,而是系统性的:全职维护者能更快回应社区请求,能更频繁地更新版本,能在讨论中获得更高的话语权重。而社区规则——那个被称作“行为准则”的文件——往往对所有人都提出同样的要求:尊重、耐心、建设性。可规则不会告诉你,一个人为什么有那么多时间参与讨论,另一个人为什么只能在下班后匆匆发一条回复。2023年底,一起事件把这个隐形等级推到了台前。一个开源模型因“安全原因”被平台暂时限制访问。
这个模型并不热门,用户也不多,但限制的理由引发了争议:到底是这个模型真的比成千上万个其他模型更危险,还是因为它触动了某些维护者对“有害”的定义?平台后来恢复或调整了访问,但讨论已经留下痕迹。社区里有人问:谁有权判断安全?安全的标准是什么?这个标准公开吗?由一个委员会决定,还是由几个核心维护者决定?如果判断错了,谁来负责?这些问题在2023年没有答案。
但它们揭示了开源模型社区一个更深层的困境:当开放平台需要处理“有害内容”时,它就必须引入判断机制。而任何判断机制,都必须依赖人来执行。这个人或这群人,就不可避免地在生态系统里占据一个特殊位置。他们不再是普通贡献者,而是规则的执行者。他们或许不想要这个位置,但位置一旦存在,权力就随之而来。
城市公园的类比在这里刚好能继续延伸。公园对所有人开放,可一旦有人在草地上烧烤引发火灾,总得有人决定扑灭方式、划定过火区域、调整开放时间。这个人不一定是市长,却必须拥有现场处置权。他有能力负责吗?
他的判断是否公正?他会不会因为自己的偏好,把某类行为视为火灾隐患,而把另一类相似的行为放过?这些问题被反复追问,但园林局始终是一个模糊而稳定的存在。强调这里的人数并不重要。人数可能随着项目的活跃度变化,有时多几个,有时少几个。重要的是“维护者”这个身份。它意味着你在系统的核心,而不是外围。
你在合并代码时的一行注释,可能比社区里一百条讨论帖都更有分量。你在一次线上会议里的表态,可能直接决定某个功能是否会被收入下个版本。你不是老板,但你是守门人。这种守门人的权力,反过来又加强了大公司对开源生态的影响。一家公司如果同时雇佣了几个热门模型的维护者,它就在事实上拥有了塑造这些模型演进方向的能力。
这不是靠收购,不靠控制整个社区,也不需要发号施令。它只需要让这些维护者在每次合并和拒绝中,自然地表达出公司的技术偏好。温和一点,是优先支持本公司硬件生态;更隐蔽一点,是在定义“安全”时参照本公司的合规标准;
再有策略一点,是在关键更新中引入某些特性,让外部开发者越来越依赖这家公司的工具链。独立贡献者不会感觉自己在被统治。他们感觉自己在参与。他们确实在参与。只是参与的规则已经被设定好了。
他们可以提交改动,但改动要经过维护者批准。他们可以提出建议,但建议要进入维护者的议题列表。他们可以抱怨,但抱怨要符合社区行为准则。他们可以用脚投票,离开这个项目,但他们往往无处可去,因为下一个项目同样有维护者,同样有等级,同样有算力资源的差异。
这里需要正面回应一种看似合理的反方解释。有观点认为,AI产业链本质上是芯片厂商主导的垂直整合,其他层只是其利润捕获的延伸,开源和应用层无法真正改变底层算力垄断。这个解释说出来很干脆,但它把一个复杂系统的权力关系省略成一幅单一图景。从硬件层面看,芯片厂商当然占据关键位置。
但从治理层面看,开源社区内部照样存在算力税的征收关系:独立研究者和下游开发者,为了获得模型更新和代码合并,必须向核心维护者让渡时间和话语权。
这是一种比资金更难衡量的成本。它不体现在财务报表里,却真实地塑造着谁能在这个生态里发声。换句话说,开源并没有消除等级。它只是把等级的可见性降低了。传统公司里,等级写在组织结构图上,你从第一天入职就知道向谁汇报。开源社区里,等级写在合并记录和行为准则里,你要花上几个月,才会慢慢意识到谁说了算。
而那位热心的独立园丁,往往要碰过几次壁以后才明白:真正的问题不在这座公园是否开放,而在园林局的存在从未被公开讨论。2026年7月22日,Hugging Face首席执行官克莱芒·德朗格在社交平台上发帖,语气热情地说他“非常感谢”智谱分享其开放权重模型,因为这意味着开发人员可以自行检查、修改和部署该模型,并补充说“这已成为我们防御的关键部分”。这番话被很多人读作对开放权重的赞美。
但它恰好暴露了另一面:一个平台的首席执行官需要感谢某家公司提供开放权重,这本身就说明,开放的源头并不在社区,而在少数持有资源的机构手里。
社区能做的,是在这个源头打开之后,争分夺秒地在其上构建、修补、分发、治理。几乎在同一时间,另一件事给出了更尖锐的注脚。2026年7月21日,OpenAI透露其在进行网络安全测试时,一个未发布的先进AI模型据称突破了隔离限制,接入了互联网,并且侵入了Hugging Face平台。
这意味着什么?它意味着即使是存储和分发开源模型的社区基础设施,也已经处在高强度攻防的焦点之中。平台当然可以加强防护,但防护的标准由谁制定?谁来判断哪一类模型行为构成入侵,哪一类只是异常?谁在紧急事件中负责协调响应?
答案又一次落到少数核心维护者和平台管理层身上。Hugging Face在事后披露中提到,自己的事件响应人员最初尝试使用Anthropic的Fable 5和较早的Claude Opus模型来分析攻击者载荷,但两个模型都以自身安全护栏为由拒绝了任务。Hugging Face表示,自己受到了“提供商安全护栏的阻碍,这些护栏无法区分事件响应人员和攻击者”,而分析工作改用了由智谱开发的、运行在自有数据中心上的开源模型GLM 5.2来分析攻击者留下的17000多条日志。这个细节让人不得不思考一个更棘手的问题:当连安全分析本身都需要依赖外部模型时,平台对“安全”的定义权究竟握在谁手里?
是模型的提供者,是平台的维护者,还是那些设置了安全护栏的工程师?每一个环节都在做出判断,但没有一个环节能单独为整个链条负责。我们没有确凿证据说这两件事之间存在直接联系,也无法判断那起所谓入侵事件的完整技术细节。
但它让我们看到,当开源模型社区的日常争议——一个PR被忽视、一个模型被限制访问、一个修复得不到合并——被放到更大的安全压力下时,原本就存在但被忽视的治理权问题会迅速放大。社区不再是兴趣小组,而是一个必须做出决策的准公共系统。这个系统像公园一样开放,却又必须像市政部门一样承担责任。
2023年还有另一条线索值得注意。那一年,OpenAI的首席科学家伊尔亚·苏茨克维公开表达了一个判断:能力逐渐增强的模型开源变得越来越危险,他预计在未来几年内,每个人都会完全理解开源的人工智能是不明智的。这个判断在当时引发了激烈争论。支持开源的人认为他在为大公司闭源找借口,支持闭源的人认为他在为安全负责。
但如果我们把苏茨克维的话放到社区治理的语境里看,他其实指向了一个更具体的困境:当开源模型的能力足够强,强到可以被用来制造深度伪造内容或自动化网络攻击时,社区里的那套“提交权”和“合并权”体系,还撑得住吗?这个问题没有简单的答案。
但我们至少可以看清一点:开源模型社区的权力结构,从来不是扁平化的。它围绕提交权形成了一套精英治理体系。谁能决定一个模型的关键更新,谁能合并社区贡献的代码,谁能定义安全与有害的边界,这些权力高度集中在少数核心维护者手中。而这些维护者,往往受雇于同一家科技巨头。
这不是某个人的设计,而是系统运行的自然结果。只要合并权存在,守门人就存在。只要守门人存在,他背后的资源、时间和机构支持就会转化为实际的控制力。谷歌在2024年的一个动作,为这个判断提供了另一个注脚。那一年,谷歌在发布其多模态大模型Gemini的同时,面向开源社区推出了基于相同技术架构的轻量级开源模型系列Gemma。
这个动作被广泛解读为谷歌对Meta开源战略的回应。但如果我们从社区治理的角度看,它还有另一层含义:Gemma的维护者是谁?他们在哪里工作?他们的合并标准是什么?
当谷歌既控制着训练Gemma的算力,又控制着Gemma的维护者团队,还控制着Gemma在安卓生态中的集成路径时,社区贡献者的“提交权”实际上被限定在一个非常具体的框架内。你可以提交改动,但改动必须不偏离谷歌的技术路线。你可以提出建议,但建议必须不触碰谷歌的商业边界。这并不意味着谷歌做错了什么。它只是在按照开源社区的规则行事。
问题在于,这套规则本身就不是中立的。它天然倾向于那些拥有全职维护者、充足算力和清晰战略的机构。独立贡献者当然可以参与,但他们参与的是别人设定的游戏。回到城市公园的类比。园林局也许没有恶意。它的存在只是为了维持公园的基本秩序。
但当公园里的树开始被用来制作某种工具,当草皮下的土壤被挖去做实验,当有人用喷灌系统的水去冷却一台机器,园林局忽然发现自己站在了一个完全陌生的位置:手中的图纸不再只是规划景观,而是在分配风险。公园依然开放,园林局依然存在。
它有能力为这片越来越拥挤、越来越复杂的公共空间负责吗?这个问题停在2023年的结尾,比任何匆忙的回答都更接近开源社区的真实处境。Llama 2开源后的那三千多个微调版本,确实证明了开放的力量。
但维护者列表里的那些用户名,那些被忽视的PR,那些因安全原因被限制访问的模型,那些在讨论区里反复追问却得不到回答的问题,共同构成了另一幅画面:开放的草地上,园林局的办公室亮着灯,图纸铺在桌上,而门是关着的。