第 17 章

玩家眼睛的疲劳

纵览《荒野大镖客:救赎2》的虚拟世界,圣丹尼城外的沼泽地在清晨五点四十分被晨雾笼罩。游戏内的太阳刚刚越过地平线,光线穿过水汽的折射被实时计算——每一束光在遇到每一粒悬浮水分子时都会发生散射,散射角取决于光的波长和水分子的密度。雾的分布不是均匀的:靠近水面的区域更浓,树冠上方更薄,因为温度梯度影响了蒸发速率。当主角亚瑟·摩根骑马穿过这片沼泽时,雾气会因他的移动而扰动,形成的涡流遵循流体力学模拟。这个效果消耗的GPU资源,大约相当于一台PlayStation 4全部算力的百分之十二。

大多数玩家没有看到这片雾。他们按住加速键,眼睛盯着小地图上的导航标记,以最快速度穿过沼泽,前往下一个任务触发点。那片耗费了数百个工时、经过多次迭代、在技术美术会议上引发了激烈争论的晨雾,在玩家的视网膜上停留的时间平均不超过三秒。同一年的十二月,《赛博朋克2077》发售。

夜之城的光源数量超过三万个,每一个霓虹灯管都经过独立的光照计算,在湿滑的街道表面上产生精确的反射。雨滴穿过光束时触发体积光散射,在主角的义体表面形成高光。发售一周后,一位玩家在YouTube上传了一段视频,标题是“在夜之城步行三十分钟,不看任何任务标记”。视频中,主角V在街道上缓慢行走,镜头固定在平视角度,没有跑动,没有跳跃,没有接任何任务。四十八小时内,播放量超过一百万。评论区最高赞的回复是:“我玩了六十个小时,从来不知道这个城市有这么多细节。”第二高赞的回复是:“我玩了六十个小时,从来不知道这个城市有这么多细节——因为我一直在盯着小地图上的黄色虚线。”

两件事并置在一起,呈现的不是两个游戏的对比,而是同一个结构性事实:游戏画面从未如此美丽,但玩家真正停下来看的时间从未如此短暂。这不是审美疲劳。审美疲劳意味着还有恢复的可能——换一种风格,换一种节奏,疲劳可以缓解。

这里发生的是视觉语法的通货膨胀。曾经需要一整个美术团队数月工作才能实现的画面奇观,现在被玩家用拇指在三十秒内划过去。要理解通货膨胀如何发生,需要回到游戏美术最根本的机制:视觉速记。视觉速记是游戏美术在硬件限制下发展出的一套压缩信息的方法——用最少的像素、最少的多边形、最少的着色器指令来浓缩语义信息,让玩家瞬间完成识别。

1985年的《超级马力欧兄弟》是这套机制最纯粹的范例。蓝色的天空代表安全,绿色的地面代表可站立,棕色的砖块代表可破坏或不可破坏的障碍物(取决于颜色深浅)。白色的云朵是纯粹的装饰,但它的存在本身传递了一个信息:这是一个天空关卡,重力规则不变。每一个8×8像素块都参与信息的压缩和传递。

玩家的眼睛不需要在“功能信息”和“装饰信息”之间做选择,因为两者是同一套像素。这套机制的有效性建立在两个前提上。第一个前提是硬件约束:显存只有2KB,调色板只有五十三种颜色,因此每一个像素都必须经过反复权衡。浪费一个像素去画没有功能意义的花纹,意味着要牺牲一个敌人的可识别性,或者一段地形的可读性。第二个前提是注意力契约:玩家愿意看画面,因为不看画面就玩不下去。没有HUD,没有任务标记,没有导航虚线。画面本身是唯一的信息源。视觉速记的效率,在这两个前提下达到了最大化。

四十年后,两个前提都瓦解了。硬件约束的瓦解是渐进的。1990年代,更多的颜色和更多的多边形让美术团队可以同时保留功能信息和装饰信息。2000年代,可编程着色器让表面材质从“示意”变成“模拟”。2010年代,物理渲染(PBR)标准化让任何表面都可以在数学上正确地对光做出反应。

到2020年,一棵树的树干表面可以拥有六层材质:基础色、法线贴图、粗糙度贴图、环境光遮蔽贴图、细节法线贴图、苔藓混合贴图。每一层材质的分辨率都是2048×2048像素。这六层材质共同作用,产生了一个物理上正确的树干表面:光从哪个方向来,反射就往哪个方向去;表面的微结构决定了高光的形状和强度;苔藓只在树干的北面生长,因为南面日照更充足。这一切都是正确的。但它在功能上传递的信息只有一个:这是一棵树。玩家可以靠近它,可以用枪射击它,可以躲在它后面,但它的六层材质不会改变任何游戏机制。它的视觉细节是冗余信息——用信息论的术语说,是熵。

当冗余信息的密度超过某个阈值,视觉速记就会失效。大脑的注意力分配系统会做出一个判断:这些信息不值得花时间处理。于是眼睛开始寻找信息密度更高的源——小地图上的图标,任务标记,伤害数字,经验值提示。这些图标在视觉上极其简陋,通常是单色、低分辨率、无渐变、无阴影。

但它们在语义密度上碾压了任何物理渲染的场景:一个箭头图标包含的信息量——方向、距离、任务类型、奖励内容——等于一棵拥有六层PBR材质的橡树的一千倍。这是通货膨胀的精确机制。货币贬值了。曾经稀缺的像素现在泛滥成灾,曾经珍贵的视觉奇观现在变成了背景噪音。

注意力契约的瓦解则更为复杂。它不是简单地“玩家变得没耐心了”,而是游戏的结构本身在四十年间被重新塑造。1985年的《超级马力欧兄弟》只有一个任务:从左走到右,不要死。没有任务列表,没有进度条,没有成就系统,没有每日挑战。玩家看画面的动机是纯粹的:不看就过不了关。

2020年的3A游戏提供的是一个完全不同的认知环境。任务列表、奖励系统、进度条、成就提示、每日挑战、限时活动——这些系统共同构成了一个持续的压力,要求玩家“做点什么”。完成一个目标,获得一个奖励,推进一个进度。在这种压力下,停下来看风景不是一个中性的选择,而是一个需要主动抵抗系统压力的行为。

每一个没有在推进任务的时间,都被系统暗示为“被浪费的时间”。《对马岛之魂》的风向引导系统,是对这个困境的一次正面回应。美术总监杰森·康奈尔在2020年的一次开发者访谈中,花了将近十分钟解释这个系统的设计逻辑。团队在每一个场景中手工放置风的方向和强度,使草叶、树叶、衣摆和粒子效果都朝向一个统一的视觉引导线,将玩家的视线自然地引向当前的目标点或兴趣点。他的原话是:“我们希望玩家不需要看小地图,不需要看HUD,只需要看着画面本身,就能知道该往哪里走。”

这个系统的工作量极其巨大:每一个任务场景都需要单独调整风向参数,确保引导线与地形、建筑、敌人位置和摄影机角度协调一致。测试阶段暴露出的问题包括:风太强导致草叶遮挡视线、风向与剧情对话的镜头语言冲突、某些室内场景缺乏植被导致风向引导失效。团队不得不为这些场景加入额外的粒子效果——灰尘、火星、纸片——让风“有东西可以吹”。结果是,这个系统确实有效。

一部分玩家遵循了风向引导,关掉了HUD,沉浸在画面中。但更多的玩家——根据游戏发售后一个月内的Twitch直播统计数据——仍然选择打开全部HUD元素。风向引导在那里,草在动,树在摇,衣摆在飘,但眼睛锁定的区域是屏幕左上角。

这不是美术的失败。这是认知经济学的必然结果。人类视觉系统的注意力分配是一个零和游戏。在任何给定的时刻,视网膜接收到的信息量远远超过大脑能够处理的上限,视觉皮层必须做出选择:哪些信息进入深度加工,哪些信息被过滤掉。这个选择机制在进化过程中被高度优化,优先处理的是与生存相关的信息——运动、威胁、食物来源——以及在社会化过程中习得的、与任务相关的信息。在电子游戏的环境中,HUD系统精确地定义了什么是“任务相关信息”:目标在哪里,敌人在哪里,危险区域在哪里,安全路径在哪里。

HUD是视觉认知的快捷键。当玩家需要快速完成一个任务——而大多数游戏的奖励结构都鼓励快速完成任务——大脑会自动将注意力从“画面”转移到“快捷键”上。

风向引导的困境在于,它试图用画面元素替代HUD元素,但画面元素的语义密度永远无法与HUD元素竞争。一束摇动的草叶可以暗示“这个方向有事发生”,但它的精确度不如一个箭头图标。一个箭头图标可以同时传递方向、距离、目标类型和优先级——草叶只能传递方向。在认知效率的竞争中,画面元素输了。不是因为画面不够美,而是因为美不是效率。

康奈尔知道这一点。《对马岛之魂》的风向引导最终被设计为一个可选项,而不是一个强制项。玩家可以在设置中随时开关。这个设计选择本身就承认了HUD的认知优势:它允许玩家在想要沉浸时关掉HUD,在需要效率时打开HUD。这是一个务实的妥协。

但它也揭示了一个更深层的问题:沉浸和效率在2020年代的3A游戏结构中,已经被置于对立的位置。Rockstar Games在《荒野大镖客:救赎2》中面对的是同样的问题,但他们的解决方案不依赖于画面元素,而是直接切断了控制需求。

游戏中的“电影模式”允许玩家在骑马长途旅行时切换到自动视角:镜头缓慢移动,选取风景最优美的构图,模拟观看西部片的体验。玩家不需要手动控制方向,马会自动沿着路径前进。手可以离开手柄,眼睛可以专注于画面。这是一个诚实的尝试——承认现代玩家在主动控制时没有多余的注意力分配给风景,因此创造一个不需要控制的时刻,让玩家纯粹地观看。

电影模式的使用率,根据游戏发售半年后的数据统计,在完成了主线剧情前十小时的玩家中不到百分之十五。在全部玩家中,这个数字更低。大多数玩家在进入电影模式后不到两分钟就切回了标准视角,或者直接跳过旅行——用快速传送功能到达目的地。

快速传送的存在本身,是对风景的一个判决。它承认风景是可跳过的,承认从A点到B点的路程不是体验的核心,承认效率优先于沉浸。

这个判决不是Rockstar做出的,而是整个行业在二十年间的渐进选择。快速传送在2000年代初期还是一种作弊码或隐藏功能,到了2010年代已经成为开放世界游戏的标准配置。

玩家预期它存在,评测会用“有没有快速传送”作为评分标准,论坛会为“快速传送破坏沉浸感还是提升体验”争论不休。争论的结果不重要——重要的是争论本身已经确认了快速传送的合法性。它不再是一个需要辩护的选项,而是一个默认的权利。电影模式的失败——如果“失败”是准确的词——指向了问题真正的症结。问题不在于玩家“没有时间”看风景。

问题在于,当玩家在游戏中,他们的认知模式已经被游戏本身训练成了一种任务导向的扫描状态。这种状态不是由画面质量决定的,而是由游戏的结构决定的。在扫描状态下,风景不是风景,而是“通过区域”——一个需要被穿过的空间,而不是一个需要被观看的场所。2021年,一位曾在多家3A工作室担任高级美术师的匿名人士在ArtStation上发表了一篇长文,标题是《我们造了大教堂,但人们在里面跑步》。

文章的核心论点是:3A游戏的美术团队正在建造视觉上的大教堂——每一个细节都经过精心设计和手工打磨,每一个角落都值得停下来凝视——但游戏的设计机制迫使玩家在这些大教堂里跑步,眼睛盯着地面上的导航标记,从入口跑到出口,不回头,不停留。文章写道:“我们花费六个月建模和贴图的一个室内场景,在玩家实际的游戏过程中,平均被注视的时间不到四秒。我们花费两年构建的一个开放世界,百分之九十的区域在百分之九十的玩家眼中,只是地图上的一片绿色。”

这篇文章在社交媒体上被转发了数万次。评论区出现了两种声音。一种来自美术从业者,表达的是共鸣和疲惫。另一种来自玩家,表达的是反驳:“如果游戏设计得让探索有意义,我当然会停下来看。大多数开放世界的美术只是重复的填充物,为什么要为填充物浪费我的时间?”

玩家的反驳触及了问题的另一个层面。美术团队造了大教堂,但大教堂的每一座礼拜堂都用同样的六层PBR材质建造,每一扇彩色玻璃窗都用同样的物理着色器渲染,每一根柱子都用同样的法线贴图增加细节。在物理渲染的技术框架下,所有的表面都“正确”了——但正确意味着同质化。一棵橡树的树干和一棵松树的树干,在PBR标准材质库中,底层的着色器逻辑是完全相同的,区别只在于参数值:粗糙度0.7还是0.6,法线强度1.2还是1.0,基础色偏向棕色还是灰色。这些参数差异在视觉上是可以区分的,但在认知上不足以产生“不同”的体验。

当玩家在《荒野大镖客:救赎2》的沼泽中看到一棵橡树,在《赛博朋克2077》的郊外荒地看到一棵橡树,在《刺客信条:英灵殿》的英格兰乡村看到一棵橡树,这三棵橡树在视觉上几乎可以互换。它们都是正确的,因此它们都是相同的。

视觉速记在这一刻彻底失效。不是因为信息不够,而是因为信息没有差异。

当所有游戏都使用相同的PBR材质库、相同的全局光照解决方案、相同的屏幕空间反射、相同的体积雾和粒子系统,视觉速记的压缩增益消失了。每一条信息都是高保真的,但每一条信息都没有携带任何关于“这个特定世界”的独特语义。玩家看到的不是“一片具体的沼泽”,而是“一片正确渲染的沼泽”。前者需要注意力,后者只需要识别。识别是瞬间完成的。大脑判定“这是沼泽地形”之后,就不再投入额外的认知资源。

识别触发的是自动导航模式:沿着小地图的路径走,避开水面——因为水面通常减慢移动速度——寻找可交互的物体或敌人。在识别模式下,视觉速记的原始功能——让玩家在毫秒级完成识别并从识别中推导出下一步行动——被完美地保留了。但它的代价是审美体验的消失。

审美体验需要的是“不识别”——不把一棵树归入“树”的类别,而是看到这一棵特定的树,在特定的光线下,在特定的时刻,呈现出的特定样貌。审美体验是反速记的。它需要时间,需要注意力,需要抵抗大脑的自动分类机制。

但游戏的结构不允许这种抵抗。或者说,3A游戏的结构不允许。《哈迪斯》在2020年做的事,从一个侧面说明了这个问题。Supergiant Games的美术团队用纯手工绘制的方式构建了游戏的每一个房间、每一个角色、每一帧动画。当玩家进入一个房间,画面中没有冗余信息:每一个视觉元素都携带功能语义——这个柱子可以破坏,这个岩浆池会造成伤害,这个敌人正在准备一个不可打断的攻击。

但这些元素的手绘质感本身携带了独特的审美信息:扎格柔斯的脚踝在落地时有一个微小的抖动,那是手绘动画的不完美被有意保留的结果;冥界的地板砖块的线条不是直线,而是带着轻微弯曲的、有触感的笔触。这些细节不会帮助玩家更快地识别敌人或躲避陷阱,但它们传递了一个信息:这个世界是手工制造的,不是算法生成的。玩家因为感受到这种手工制造的痕迹,而愿意停下来多看一会儿。

《哈迪斯》的成功证明了风格化反击的有效性。但它也证明了一个残酷的边界:这种成功无法被规模化。

Supergiant Games是一个约二十人的工作室,花了四年时间完成《哈迪斯》。每一个房间的手工布置、每一个角色动画的手绘抖动、每一个UI元素的装饰性边框——这些都需要时间,需要人力,需要一种不可复制的判断力。一个二十人的团队可以这样做。一个两百人的团队,一个两千人的团队,不可能这样做。

不是因为能力不够,而是因为当团队规模扩大到一定程度,标准化就成为必须。标准化的材质库,标准化的光照方案,标准化的资产生产流程。标准化的另一面,就是同质化。风格化反击开辟了一块飞地,一块由人的判断而非技术参数定义的视觉领地。

但飞地的边界是清晰的:它的大小,正好等于一个二十人的工作室四年时间所能手工绘制的全部画面的总和。这块飞地无法被规模化成为行业标准。它是一块飞地,因此它永远是一块飞地。

2022年,Epic Games发布了虚幻引擎5,其核心技术演示“Lumen in the Land of Nanite”展示了一个由数十亿多边形构成的古代遗迹场景。每一个石块都是完整的三维模型,不是法线贴图的假象;光线在石块之间弹跳,实时计算反射和折射;

相机的运动是自由的,可以在任何角度以任何距离观看任何物体,没有细节衰减,没有LOD切换。这段演示视频在发布后四十八小时内获得了超过一千万次观看。评论区充满了惊叹和赞美。但有一条评论被埋在大量赞美之下,只有几十个赞。它写道:“这个场景太美了。

但我在看演示的时候,脑子里一直在想:如果这是一个真正的游戏,我在这里会有什么任务?我会在三十秒内从这里跑过去,还是在十分钟内仔细搜索每一个角落?如果是前者,这些几十亿个多边形对我来说有什么意义?如果是后者,这些几十亿个多边形对我真的有意义吗?”

这条评论没有回答自己的问题。但它把问题提对了。2020年代初期,游戏美术面临的最大危机不是技术瓶颈。技术还在进步,而且进步得很快。光线追踪、全局光照、虚拟几何体、AI超采样——这些技术正在将画面质量推向一个前所未有的高度。但危机在于,画面质量越高,玩家真正看的时间越短。

这不是一个技术问题,因此不能通过更多的技术来解决。这是一个认知生态的问题:玩家与游戏画面之间的注意力契约,在经过四十年的技术加速后,正在失效。契约的条款很简单:美术团队付出努力,创造视觉奇观;玩家付出注意力,获得审美体验。这个契约在1980年代是成立的——不是因为玩家更有耐心,而是因为画面本身是稀缺的。

在2KB的显存限制下,每一个像素都经过反复权衡,每一个像素都携带极高的信息密度。玩家不得不看,因为不看就玩不下去。视觉速记的效率与注意力投入是成正比的。到了2020年代,契约破裂了。破裂的原因不是一方违约,而是货币贬值。

美术团队仍然在付出努力——实际上比以往任何时候都更多——但努力产出的视觉信息,在玩家眼中已经贬值到一个临界点以下。冗余信息淹没了功能信息,标准化材质淹没了独特风格,任务系统的压力淹没了停下来看的意愿。

玩家不再因为画面美丽而注视画面,因为美丽的画面已经太多了,多到变成了一种默认状态,一种不值得额外注意的常态。一个默认状态下的美丽画面,不再具有审美价值。它只具有识别价值:“这是游戏画面,画面质量不错,可以继续玩了。”识别在零点三秒内完成,然后眼睛移向小地图。

2023年,一位《赛博朋克2077》的高级环境美术师在波兰的一场行业会议上展示了一组幻灯片。第一张幻灯片是夜之城某个巷道的完整渲染画面:霓虹灯在湿漉漉的砖墙上的反射,雨水从遮阳篷边缘滴落时带起的微小水花,地面上一个被丢弃的塑料瓶在风中轻微滚动。

第二张幻灯片是同一场景的热力图,显示的是玩家在测试中的视线分布——超过百分之八十的注视集中在屏幕中央偏上的导航虚线上。巷道本身几乎没有被注视。第三张幻灯片是一句手写的注释:“我们花了三周时间做这个巷道。测试玩家花了三秒钟穿过它。”

会议结束后,有听众问这位美术师:这是否意味着应该减少对场景细节的投入?他沉默了几秒,然后回答:“这意味着我们不知道玩家为什么要看画面了。我们只知道他们不看。”

“我们不知道玩家为什么要看画面了”——这句话是2020年代初期游戏美术的精确诊断。四十年来,游戏美术的核心任务一直很明确:让玩家一眼看懂。这个任务建立在硬件约束之上,也建立在注意力契约之上。当硬件约束消失,当注意力契约破裂,任务本身变成了一个问题。让玩家看得懂,他们不看。让画面更美,他们不看。当他们不看时,美术还能做什么?这个问题没有现成的答案。它将在接下来的十年里,被反复提出、反复回避、反复碰壁。而每一次碰壁,都在提醒这个行业:四十年的语法,在通货膨胀面前,已经不再流通。