第 12 章

无处安放的HUD

一个人走出地堡,看见一座山。这是《见证者》在2016年1月26日交给玩家的第一个画面。没有血条,没有地图,没有任务标记,没有漂浮在空中的箭头。玩家站在一座小岛上,面前是一片精心布置的风景,远处立着一座山。他不知道自己该去哪里,但山就在那里。

这个画面本身就是一份界面设计声明:目标不再贴在屏幕上,它被放进了空间里。

一个月后,另一群人开始谈论另一个世界。同年二月,马库斯·佩尔松透露了《我的世界》电影的计划,预计于2025年4月在美国上映。一个世界被压缩成方块,再被拉伸成银幕上的故事。另一个世界被压缩成谜题面板,再被铺展成一座可以步行的岛屿。

这两个事件之间隔着的是同一个症结:当虚拟世界变得比物理世界更令人信服,原来贴在屏幕上的那些信息去了哪里?

这个问题在2016年听起来还像是一个美学偏好。到了2016年之后的那几年,它变成了一场危机。要理解这场危机,得先从人类眼睛的一个基本动作说起。

人在看近处的东西时,两只眼睛会向内转,视线交叉在物体上。看远处的东西时,两只眼睛几乎平行。这个动作叫辐辏。它和另一个动作——晶状体调节焦距——是绑在一起的。看近物,眼睛向内转,同时晶状体变厚。看远物,眼睛向外转,同时晶状体变薄。这两个动作从婴儿时期就一起工作,大脑把它们当成同一条指令的两个部分。

现在设想一下:你戴上虚拟现实头显,眼前是一块离眼球只有几厘米的显示屏。显示屏上有一个数字——比如弹药数——被渲染在距离你两米远的位置。你的晶状体必须对焦在显示屏上,因为那才是真实的光源。但你的眼睛却要向内转,因为大脑收到的信号是那个数字位于远处。辐辏和调节第一次在人的一生中分了家。

结果就是晕。视觉辐辏冲突,这是虚拟现实领域最让人头疼的名词之一。它不是一个可以被显卡性能解决的延迟问题,也不是一个可以用更高刷新率安抚的眩晕问题。它是眼睛的两套自动系统互相打架。

想象一下,你正盯着眼前几厘米处的一只苍蝇,同时又要看清两米外墙上的钟表数字——你的眼睛会立刻感到酸胀和混乱,这就是辐辏冲突在日常生活中的简化版。玩家可能说不清为什么难受,但身体知道。身体在抗议一个它从未遇到过的矛盾。

传统平视显示器——也就是日后被简称为HUD的那层透明信息膜——在平坦的显示器上工作了三十年。它是一层透明的信息膜,贴在游戏世界的前面。玩家看着屏幕,HUD和世界共享同一个焦平面,眼睛不会打架。

但在虚拟现实中,这层膜该贴在哪里?贴在眼球前方,就会触发辐辏冲突。贴在世界的某个表面上,它就不再是HUD了。这就是虚拟现实扔给界面设计师的问题:现在,你把菜单放在哪儿?

这个问题之所以让设计师后背发凉,是因为它触及了界面存在的前提。整个平视显示器的历史都在默认一件事:信息可以悬浮在世界的上方,因为世界本来就被压扁在一块屏幕上。一旦玩家被连头带脚扔进三维空间,那个“上方”就不存在了。平面界面失去了物理依附。

《见证者》恰好在这条裂缝上提供了一个参照。它没有虚拟现实版本。它是平面屏幕上的游戏。但它做了一件激进的事:它把界面融进了世界本身。游戏中约一万个实体对象被转化为独立文件进行管理。

设计师布洛与团队开创性地把游戏世界序列化为文本文件,既便于版本控制又能快速定位编辑冲突。这个技术决策听起来像是一个软件工程问题,和界面设计无关。但它暗含了一个世界观:世界不是一张需要贴上信息的背景布,世界本身就是信息。

布洛选择自研引擎,而不是使用现成的工具。原因很简单:他要完全控制。作为一个紧凑的游戏世界,岛屿被视为一个区域,这简化了游戏性和引擎开发。但此举也为团队带来了衍生挑战:为支持多人并行开发,他们需要找到一种方法,在无需依赖版本控制系统文件锁定的前提下,让多名开发者能同时编辑不同区域,并确保离线状态仍可正常工作。

把世界序列化为文本文件,本质上是在说:世界是一份可编辑的文档。山的位置、谜题的逻辑、路径的走向,都是文字。这种思路在UI设计上产生的后果是深远的——界面元素不再需要单独的一层,它们可以被写进世界的同一份文档里。

玩家在《见证者》中遇到的谜题面板就是这样一种对象。它们散布在岛屿各处,是一种呈现在面板上的交互式迷宫。

一块面板立在地上、挂在墙上、靠在山崖边。玩家走向它,看到上面刻着一条线,一个起点,一个终点。规则是什么?没有说明。玩家必须从散布在小岛上的视觉提示和录音中确定每个谜题的规则。

面板不解释自己。它只是世界的一部分。玩家和面板的关系,就像一个人和一块标牌的关系:你知道它想告诉你什么,但它不会用浮动文字打扰你。

这种设计带来的结果是:玩家开始用身体丈量空间。他们记得某块面板在哪里,因为那块面板长得和周围的环境一样。他们不是打开地图找到“谜题三号”的位置,而是走回那个他们曾经经过的岔路口,拐进去,看见那块面板还在那里。信息获取变成了一种空间导航。

这听起来很优雅。但优雅是有代价的。先来看这个代价的另一个侧面。布洛对游戏开篇区域的修改记录了一件事:团队最初把玩家放置在一个废弃的地堡内,但玩家在离开地堡时并未面对着山。

虽然团队试图移动并旋转地堡空间,但为配合游戏的其它部分,这一设计最终被废弃,取而代之的是一个简洁的带有少量内饰元素的空间,玩家来到外部环境时高山也会一览无遗。这一开篇区域也算是游戏的教程,帮助玩家了解游戏的基本机制,那就是他们必须在解谜和探索之间做出自己的选择。

这段话透露了一个关键的界面逻辑:山是目标,玩家必须第一眼看到它。如果玩家走出地堡时没有面对山,他和目标之间就多了一层“找路”的问题。这个问题本身没有错,但对于一个没有文字的教程来说,它会变成噪音。所以地堡被废弃了。一个更简洁的空间取而代之,让山直接进入视野。目标和世界的关系被调整到不需要任何解释的程度:看见山,知道要去那里。

布洛想让玩家第一眼就能看到山。这个“想”不是界面设计之外的偏好。它本身就是界面设计。让山出现在第一眼,就是让目标成为世界的一部分,而不是屏幕上的一个标记。

但这里有一个微妙的地方。《见证者》仍然是一个平面屏幕游戏。玩家是在用鼠标和键盘操作。

屏幕依然是那个屏幕。玩家依然坐在屏幕前面,眼睛看着一个二维平面。布洛做的不是取消媒介,而是让媒介变得透明。世界和界面的融合发生在屏幕的内部,而不是发生在玩家的身体和世界之间。

虚拟现实要做的事情比这更彻底。它要取消的,恰好是屏幕本身。2016年之后,消费级虚拟现实头显开始进入市场。头显一戴,屏幕不见了。玩家第一次真正地“进入”了世界。

但随之而来的是一连串的问题。最先爆发的是运动眩晕:当玩家的眼睛告诉自己“我在移动”,而内耳的前庭系统却告诉身体,人仍然坐在椅子上没有移动,大脑就会陷入错乱。这个问题的解决方案——瞬间移动、固定参照物、减少加速度——已经足够让开发者头疼。但界面问题藏得更深,因为它不像眩晕那样会立刻被人察觉。

传统HUD的问题在于它是一层附着在眼球上的膜。在虚拟现实中,这层膜会引发辐辏冲突。设计师们很快发现,把弹药数贴在眼前的做法行不通。眼睛会累,大脑会晕,玩家的体验会迅速恶化。

哪怕玩家说不清原因,他们也会摘下头显,说一句“不舒服”。于是发生了一场集体迁徙。这场迁徙没有一个统一的指挥。它是在不同工作室、不同引擎、不同项目的试错中缓慢成形的。

弹药数被刻在枪身上。这个方案看起来简单,但它意味着一个根本性的转变:信息不再位于观察者和世界之间的某个抽象层,它变成了世界中的一个物件。玩家低头看自己的枪,弹药数就在那里,和枪身的纹路、划痕、反光共享同一个三维空间。看见弹药数的方式,和看见枪的方式完全一样。

生命值被融入手腕上的全息手环。这比刻在枪身上更私人。枪是武器,手腕是身体。当玩家抬起手腕查看生命值,他做的动作和现实中查看手表的动作几乎相同。这个动作不需要学习,或者说,他早就学会了。人类用眼睛看手腕的动作,在虚拟现实出现之前已经练习了几千年。

背包变成了从肩后抓出的实体空间。这个设计尤其值得注意,因为它调用的是人对于“背着的东西”的身体记忆。在一个平面屏幕上,打开背包是一个抽象操作:按一个键,弹出一个窗口。

在虚拟现实中,设计师把背包放回它原本在的地方——肩上。玩家伸手到肩后,做出抓取动作,背包就出现在视野里。这个动作是不是和现实完全匹配,并不重要。重要的是它给了玩家一个身体上的位置感:我的东西在我的肩膀上。这在认知上比任何图标都更直接。

菜单被做成需要伸手触碰的立体面板。这个方案的逻辑是:如果世界是三维的,那么菜单也应该是三维的。菜单不再是一块悬浮在视野角落的玻璃片,而是世界里的一件物体。它可能是一块悬浮的透明屏幕,可能是一本可以翻页的书,可能是一个从手表投射出的全息界面。无论形式如何,它的共同点是:它需要被操作,而操作的方式是身体在空间中的动作。

这些方案听起来五花八门,但它们共享一个核心直觉:当玩家被扔进三维空间,他们的身体也一起进去了。

在平面屏幕时代,玩家的身体一直在游戏之外。手在键盘上,手指在鼠标上,身体坐在椅子上。界面设计不需要考虑身体,因为身体根本不参与。虚拟现实把身体拉了进来。

手的动作、头部的转动、眼睛的注视方向,都变成了输入。设计师们突然发现,他们面对的不再是一个看着屏幕的用户,而是一个站在世界里的身体。

这不是一个小变化。它从根上改变了界面的契约。在平面屏幕时代,界面的隐性契约大致是这样的:设计师允许玩家看见世界的某个版本,并提供必要的操作工具;玩家允许自己的视野被图标和数字部分遮挡,并按照这些符号的指引行动。双方都承认一个前提:世界在屏幕里面,界面在屏幕上面。这个契约运行了三十年,因为它刚好能让双方都满意。玩家需要信息,设计师需要传达信息,屏幕提供了这个中间层。

虚拟现实撕掉的正是在这个中间层。世界不再是屏幕里面的东西,而是包围玩家的东西。当世界包围了玩家,界面的老位置就消失了。那些曾经贴在屏幕边缘的血条、地图、任务栏,它们现在无处安放。

这场契约破裂的过程,在《半衰期:爱莉克斯》中达到了一个阶段性高峰。这款游戏于2020年发布,被许多人称为第一款真正完整的虚拟现实大作。

但它的意义不在“大作”这个标签上。它的意义在于,它用一种彻底的方式重写了界面契约。

游戏里有一个重力手套的设定。玩家通过手腕的动作把远处的物品吸过来,然后用手接住。这个动作本身是一个输入方式,但更重要的它是——它也是一种信息获取方式。当玩家看到一个物品,比如一个弹匣或者一瓶树脂,他伸手,手套把物品拉过来,他的眼睛看到物品的细节,他的手感到物品的重量。这一切都发生在世界的空间里,没有中间层。信息就是物品本身,获取信息的方式就是操作物品的方式。

腕袋的设计则更进一步。玩家的手腕上有一个容器,里面放着弹药、树脂和其他小物件。需要时,玩家抬起手腕,手伸进腕袋,从中取出东西。整个过程没有任何菜单弹出来。玩家的眼睛看着手腕,手做出抓取动作,物品就出现了。这个过程和现实中的口袋惊人地相似。设计师们没有发明这个方案,他们只是让手腕和口袋的身体记忆在虚拟世界中重现。

重力手套和腕袋的组合揭示了新契约的一个核心原则:信息节点是世界中可触的物体。

在旧契约中,生命值是图标,弹药数是数字,地图是缩略图。新契约把它们全部替换成了物件。这些物件有形状、有位置、有物理属性。玩家不能用眼睛“扫一眼”获得信息,他必须用身体去接触信息。

在这里,一个古老的东西被重新激活了。人在进入电子游戏之前,已经和物打了几万年的交道。用双手摆弄物件、用身体丈量空间、通过物体的位置和状态来判断局势——这些能力不需要学习,它们写在我们的祖先留在洞穴里的壁画、工具和骨骼里。平面屏幕界面绕过了这些能力,用一个抽象符号系统取而代之。虚拟现实把它们请了回来。

但这正是转折开始的地方。当一个玩家在平面屏幕上查看生命值时,他只需要把视线移向屏幕的一个角落。这个动作耗时不到半秒,不干扰他正在进行的操作。

但当一个虚拟现实玩家需要查看生命值时,他必须低头看自己的手腕。这意味着他的视线离开战场,焦点从整个空间收缩到手腕上的一小块区域。如果敌人正在逼近,这半秒可能致命。弹药数刻在枪身上也有同样的问题。换弹时看枪身是自然的。

但在交火中,玩家需要知道剩余弹药,又不想把枪从射击位置移开。刻在枪身上的数字变得难以看清。旧HUD的优势暴露出来:它悬浮在视野上方,永远在同一个位置,玩家可以一边射击一边用眼角余光获取信息。

三维实体的信息节点在沉浸感上赢了,却在效率上输了。这构成了新契约的第一个内部矛盾。

还有更深的问题。在平面屏幕上,寻找一个按钮是一个不费力的过程。按钮的位置是固定的,玩家的手和眼睛都记得。但在虚拟现实中,如果按钮是一个立体的存在,它就必须在某一个地方。玩家要找到它,就必须先弄清楚方向和距离。如果背包从肩后抓出,玩家要记住背包在哪个肩上。如果菜单在手腕上,玩家要记住抬哪只手。

这些动作消耗了注意力,而注意力在任何需要快速反应的游戏中都是稀缺资源。

用三维实体替代二维图标,意味着玩家要处理的是一种全新的认知负担:环境导航。

在现实世界中,我们也面临这种负担。找钥匙、找手机、找门把手——这些都需要时间和注意力。

到这里,界面演进史走完了一个意味深长的循环。最早的街机游戏没有界面,玩家通过控制台上的旋钮和按钮直接操作机器。后来屏幕出现了,信息被提升到屏幕的平面上,玩家通过眼睛接收。这个变化让操作变得抽象了,但也让效率大大提升。

现在虚拟现实再次引入身体参与,信息重新回到三维空间,融入物件和身体。界面又变回了和世界一样的东西。

但它面临的问题也变了。旧问题是如何在平面上高效地呈现信息。答案是HUD。

新问题是如何在空间中高效地呈现信息。答案还没有定型。有一种看法认为,游戏界面的演进主要由技术驱动,设计师只是被动响应硬件与图形能力的提升,玩家体验的改善是技术进步的副产品。

这个说法在虚拟现实这里遇到了一点麻烦。因为同样的头显、同样的图形管线、同样的追踪精度,不同的设计团队给出了截然不同的答案:有的把弹药数刻在枪身上,有的把它留在视野边缘,有的干脆让玩家自己去数。技术没有替他们做出这些选择。

选择来自另一种博弈——设计师对沉浸感的执念、对效率的估算,以及玩家身体本能的配合与抵抗之间的拉锯。技术提供了新的条件,但条件并不自动生成契约。

这个反例也说明,界面契约的修订从来不是单方面宣布的。设计师可以提出枪身数字、腕袋、立体菜单,但玩家是否接受、是否学会、是否在关键时刻因此送命,才是新契约能否成立的关键。

2016到2020年间,很多方案停留在实验阶段,恰恰是因为玩家还没有准备好,或者设计师还没有找到让玩家准备得足够快的办法。旧契约的另一个关键遗产——身体默认值——在这里发生了断裂。

一个在平面屏幕上玩了十年射击游戏的玩家,左手会自动去寻找前进、后退和左右平移的那几个键位,右手会自然搭在鼠标上,眼睛会不自觉地扫向屏幕的左上角。这套身体反应模式是经过几百小时的重复训练后在神经系统中沉淀下来的。它让玩家的意识可以从操作中解放出来,专注于更高层的策略和判断。

虚拟现实让这整套默认值变得无用。没有了键盘上的移动键位,玩家必须学习用摇杆或身体移动来导航。没有了固定的屏幕角落,玩家必须学习用身体动作获取信息。旧的身体默认值成了负担。玩家的手指还会去找键盘,但键盘已经没有了。眼睛还会扫向屏幕的边缘,但那里只有头显的镜框。

这种身体默认值的混乱是暂时的吗?可能是。人类的身体有很强的适应能力,新的重复会形成新的默认值。反复低头看手腕,最终会变成自动动作。反复伸手到肩后抓背包,也会写入身体记忆。

但这个过程需要时间。在2016到2020年间,时间还不够长。玩家还处在旧默认值失效、新默认值尚未成形的过渡期。

当玩家伸手到肩后抓取背包时,手柄会震动。这个震动不是随便设计的。2017年,Oculus发布了一份触觉反馈设计指南,其中提到一个细节:抓取虚拟物体的震动反馈应该分为三个阶段——接触、抓握、释放。接触阶段的震动很轻,像手指碰到布料的触感。抓握阶段的震动稍强,像手掌合拢时的压力感。释放阶段的震动最短,像东西从指尖滑落。三个阶段加起来不到半秒,但它们在玩家的手掌上构建了一个完整的物理事件:我碰到了,我抓住了,我放开了。

Valve在开发《半衰期:爱莉克斯》时把这个逻辑推得更远。根据一项2019年提交的触觉反馈专利,Valve的工程师们设计了一种“基于物体物理属性的动态触觉响应”系统。简单说,手柄会根据被抓物体的重量、材质和形状,生成不同的震动模式。抓起一个弹匣,震动短促而清脆,模拟金属的硬度和重量。抓起一瓶树脂,震动柔和而持续,模拟液体的晃动感。

抓起一颗手雷,震动在最后阶段会突然加强,提醒玩家这东西需要赶紧扔出去。

这些震动模式不是对现实触感的精确复制——手柄的线性马达做不到那个程度——但它们提供了一种“足够好的”身体线索。大脑接收到这些线索后,会自动补全剩余的感觉。这就像看到枪身上的划痕会让玩家觉得枪更真实,手柄的震动让虚拟物体的重量变得可信。

这个设计的意义不在技术本身,而在于它暴露了新契约的一个深层逻辑:在虚拟现实中,信息不仅需要位置,还需要质地。平面屏幕上的图标没有重量。玩家点击背包图标,弹出一个窗口,这个过程没有任何触觉反馈。图标只是一个视觉符号,它的存在不需要被身体确认。

但在虚拟现实中,背包从肩后抓出的那一刻,玩家需要感到“抓”这个动作的后果。如果手柄不震动,背包就只是一个视觉幻象,和平面屏幕上的图标没有本质区别。震动把背包从幻象变成了物体。

换句话说,触觉反馈是新契约的签字笔。没有它,契约就只是一份草稿。玩家伸手到肩后,手柄震动,背包出现——这个序列完成了一次完整的身体确认:我的肩膀上有东西,我抓住了它,它现在在我手里。这个过程调用的不是抽象符号的识别能力,而是人类几万年来抓取物体的身体本能。

婴儿在学会说话之前就会抓东西。触觉是比视觉更古老的确认方式。虚拟现实的设计师们重新发现了这一点。

但这也带来了新的问题。触觉反馈的设计需要消耗计算资源和开发时间。每一个可抓取的物体都需要配置对应的震动模式。如果震动模式配置不当,玩家会感到违和——太强的震动让人觉得虚假,太弱的震动让人觉得物体不存在。更麻烦的是,触觉反馈的标准因人而异。一个人的手掌灵敏度、对震动的偏好、对“真实感”的阈值,都和另一个人不同。平面屏幕上的图标对所有人都一样:红色是血,蓝色是魔法,弹药数字永远在右下角。

这段时间里的每一次眩晕、每一次找按钮的迟滞、每一次低头翻腕袋时被击倒,都在提醒人们:界面的契约已经很深了。它能被撕毁,但撕毁之后必须重建,而重建的代价会先落在玩家身上。

有些问题是我们也不知道的。比如,新的身体默认值到底需要多久才能稳定下来?一个从没玩过平面屏幕射击游戏的人,直接开始玩虚拟现实射击游戏,他会不会比老玩家更快地适应三维信息?如果会,这意味着旧默认值不仅仅是无用,它还是一个需要被压制的干扰源。那么,虚拟现实会不会培养出一种全新的身体默认值,和平面屏幕时代完全不同?这些问题在材料中还没有答案。

回到《见证者》。那座山曾经给过玩家一个不需要文字的目标。布洛的选择是让世界自己说话。虚拟现实的设计师们面对的是一个同样的冲动:让世界自己说话。

弹药在枪里,生命在手腕上,背包在肩上。世界不再需要一层贴膜来解释自己。这个冲动是真诚的,也取得了一定的成功。

但布洛的岛屿是一个静态的、可控的世界。山在那里,谜题在那里,玩家按自己的步调探索。

虚拟现实中的战斗场景和多人竞技不是这样的世界。它们是高速的、动态的、时间紧迫的。在世界自己说话的那一刻,玩家可能没有时间听完。

这就是新契约最脆弱的地方。2016年1月的那座山和2016年2月的那部电影,它们指向了同一个未来:虚拟世界正在变得越来越有说服力,越来越值得进入。但它们也分别指向了两种不同的界面态度。

布洛的态度是:把界面融入世界,让信息成为风景的一部分。电影工业的态度是:把世界抽出来,让信息和情感在一个更可控的平面上被编辑和呈现。

虚拟现实站在两者之间,它想给玩家风景,但玩家还需要信息。如何让信息在风景中不失去效率,如何让风景在信息中不失去自己,这是2016到2020年间没有人能完全回答的问题。

问题的分量在加重。因为虚拟现实只是开始。当信息不再依附于屏幕,它就不得不融入空间。而空间,无论是虚拟的还是物理的,都比屏幕要大得多。菜单无处安放,只是这条路上的第一个路标。

接下来会发生什么,已经不取决于游戏设计师怎么想。界面已经松开了一根手指,它准备从屏幕上滑下来。当它完全落下时,它碰到的将是屏幕之外的世界。那个世界里没有暂停键。