跳转到内容
← 返回核心概念
计算机科学应用计算机科学 · 人机交互16 分钟阅读

人机交互

Human-Computer Interaction

1968年12月9日,在旧金山一间礼堂里,一位名叫道格拉斯·恩格尔巴特(Douglas Engelbart)的工程师坐在屏幕前,用一只木壳的小盒子在桌面上滑动,屏幕上的光标随之移动。他点击、拖拽、跳转链接、与远在数十公里外的同事实时共同编辑同一份文档。 台下的观众看到的,是鼠标、超文本链接、视频会议、屏幕窗口、协作编辑…

人机交互HCI图形界面可用性交互设计Fitts定律

1968年12月9日,在旧金山一间礼堂里,一位名叫道格拉斯·恩格尔巴特(Douglas Engelbart)的工程师坐在屏幕前,用一只木壳的小盒子在桌面上滑动,屏幕上的光标随之移动。他点击、拖拽、跳转链接、与远在数十公里外的同事实时共同编辑同一份文档。

台下的观众看到的,是鼠标、超文本链接、视频会议、屏幕窗口、协作编辑、剪切复制粘贴——几乎是今天个人计算的全部基本动作。而这一切发生在个人电脑诞生之前。这场90分钟的演示,后来被称为"演示之母"(The Mother of All Demos)。

它回答的,是一个常被忽略的根本问题:计算机的算力再强,如果人无法有效地驾驭它,又有什么用?这正是人机交互(Human-Computer Interaction,HCI)这门学科的核心关切。

破除误解:HCI 不是"把界面做好看"

人机交互常被误解为"美工"或"画界面"——把按钮画漂亮、配好颜色。这是把它和视觉设计混为一谈。

HCI 真正研究的是:人与计算系统之间信息如何流动,以及如何让这种流动更准确、更省力、更不易出错。它横跨计算机科学、认知心理学、设计学与人因工程,关心的问题是:

  • 人在使用系统时,脑子里在想什么?(心智模型)
  • 一个操作要花多少时间、出多少错?(可以被量化、预测)
  • 当用户犯错时,该怪用户,还是怪设计

恩格尔巴特给这门学科定的基调不是"让计算机替人做事",而是"增强人的智能(augmenting human intellect)"——人与机器协作,放大人的能力。这个立场至今仍是 HCI 的精神底色。

机制:交互如何被量化与设计

Fitts 定律:交互可以被预测

很多人以为界面好坏全凭主观感觉。但早在计算机普及之前,心理学家保罗·费茨(Paul Fitts)在 1954 年就发现:人把手(或光标)移动到一个目标上所需的时间,是可以用公式预测的

费茨定律说:移动时间随目标距离增大而变长,随目标尺寸增大而变短,二者以对数关系结合成"难度指数"(index of difficulty)。费茨当年甚至借用了刚兴起的信息论,把这个过程类比为"人体运动系统的信息传输速率"。

这条 70 多年前的定律,直接解释了今天许多设计直觉:

  • 屏幕四个角边缘是"无限大"的目标(光标会被边界挡住,不会滑过),所以操作系统把"开始菜单""关闭按钮"放在角上。
  • 重要、常用的按钮要做得,并尽量离手近
  • 右键菜单在鼠标当前位置弹出,因为那里距离为零、最快。

HCI 由此区别于纯艺术:它的许多结论是可测量、可预测的。

不止费茨:希克定律与击键层模型

费茨定律不是孤例。1952 年,英国心理学家威廉·希克(William Hick)发表《论信息获取速率》,发现人从 N 个等概率选项中做出选择的反应时间,随选项数量按对数增长(反应时间 ≈ a + b·log₂N)。次年雷·海曼(Ray Hyman)用更系统的实验加以验证,二者合称希克-海曼定律(Hick–Hyman law)

和费茨一样,希克直接借用了香农(Claude Shannon)刚提出的信息论:log₂N 正是 N 个等概率选项所含的"比特"数,大脑像一条带宽有限的信道,传更多比特就得花更多时间。

但希克定律常被误读成"选项越少越好"。这是过度简化。

由于是对数关系,选项翻倍并不会让决策时间翻倍;真正拖慢用户的,往往不是选项数量,而是杂乱无章的排列和难以预判的后果。当选项被分好组、且用户熟悉它们时,这条定律的效应会明显减弱。

第三个例子是 1980 年卡德、莫兰与纽厄尔(Card、Moran & Newell)提出的击键层模型(Keystroke-Level Model)。它把一次操作拆成可计时的基本动作再相加,从而在产品做出来之前就预测专家用户要花多少秒:按一次键约 0.2 秒,用鼠标指向目标约 1.1 秒,一次"心理准备"约 1.35 秒。

把界面操作拆成这些"原子动作"求和,设计者就能在两套方案动手实现之前算出哪套更快——这正是 HCI 把"好不好用"变成工程计算的早期范例。

诺曼与《设计心理学》:错误往往是设计的错

1988 年,认知科学家唐·诺曼(Don Norman)出版《设计心理学》(The Design of Everyday Things)。他的核心论点是:当人用不好一扇门、一个炉灶或一个软件时,多半不是人笨,而是设计没有把"可以怎么用"表达清楚

诺曼引入了两个被 HCI 广泛使用的概念:

  • 可供性(affordance):物体本身暗示了可以对它做什么。一个平板会"邀请"你去推,一个把手会"邀请"你去拉。诺曼借自生态心理学家吉布森(J. J. Gibson)。
  • 指意(signifier):感知得到的线索,告诉人"该在哪、该怎么操作"。一个写着"推"的标牌、一个看起来可点的按钮,都是指意。

他还提出了"执行—评估鸿沟":用户先要把意图翻译成操作(执行),再要看懂系统的反馈、判断是否达成目标(评估)。好的设计,就是缩小这两道鸿沟。

值得一提的是,"可供性"这个词后来在设计圈被用滥了。

很多设计师把"在屏幕上加一个图标、一个光标"也叫"加了一个可供性"。诺曼认为这是误用:可供性是物体本来就具备的可能动作,屏幕上那个图标只是把它广而告之的视觉线索而已。为厘清这层区别,他在 1999 年的文章《可供性、约定与设计》中正式引入"指意(signifier)"一词;在 2013 年修订版里他甚至坦言,若重写此书,许多地方他会直接用"指意"而非"可供性"。这场术语之争看似咬文嚼字,实则关乎一个实际问题:界面要传达的,究竟是"能做什么",还是"看起来能做什么"。

可用性:让"好用"变成可检验的标准

HCI 把"好不好用"拆成可评估的维度,常被概括为可用性(usability)的几个方面:易学性、效率、可记忆性、出错率、满意度。配套的方法包括可用性测试(看真实用户怎么卡住)、启发式评估、A/B 测试等。"好用"由此从感觉变成了可以测量、可以迭代改进的工程目标。

其中"启发式评估"有明确出处。1990 年,雅各布·尼尔森(Jakob Nielsen)与罗尔夫·莫利赫(Rolf Molich)在 CHI 会议上提出:用一小组通用原则就能快速排查界面的大部分问题,最初是 9 条;尼尔森后来对 249 个真实可用性问题做因子分析,于 1994 年提炼成沿用至今的十条可用性启发式,例如"让系统状态始终可见""贴合真实世界""出错时给出可恢复的提示"。

可用性还能落到具体的时间数字上。综合 1968 年米勒(Robert Miller)对人机对话的实验,尼尔森总结出三条响应时间界限:0.1 秒内系统作出反应,人会觉得"即时";1 秒是思路不被打断的上限;超过 10 秒,用户的注意力就基本守不住、容易放弃。这套数字至今仍是衡量加载与反馈速度的参照。

里程碑:从增强智能到图形界面

  • 1945:万尼瓦尔·布什(Vannevar Bush)在《诚如所思》(As We May Think)中设想了可关联检索信息的"Memex",预示了超文本。
  • 1954:费茨发表运动时间定律,为交互量化奠基。
  • 1968:"演示之母"——恩格尔巴特团队展示鼠标、超文本、协作编辑等。
  • 1973:恩格尔巴特团队的多名成员转入施乐帕克研究中心(Xerox PARC),造出带位图屏幕、鼠标和可叠放窗口的 Alto——最早演示图形界面的个人计算机之一。
  • 1981:施乐 Star 工作站把窗口(Windows)、图标(Icons)、菜单(Menus)、指针(Pointer)整合成完整的 WIMP 范式与"桌面隐喻",用图标代表文件与工具,是第一台商用 WIMP 系统(早期 Alto 上的图形界面尚未完整成形)。
  • 1983:本·施奈德曼(Ben Shneiderman)提出"直接操作(direct manipulation)"——让用户直接拖拽、点击屏幕上代表对象的图形,而非记忆命令,这成为 GUI 之所以好用的理论基石。
  • 1984:苹果 Macintosh 把图形界面带给大众市场,GUI 从此成为主流。
  • 1988:诺曼《设计心理学》出版,把以人为本的设计思想系统化。
  • 2007年起:iPhone 把多点触控带向大众,界面从"指针操作"转向"直接用手触碰"。但多点触控并非 iPhone 发明——贝尔实验室 1984 年就做出过多点触摸屏,比尔·巴克斯顿(Bill Buxton)等人的相关研究更早;iPhone 的贡献是把它打磨成人人可用的产品。

争议与代价:好用,为谁服务?

HCI 内部并非只有共识。

最有名的设计之争是拟物 vs 扁平。早期图形界面刻意模仿现实:备忘录像便签、垃圾桶像垃圾桶、按钮带立体高光——这种"拟物设计(skeuomorphism)"用真实世界的隐喻降低学习成本,本质是给新用户提供强烈的"指意"。2013 年,苹果在乔纳森·伊夫(Jony Ive)主导下推出 iOS 7,几乎抹去所有拟物纹理,转向扁平设计,理由是用户早已习惯触摸屏、不再需要现实比喻,过度装饰反而碍事。

这场转向引发激烈争论:扁平更干净、也更"忠于媒介",但去掉阴影与边框后,"什么能点、什么不能点"有时变得模糊——可点的元素失去了指意,可用性反受其害。此后业界又出现"新拟物(neumorphism)"等回潮,说明这并非谁对谁错,而是学习成本与视觉清晰之间的永恒权衡

更尖锐的争议关乎伦理。HCI 既能帮用户更省力,也能反过来操纵用户。2010 年,设计师哈里·布里格努尔(Harry Brignull)提出"暗黑模式(dark patterns,又译欺骗性设计)"一词,专指那些利用人的认知习惯、诱导人做出本不愿做之事的界面:藏得极深的退订按钮、用羞辱性文案让你不敢点"不要"(confirmshaming)、悄悄把商品塞进购物车。这些手法恰恰是把可用性原理反向使用。如今欧盟《数字服务法》与美国 FTC 已着手把部分暗黑模式列为违规——可用性研究因此不再只问"怎样更好用",也要问"好用的力量该如何被约束"。

跨域连接

  • 香农:费茨定律与希克—海曼定律都把人当作带宽有限的信道:动作难度取距离与目标宽度之比的对数,选择时间取选项数的对数,两者量的都是「要传多少比特」。这给出可检验的推论——把目标宽度加倍与把距离减半应带来相同的时间节省;选项翻倍只多花固定的一小段时间,而不是让决策时间翻倍。
  • 记忆系统:工作记忆容量很小,界面把状态画在屏幕上,等于把本该由人保持的信息外置,于是识别取代了回忆。推论是效应量因人而异:新手缺少长期记忆中的图式,受益最大;专家已把命令编码成可直接提取的组块,反而更快。同一套界面对两类用户的评价常常相反,根源就在这里。
  • 助推与选择架构:不存在中立的默认值。默认项、步骤数与措辞都在改变各个选择的相对成本,因此可用性原理天然可以反向使用:把退订路径拉长、把拒绝选项写得羞辱人,都是在给某个选择加价。好处是这让暗黑模式变得可测量——点击步数与文案框架是能被审计的量,而非主观感受。
  • 戈夫曼:界面同时是一个前台,规定了人在他人面前能呈现什么。正在输入、已读、上次在线这类提示把原本私人的节奏变成公共信号,于是不回复从一种沉默变成一次可见的选择。机制在于系统单方面决定哪些线索被披露,用户只能在给定舞台上调整表演——这也是这类提示一旦上线极难撤除的原因。
  • 计算机图形学:直接操作范式要求对象随手连续移动,这把心理阈值直接翻译成图形管线的工程指标:约零点一秒内响应才被感知为即时,一秒是思路不被打断的上限。推论是渲染预算不只是画质问题而是可用性问题——帧率与输入延迟一旦越过阈值,用户对「是不是我操作错了」的判断就会出错。

参考文献

  • Donald A. Norman, The Design of Everyday Things, Revised and Expanded Edition (Basic Books, 2013)
  • Paul M. Fitts, "The information capacity of the human motor system in controlling the amplitude of movement," Journal of Experimental Psychology 47(6), 1954, pp. 381–391
  • Stuart K. Card, Thomas P. Moran & Allen Newell, The Psychology of Human-Computer Interaction (Lawrence Erlbaum, 1983)
  • Vannevar Bush, "As We May Think," The Atlantic Monthly, July 1945
  • Stuart K. Card, Thomas P. Moran & Allen Newell, "The Keystroke-Level Model for User Performance Time with Interactive Systems," Communications of the ACM 23(7), 1980, pp. 396–410
  • Ben Shneiderman, "Direct Manipulation: A Step Beyond Programming Languages," Computer 16(8), 1983, pp. 57–69
  • Jakob Nielsen & Rolf Molich, "Heuristic Evaluation of User Interfaces," Proceedings of ACM CHI'90, 1990, pp. 249–256
  • Donald A. Norman, "Affordance, Conventions, and Design," Interactions 6(3), 1999, pp. 38–43
  • W. E. Hick, "On the Rate of Gain of Information," Quarterly Journal of Experimental Psychology 4(1), 1952, pp. 11–26
  • Robert B. Miller, "Response Time in Man-Computer Conversational Transactions," Proceedings of the AFIPS Fall Joint Computer Conference, 1968, pp. 267–277

延伸阅读

  • Thierry Bardini, Bootstrapping: Douglas Engelbart, Coevolution, and the Origins of Personal Computing (Stanford University Press, 2000)
  • Jakob Nielsen, Usability Engineering (Morgan Kaufmann, 1993)
  • Harry Brignull, Deceptive Patterns: Exposing the Tricks Tech Companies Use to Control You (Testimonium Ltd, 2023)