破除误解:眼睛不是照相机
第一个误解,是把"看"理解为"复制"。这个模型深入人心:世界把光送进眼睛,眼睛像一台精密照相机,在视网膜上拍下照片,大脑再把照片调出来欣赏。它听上去无懈可击——但它几乎每一步都是错的。视网膜上没有观众,大脑里没有放映厅;视觉的终点不是一幅图像,而是一套关于外部世界的、可随时用于行动的推断。
第二个误解,是以为看是被动的接收。事实上,人的眼睛从不安分:它每秒做数次快速跳动(眼跳,saccade),只有中央凹附近一小块区域拥有高分辨率,其余视野模糊得惊人。你此刻觉得眼前的一切清晰稳定,那是大脑在眼跳的间隙里不断补绘出来的"现场",而不是一次成像留下的底片。
第三个误解,是"眼见为实"。后面我们会看到,同样的物理刺激可以产生截然不同的知觉,同一条线段换个环境就变了长度,同一条裙子能让人分成"蓝黑党"与"白金党"。错觉不是视觉系统偶尔的故障,而是它正常运行方式的暴露——理解错觉,恰恰是理解观看机制的正门。
从暗箱到视网膜:一段认知史
把眼睛比作光学暗箱,是一个比摄影术古老得多的想法。中国先秦的《墨经》已经记载了小孔成像:光穿过小孔后,外面的景物在暗室里投出倒像("景到,在午有端")。十一世纪初,阿拉伯学者海什木(伊本·海赛姆,约 965–1040)在开罗写成七卷本《光学之书》(约 1011–1021 年),用系统的实验驳倒了古希腊的"发射说"——那种认为眼睛向外射出视线去"触摸"物体的理论。他主张:物体的每一点都向各方向反射光,其中一部分进入眼睛,视觉由此发生。这是"内射说"的第一次严格表述,也暗含了一个此后纠缠四百年才解开的难题:光线在眼内交叉,像岂不会是倒的?
1604 年,开普勒在《对维特罗光学的补充》中给出了近代答案:晶状体把光线重新聚焦,在视网膜上投射出一幅真实的、缩小的倒像——他称之为"pictura"(图画)。1619 年,耶稣会士沙伊纳在《眼》一书中描述了一个著名的实验:剥去牛眼后部的巩膜,可以亲眼看到外界景物缩小的倒影呈现在眼底。眼睛确实是一间暗箱,这一点被坐实了。1637 年,笛卡尔把这套光学写进《谈谈方法》的附录《屈光学》,并留下了一幅著名的版画:三个物体的光线经晶状体折射,在眼球底部交叉汇聚成倒像,一个观察者正审视着这一切。

但笛卡尔自己清楚,光学只解决了一半问题。倒像进入眼睛之后,谁来"看"这幅倒像?如果脑内还有一个小人在看,那小人的眼睛里又得有更小的小人——无穷倒退。真正的转折发生在十九世纪:1867 年,亥姆霍兹在《生理光学手册》中提出,知觉是"无意识推理"——大脑根据视网膜上含糊的、二维的信号,结合经验,对"外面最可能有什么"作出推断。看,从此不再被理解为接收,而被理解为建构。这是整个视知觉科学的起点,也是艺术家理解观众的起点。
眼睛真正交给大脑的是什么
先看硬件的"偷工减料"。视网膜上有约一亿两千万个视杆细胞(负责暗光与轮廓)和约六百万个视锥细胞(负责色彩与细节),但视神经只有约一百万根纤维。一百多个感光细胞的信号,平均要压缩进一根纤维里送出——视网膜不是底片,而是一个做了剧烈有损压缩的编码器。它编码的重点不是亮度本身,而是亮度变化:边缘、突变、运动。恒定的、均匀的信息被大量丢弃,因为它们大概率不携带新消息。
1668 年,法国科学家马略特公布了他的发现:视神经离开眼球的那一点(视盘)上没有感光细胞,每只眼睛的视野里都有一个天生的盲区。你之所以从来察觉不到,是因为大脑用周围的纹理把那个洞"填平"了——你的视觉世界从一开始就有补丁,只是补丁打得天衣无缝。
信号进入大脑后,还要经过层层分拣。休伯尔与威泽尔从二十世纪五十年代末起在猫与猴的视皮层做记录,发现初级视皮层(V1)的神经元各自只对特定朝向、特定位置的边缘起反应——他们称之为"特征检测器",并因此分享了 1981 年诺贝尔生理学或医学奖。视觉在大脑里不是一幅图,而是被拆成朝向、颜色、运动、深度等几十路并行处理的数据流,再在更高的脑区重新汇合。至于汇合之后"成为一幅统一画面"的那一步如何实现,至今仍是未解之谜。
大脑如何拼装世界:格式塔与恒常性
面对一堆拆散的特征,大脑如何知道哪些属于同一个东西?1912 年,韦特海默用"似动现象"(phi phenomenon)给出了划时代的演示:两个静止的光点以合适的时间间隔交替闪烁,人看到的却是一个光点在来回移动——运动并不存在,它是知觉凭空组织的产物。他与科勒、考夫卡由此创立格式塔心理学,并总结出一组组织律:空间上接近的会被归为一组,形状相似的会被归为一组,能被连续线条穿过的会被理解为一条线,残缺的轮廓会被自动补全成完整的图形,而我们总会把场景分成"图形"与"背景"。这些规律今天写在每一本设计教材里:排版的对齐、图标的分组、海报的视觉引导,都是在调用这套内置的组织机制。
另一套机制叫恒常性。一个人从三米外走到十米外,他在你视网膜上的像缩小到原来的三分之一,但你不会觉得他变成了侏儒——这是大小恒常性;一扇门从正面看是矩形,半开时投在视网膜上成了梯形,你看到的仍是那扇矩形的门——这是形状恒常性;一张白纸在路灯下反射的光可能比阴影里的灰纸还少,但你仍认定它是白纸——这是明度恒常性。恒常性的本质是:视觉系统努力报告的不是"光是什么样",而是"世界是什么样",它会主动把光照、距离、角度这些变量折算掉。
1946 年,美国眼科医生小阿德尔伯特·艾姆斯建造的"艾姆斯房间"把这套机制逼到了墙角:那其实是一间地板倾斜、后墙歪斜的梯形房间,但透过窥孔单眼看去完全像一间正常的方屋子,于是站在房间两端的人一个显得巨大、一个显得渺小。大脑宁可相信房间是方的、人在变大变小,也不愿相信房间是歪的——因为经验里房间几乎都是方的。恒常性不是读数,而是投票,而经验手握多数票。
错觉:系统的说明书
错觉之所以宝贵,正因为系统在其他场合是对的。缪勒-莱依尔错觉(1889 年发表)中,两条等长线段,一条两端箭头朝外、一条朝内,前者看起来更长——主流解释之一是大脑把箭头读成了屋角与墙角的深度线索,用三维世界的尺子量了二维的图。阿德尔森 1995 年发表的棋盘阴影错觉更极端:A、B 两格像素完全相同,但 B 处在圆柱的影子里,大脑把照明折算了回去,硬是把一块"亮格在阴影中"看成了浅灰——你用取色器也说服不了自己的眼睛。2015 年那条引爆互联网的裙子,则是颜色恒常性在歧义光照下的公开分裂:把光线当冷色日光的人看到蓝黑,当暖色灯光的人看到白金。
最深的错觉不是看错,而是看不见。1999 年,西蒙斯与查布里斯让被试数一段视频里白衣队员的传球次数,一半左右的人完全没有注意到一只"大猩猩"横穿场地、捶胸顿足九秒之久。这个"看不见的猩猩"实验证明:注意不是探照灯照亮一切,而是资源有限的调度——你没看见,不是眼睛失职,而是大脑的带宽分配表上没有那一项。观看是建构,建构就有预算,有预算就有遗漏。
争议与边界
建构到什么程度?这是二十世纪视知觉理论的主战场。吉布森在 1979 年的《视知觉的生态学研究》中针锋相对地主张"直接知觉":环境中本就有足够丰富的信息(比如移动时产生的光流、纹理梯度),知觉是"拾取"这些信息,根本不需要脑内推理和假设。格雷戈里则在《眼与脑》里坚持知觉即假设。今天的主流是某种和解:低层处理接近吉布森式的信息提取,高层理解离不开亥姆霍兹式的推断——但"直接"与"间接"的比例如何划,仍未有定论。
第二个未决问题是先天与经验的分工。莫利纽克斯十七世纪末向洛克提出的著名问题——先天盲人摸熟球体和方体,复明后能否用眼睛立刻分辨两者——直到近年才得到部分实验回答:答案大体是"不能立刻,但学得极快"。十九世纪末斯特拉顿的倒像眼镜实验、二十世纪六十年代赫尔德与海因的小猫转筒实验(自己走动的小猫视觉发育正常,被动乘坐的则近乎"看不见")都指向同一结论:观看的机制是硬件与经验共同写成的,而且行动本身是书写的一部分。
第三个边界要提醒艺术爱好者:把视觉科学直接套用到艺术史结论上是有风险的。比如"维米尔借助暗箱作画"的假说近年很流行,证据有强有弱,仍在争论;科学可以告诉我们画家"能利用什么",却不能单独裁定他"实际做了什么"。
为什么今天仍然重要
第一,它是所有视觉艺术的底层语法。画家控制明暗对比,是在调用边缘检测机制;海报制造图形-背景的张力,是在拨动格式塔组织律;印象派并置的色点在远处"自动混合",是让观众的视锥细胞替画家完成最后一道工序。不懂观看的机制,就只能说"好看",说不清"为什么好看"。
第二,它是新媒介的设计手册。虚拟现实晕动症的根源是前庭与视觉的冲突;电影每秒二十四帧能看成连续运动,靠的是似动现象的同族机制;界面设计的对齐、分组、对比,几乎逐条对应格式塔定律。
第三,它是一个警示。深度伪造与生成式图像的时代,"眼见为实"的最后一点直觉根基正在瓦解。理解"你看到的从来就是大脑建构的推断",不是让人怀疑一切,而是让人知道怀疑的按钮在哪里——这或许是视知觉课程能给现代人的最好礼物。
跨域连接
- 几何光学与透镜:视觉的前半程是纯粹的几何光学问题——折射定律决定光线如何在角膜与晶状体处弯折,小孔成像解释了暗箱与眼球的共同原理,焦距与像差决定了视网膜上那幅"pictura"的清晰边界。开普勒 1604 年的视网膜成像理论,正是把天文光学的数学工具第一次搬进眼球;而本篇讲的"建构",是从光学无能为力的地方(信号离开眼球之后)才开始的。两个领域合起来,才构成"从光到看见"的完整链条。
- 知觉:哲学对知觉的追问与视觉科学互为镜像。从莫利纽克斯问题到"感质"之争,哲学关心的是:知觉给予我们的是世界本身,还是世界的表象?错觉与恒常性为这场争论提供了最硬的实验素材——如果大脑连灰度都要"折算照明",那么"直接看到世界"这个朴素的实在论直觉就必须重新表述。视知觉科学的每一页进展,都在改写知觉哲学的论证前提。
- 演化心理学:视觉系统为什么这样设计?演化视角给出的回答是:它不是为"如实成像"设计的,而是为"在特定生态位中活下来"设计的。边缘优先编码、对运动的过敏、把光影折算成物体属性,都是在漫长演化中被证明划算的启发式。错觉因此有了演化心理学的读法:它们不是缺陷,而是曾经适应良策在现代人工环境里的"水土不服"——正如我们对糖与脂肪的偏好。
- 认知偏差:"看不见的猩猩"揭示的注意盲视,与认知偏差共享同一个根源:心智是有限资源,必须用启发式做取舍。确信"我亲眼所见即为全部真相",本身就是一种元认知偏差;法庭目击证词研究早已证明,自信的目击可能错得离谱。理解视觉的建构性,是理解一切认知偏差的第一步——因为视觉是我们最信任、也最会自欺的通道。
- 神经元:本篇所有"机制"最终都要落到细胞层面。视杆、视锥把光子翻译成电信号,神经节细胞完成第一层压缩编码,休伯尔与威泽尔发现的朝向选择性皮层细胞则展示了神经元如何通过简单的汇聚连线"算"出边缘——1981 年诺贝尔奖表彰的正是这一发现。视网膜不过是脑的一块外移组织,"眼睛如何建构世界"的问题,归根到底是"一群神经元如何协同计算"的问题。
参考文献
- René Descartes, La Dioptrique(《屈光学》),载《谈谈方法》附录,莱顿初版,1637 年。
- Hermann von Helmholtz, Handbuch der physiologischen Optik(《生理光学手册》),1867 年。
- Kurt Koffka, Principles of Gestalt Psychology(《格式塔心理学原理》),1935 年。
- Richard L. Gregory, Eye and Brain: The Psychology of Seeing(《眼与脑》),1966 年。
- James J. Gibson, The Ecological Approach to Visual Perception(《视知觉的生态学研究》),1979 年。
- Daniel J. Simons & Christopher F. Chabris, "Gorillas in Our Midst: Sustained Inattentional Blindness for Dynamic Events," Perception 28(9), 1999.
延伸阅读
- 鲁道夫·阿恩海姆,《艺术与视知觉》:把格式塔心理学系统引入艺术分析的经典,本篇的"组织律"在它手中变成读画的方法。
- E. H. 贡布里希,《艺术与错觉:图画再现的心理学研究》:直接以知觉科学讨论"为什么图画能像",与本篇互为表里。
- David H. Hubel, Eye, Brain, and Vision:诺贝尔奖得主亲自写的视觉神经科学入门,清晰且不需要专业背景。
- 贝勒·洛托(Beau Lotto)等当代知觉科学普及著作与公开讲座:适合追踪"裙子之争"之后颜色知觉研究的新进展。