DAY 59 · 知觉与注意
感官与知觉:你看到的不是世界,是大脑最好的猜测
2026.08.02 · BigCat's Inner World
视网膜上有一个真实的盲点,你从没在视野里见过那个洞。因为你看到的不是感官输入,而是大脑基于输入生成的推断。这一期讲它怎么做出来、哪里可靠、哪里骗你。
知觉的建构Predictive Processing
认知神经科学 · 知觉
核心洞察
同一个视网膜图像可以由无穷多种外部场景产生。大脑解决这个反问题的办法不是被动接收,而是先猜,再拿输入纠错。Anil Seth 称之为「受控幻觉」——你体验到的是那个猜测,感官只负责约束它。
机制解读
Helmholtz 在 1867 年提出「无意识推理」。现代版本是预测加工(Clark, Friston):皮层是分层的生成模型,自上而下传预测,自下而上只传预测误差。对得上的部分不再上送——意识内容因此主要由模型而非输入决定。
关键旋钮是精度加权:大脑估计此刻感官证据有多可靠。光线好、注意力在,就调高感官权重;昏暗、疲惫、信号模糊,就更多交给先验。正弦波语音第一次听是噪声,被告知内容后立刻变成清晰句子——先验一旦装上,知觉本身就变了。
这与唯识的相分由识变现是同构描述:境不是现成待取的对象,而是识的建构产物。Barrett 的情绪建构论(Day 9)是同一机制用在内感受上。
先验权重 × 感官证据可靠度 → 四种知觉结果
先验适中 × 证据可靠 正常知觉猜测被输入持续纠正,主观上感觉「我直接看到了世界」。
先验强 × 证据可靠 错觉输入清楚,但先验太强不肯让步。棋盘阴影错觉属于此格。
先验强 × 证据弱 幻觉Powers 等 (2017):易幻听者对先验的加权显著更高。
先验弱 × 证据弱 迷失陌生、噪声大、无参照。焦虑常在这格——不是信息太多,是先验失效。
知觉不是「准不准」的问题,是两路信息谁的权重更高。
自我应用
自我「我感觉他语气不对」拆成两份:他说了哪些词、什么语速(输入),你补了什么(先验)。补的部分常来自上一次冲突。
育儿孩子说「我看到的就是这样」多数不是撒谎,只是先验和你不同。有效做法是补输入,不是质疑他的诚实。
团队评审时分开写「我观察到的」和「我推断的」再讨论。多数争执发生在第二栏,却被当成第一栏在吵。
自我评估工具 + 常见误区
练习:挑一次强烈判断(「这方案不行」「她在敷衍我」),写两栏——左栏只填可被录音录像验证的事实,右栏填其余全部。右栏比左栏长多少,就是你此刻先验的权重。
常见误区:把「知觉是建构的」读成「一切都是主观的、没有客观事实」。恰恰相反——建构受感官强约束,且不同人的模型高度收敛。它说的是你无法免费拿到未经加工的现实,不是现实不存在。
关键参考 · Anil Seth《Being You》(2021) · Andy Clark《Surfing Uncertainty》(2016) · Helmholtz (1867) 无意识推理 · Powers, Mathys & Corlett (2017, Science)
本周练习 + 思考题每天一次,把当天最强的负面判断做「事实/推断」两栏拆分。思考题:你最近一次「看错人」,错的是输入,还是你调得太高的先验?
错觉Visual Illusions
知觉心理学 · 计算视觉
核心洞察
错觉不是感官出故障,是正常推理机制在非典型输入上暴露的工作痕迹。它是显影剂,不是 bug 报告——把错觉图当成「人脑很蠢」的证据,等于把造影剂当成疾病。
机制解读
Adelson 的棋盘阴影错觉:A、B 两格像素值完全相同,你却坚定地看到深浅不同。因为视觉系统输出的不是亮度而是反射率——它在做「去光照」推断,把阴影扣掉。这在真实世界几乎永远正确,代价是遇到人工构造的图会答错。
更关键的是:知道答案,错觉也不消失。知觉模块对信念是封闭的(Pylyshyn 的「认知不可穿透性」)。凡是发生在知觉/直觉层的偏差,靠「以后注意点」几乎无效,只能改流程和环境(Day 58)。
反向证据是空心面具错觉:凹面被强行看成凸出的脸,因为「脸是凸的」是极强先验。Dima 等 (2009) 发现精神分裂症患者明显更不容易上当,自上而下连接权重更低——先验调低在这里看得更准,在别处却付出幻觉的代价。
自我应用
自我知道自己有偏误不等于摆脱它。把「提醒自己」升级成不依赖当下状态的机制:预先写死判断标准、隔夜再决定、请人只挑反例。
育儿和孩子一起玩错觉图是极好的元认知启蒙:亲身体验「我确信 ≠ 事实」,比讲一百遍谦虚有用。
团队偏误培训效果有限——它作用在可穿透层,问题却在不可穿透层。盲评、改评审顺序、结构化打分表才是正确层级。
自我评估工具 + 常见误区
练习:找一张你已知原理、却仍然「看到」错觉的图盯十秒,然后问:我的哪个判断也是这种结构——道理全懂,感受纹丝不动?那个判断需要机制,不需要道理。
常见误区:「眼见为实」。眼见是最省力的日常推断,但它给出的是对世界的最优猜测,不是拷贝。同理,目击者的确信程度与准确性只有中等相关(Day 44)。
关键参考 · Adelson (1995) checker-shadow illusion · Pylyshyn (1999, BBS) 认知不可穿透性 · Dima et al. (2009, NeuroImage) 空心面具与精神分裂症
本周练习 + 思考题挑一个你「道理想通了、感受没变」的问题,给它配一个不依赖情绪状态的外部机制。思考题:如果确信感本身也是大脑的输出,你该给它多少投票权?
多感官整合Multisensory Integration
感知觉 · 贝叶斯认知
核心洞察
感官给出不一致的信息时,大脑不投票也不取平均,而是按各自可靠度加权求和——实验室里这个过程接近统计最优。你以为的「整体印象」,是一次相当精密的估计。
机制解读
Ernst & Banks (2002, Nature) 让被试同时用眼看、用手摸判断物体高度,再给视觉加噪声。视觉权重随噪声升高平滑下降,与最大似然估计的预测高度吻合。腹语效应同理:视觉定位精度远高于听觉,声音便被「拉」到嘴唇位置。
McGurk 效应(1976)显示整合是强制的:听 /ba/ 同时看到唇形 /ga/,多数人听到 /da/——一个谁都没发出的音节。关键补充是跨语言差异:Sekiyama (1997) 发现汉语、日语母语者的效应显著更弱,整合权重被语言经验长期调制,不是生理常数。
整合也延伸到身体。橡胶手错觉(Botvinick & Cohen, 1998)里,同步的视触刺激让人把假手体验成自己的手:身体拥有感也是推断。须标注争议:Lush 等 (2020) 指出它与暗示感受性高度相关,经典解释正被重检。
自我应用
自我视频会议音画不同步、画面卡顿会系统性拉低你对对方的印象,而你几乎必然把这份不适归因到人身上而非带宽上。重要对话别在弱网络里做。
育儿孩子对声音、质地、光线的敏感度差异是真实的感官处理差异,不是矫情。调环境比要求他适应有效。
团队坏消息和复杂反馈走最高带宽通道(当面 > 视频 > 语音 > 文字)。文字剥掉了接收方降低误读所需的全部辅助证据,只剩先验在工作。
自我评估工具 + 常见误区
练习:把本周一次原本要发文字的重要沟通改成视频或当面,事后记一句:我原以为对方什么态度,实际是什么。差值就是纯文本让你的先验补进去的量。
常见误区:把它和「学习风格」混为一谈。「视觉型/听觉型学习者」缺乏证据——Pashler 等 (2008) 指出按风格匹配教学并不提高成绩。多通道对所有人都有帮助,把人分型则没有依据。
关键参考 · Ernst & Banks (2002, Nature) · McGurk & MacDonald (1976, Nature) · Sekiyama (1997) 跨语言差异 · Botvinick & Cohen (1998, Nature) · Pashler et al. (2008, PSPI)
本周练习 + 思考题把一次难沟通升级一个通道带宽。思考题:你最近一次对某人的负面判断,有多少产生于一个低带宽通道?
注意的选择性Selective Attention
认知心理学 · 注意
核心洞察
看见和看到是两件事。Simons & Chabris (1999) 的实验里,专心数传球的被试约一半没看到走进画面捶胸的大猩猩。这不是不专心,恰恰是专心的代价。
机制解读
专业训练不豁免。Drew, Võ & Wolfe (2013) 在肺结节筛查的 CT 影像里嵌入一个明显的大猩猩,83% 的放射科医生没有报告它,眼动记录显示多数人的目光曾落在上面。眼睛看过 ≠ 进入意识。
Lavie 的知觉负载理论给出可操作的规律:任务负载高时资源被占满,无关刺激在早期即被滤掉,人反而不易分心;负载低时资源溢出,注意力主动去抓别的。最容易让你分心的,常是那些太简单的任务。
过滤也不是全或无:鸡尾酒会实验中,未注意通道里自己的名字仍会被察觉(Cherry, 1953)。变化视盲更极端——Simons & Levin (1998) 让问路人在遮挡的瞬间换人,大量路人毫无察觉。世界的丰富感,多半是「需要时随时可查」造成的错觉。
自我应用
自我「我没注意到」是知觉事实,不是道德失败也不是借口——它意味着改条件:一次只留一个目标,把要监控的东西做成必须勾选的清单。
育儿孩子沉浸时是真的没听见。先建立注意通道(走近、蹲下、等他抬眼)再给指令,比提高音量重复三遍有效。
团队开会同时处理消息,等于这场会没进过你的记忆。「在场但分屏」是两边都亏的选项。
AI 协作模型输出里最危险的是符合你预期的错误——先验会替它把破绽补平。校验要用固定清单逐条核,不要通读了事。
自我评估工具 + 常见误区
练习:读完 AI 生成的关键内容,别问「读起来对吗」,而是逐条核对预先列好的三项(数字、引用、逻辑跳跃)。前者调用先验,后者绕开先验,漏检率不在一个量级。
常见误区:「我可以一心多用。」认知层面没有真正的并行,只有任务切换,而切换有实打实的重启成本;自评「多任务高手」的人客观测量往往更差。能并行的只有高度自动化的动作,一旦需要决策就退回排队。
关键参考 · Simons & Chabris (1999, Perception) · Drew, Võ & Wolfe (2013, Psychological Science) · Lavie (2005) 知觉负载理论 · Cherry (1953) · Simons & Levin (1998)
本周练习 + 思考题为你最常出错的一类工作写一张三项检查清单,本周每次逐条勾。思考题:你今天错过的那件重要的事,是没发生,还是发生了而你没看到?
深入思考
说知觉是「受控幻觉」,是不是取消了客观世界?
不是,但取消了「直接接触」这个假设。Seth 的区分是:幻觉与知觉的差别不在是否建构,而在是否被感官证据持续约束、是否与他人的建构收敛。这接近间接实在论:世界独立存在,但只能经由模型接触。实践含义是别争谁看到的是「真的」,去比谁的模型被更多独立证据约束。
预测加工与唯识的对应,是真呼应还是文字游戏?
在「境不是现成待取的对象、而是识的建构产物」这一层是真对应,两边的方法也一致:不在境上使劲,在能取的一侧使劲。差异要说清——唯识的「识」承载种子、业力与跨世相续,是本体论与伦理学;预测加工只是计算层面的机制假说。可迁移的是方法论:把注意力从「事实如何」转向「我用什么模型在看」。
先验太强会幻觉,先验太弱会怎样?
Pellicano & Burr (2012) 提出自闭症可能与「弱先验」有关:较少用预期平滑感官输入,世界呈现得更原始,既可解释感官超载与对变化的不耐受,也可解释某些细节知觉优势。它仍有争议,不能当定论,更不能拿来给人贴标签。它提示的图景是:知觉健康不在先验多少,而在精度加权调得够不够灵活。
人能不能长出新的感官?
证据说能。感觉替代研究(Bach-y-Rita,1960 年代起)把摄像头信号转成舌面或背部的触觉,盲人经训练后能识别形状、定位、察觉逼近的物体——大脑关心信息结构,对载体并不挑剔;近年 Eagleman 等已做成可穿戴设备。对「AI 超级个体」这是最实在的前沿:新数据流若能变成持续、有节律、与行动耦合的输入,它就有机会成为直觉,而不只是仪表盘上的数字。