TOPIC 15 · PHASE B 意识

大脑从不直接看世界,它只在核对自己的猜测

前几期的意识理论各说各话。这一期想用一条原理把感知、行动、连同"活着"本身一起兜住:大脑(也许所有生命)都在做同一件事——把意外压到最小。

2026-07-21 · BigCat

你伸手去拿杯子,并不是大脑先决定"动"、再发指令给肌肉;而是它先"假装"手已经贴在杯子上,再让这个假装成真。

Topic 1 讲过一句反直觉的话:看,不是被动接收,而是大脑主动猜、再拿感官去核对。这一期把这句话推到极致——原来不止看,听、动、决定、乃至维持你这条命,可能全是同一件事的不同侧面。提出者是伦敦的神经科学家 Karl Friston(弗里斯顿),他的野心大得吓人:用一条叫自由能原理的公式,把大脑、身体、甚至"一个东西凭什么算活着"都装进去。落点很反直觉——你以为的"你在观察世界",本质是大脑在跟自己的一套模型较劲、拼命不让现实吓着它。而意识,也许就是这套模型跑到最好时的样子。

// 01

大脑是台"先猜了再说"的机器

常识里,感觉是这样来的:光进眼睛、声音进耳朵,信号一路往里传,大脑在末端把它们拼成画面。预测加工说这套顺序基本反了。真实情况是:大脑时时刻刻在往下猜——高层先根据经验押一个"接下来大概会看到/听到什么",把这份猜测当预测压到低层;低层拿它跟真进来的感官信号一比,只把对不上的那点差额往上报。这份差额有个名字,叫预测误差

换句话说,往上流的从来不是"完整的世界",而是"哪儿跟我想的不一样"。猜得准,低层几乎不吭声,上面一片安静;猜错了,误差往上冒,逼高层改猜测。你之所以对冰箱的嗡嗡声充耳不闻,正因为大脑早把它预测得死死的、误差为零;它一停,寂静反而"咯噔"一下冒出来——那是预测被打破的误差。这套一层压一层、只上报差额的结构,在皮层里从最贴感官的区域一直搭到最抽象的高层;而它最早被写成公式,正是在视觉通路上。

高层 · 抽象的猜测 中层 · 形状 / 物体 低层 · 贴着感官 预测 ↓ ↑ 误差 猜测往下压,只有"对不上的差额"才往上报
预测加工的双向流:紫色的预测一层层往下压,品红的预测误差只把"跟猜测不符的部分"往上送——世界从不整个进来

EN Predictive processing flips the common-sense order. The brain doesn't wait for signals to arrive and assemble them; higher levels constantly predict downward what they expect to sense, and lower levels send back up only the mismatch — the prediction error. What flows up isn't the world, it's "where reality differs from my guess." You ignore the fridge's hum because it's perfectly predicted (zero error); when it stops, the silence jolts you — a burst of error. This one-way-report hierarchy runs from sensory cortex up to the most abstract levels, and vision is where it was first written as equations.

AI 对读

这套"猜 + 只修差额"跟机器学习里一个东西撞了个正着。训练变分自编码器(VAE)这类生成模型时,要最小化的量叫自由能(换个说法就是最大化 ELBO,证据下界)——它恰好等于"重建误差 + 你的猜测偏离先验有多远"。两条一模一样:一边压预测误差、一边别让内部模型乱飘。Friston 的"自由能"和深度学习的"自由能"不是巧合同名,是同一个数学量。所以"感知即最小化自由能"这句话,既是脑科学的假说,也是今天生成模型每一步梯度下降在干的事。

// 02

消灭意外,其实有两条路

到这儿还只是"感知"。真正大胆的一步是:预测误差不止能靠"改猜测"来消,还能靠"改世界"来消。你的猜测跟感觉对不上,有两个办法把这道缝抹平——要么更新你脑子里的模型去迁就现实(这就是感知);要么动手去改变现实,让感觉变成你猜的那样(这就是行动)。同一道预测误差,两个出口。这就是 主动推理

拿"伸手拿杯子"当例子,它会彻底改写你对"动作"的直觉。老看法:大脑先算好轨迹,再把命令发给肌肉。主动推理说:大脑先发出一个大胆的预测——"我的手此刻正贴在杯子上"。可你的手明明还在桌上,于是冒出一大团预测误差。身体不许你改猜测(这次它铁了心要相信手在杯子上),唯一能抹平误差的路,就是让手真的移过去。于是肌肉动起来,一路把误差归零,动作就自己完成了。动作不是"命令",是一个被身体拼命兑现的预言。所谓意志,也许只是大脑选择相信一个还没成真的未来,然后让身体去追平它。

预测 ≠ 感觉→ 一道预测误差 改猜测= 感知 改世界= 行动 同一道误差,两个出口 — 迁就现实,或让现实迁就你
主动推理:预测与感觉不符时,既可以更新内部模型去符合世界(感知),也可以行动去改变世界符合预测(行动)

EN The bold move: prediction error can be killed two ways — update your model to fit reality (perception), or change reality to fit your model (action). This is active inference. Reaching for a cup, the brain issues the prediction "my hand is already on the cup." Since your hand is still on the table, a big error appears — and the only way to erase it (given the brain refuses to abandon the belief) is to actually move the hand there. Movement isn't a command; it's a prediction the body scrambles to fulfill. Will may be just choosing to believe a future that isn't true yet, then chasing reality up to meet it.

// 03

一条原理,连"活着"都想管

Friston 更狠:他说上面这些都是一个更大原理的特例,叫自由能原理。一句话——任何能长期维持自己、不散架的东西,都必须让"意外"保持在最低。"意外"在这里有精确含义:碰上你这类系统本不该处的状态的程度。一条鱼被甩上岸、你的体温飙到 42 度,都是天大的意外;自由能就是这份意外的一个算得出来的上限。压低自由能,就是压低意外,就是留在你该在的状态里——也就是活着。

这里立刻蹦出一个著名的反例,叫暗室问题:既然只求意外最小,那我干嘛不钻进一间全黑、全静、啥也不会发生的屋子躺一辈子?那才叫零意外啊。答案很妙:对一个饿了会难受、闷了想动的生物来说,"永远躺在暗室里"恰恰是天大的意外——你"预期中的自己"本就包含吃饭、探索、见人。这些期待有个学名叫先验偏好,等于把"我该是什么样"写进了系统。于是压意外不等于躺平,反而逼你出门觅食、好奇张望,去把"预期中那个活得好好的自己"兑现出来。

那"你"和"世界"的边界又在哪?Friston 借来一个统计概念——马尔可夫毯。它不是皮肤那种物理墙,而是一层信息的帘子:世界只能通过你的感觉影响你,你只能通过行动反过来碰世界;感觉 + 行动这层帘子把"内部的你"和"外部的世界"隔开,又把它们缝在一起。有了这层毯,"一个东西算不算一个独立的自我"头一回有了数学上的定义——自我,是那团被信息帘子圈起来、还在努力不散架的东西。

AI 对读

把主动推理搬去做 AI 智能体,跟主流的强化学习(RL)正好照出彼此。RL 的信条是最大化奖励——奖励是外面塞给它的一个数。主动推理里没有单独的奖励:智能体只最小化"预期自由能",而这一个量天然裂成两半——"去把没搞清的地方搞清"(探索/求信息)"去到我偏好的状态"(利用/达目标)。RL 里"探索还是利用"要靠工程师手动调参去平衡,这儿却是同一个公式自己长出来的两条腿。而"奖励"在这套语言里被翻译成了先验偏好:你不是被奖励拽着走,而是本就"预期"自己会到那儿。

// 04

意识:模型跑到最好时的样子,还是一句聪明的空话?

那意识落在这套图景的哪里?一个越来越有人信的说法是:你体验到的世界,是大脑当下最好的那个模型——神经科学家 Anil Seth 干脆叫它"受控的幻觉"。所谓"看见",是大脑向外抛出猜测、再被感官不断修剪后稳定下来的那一版;当大家的幻觉都被同一个真实世界修剪着、于是彼此吻合,我们就管它叫"现实"。做梦则是同一台生成模型脱开了感官的修剪空转——所以梦既逼真又离谱。连"自我"都可以是一层猜测:大脑对自己的身体和内脏状态做推断,推出来的那个稳定结果,就是"我在这儿"的感觉。

但这套东西也挨了重拳。最要命的一击是:自由能原理会不会太万能,反而什么都没说?批评者指出,只要肯凑,几乎任何能维持自己的系统——细菌、火苗、乃至一块石头——都能被"解释"成在最小化自由能。一个什么都能套的框架,还怎么可能被实验证伪?它更像一副看世界的眼镜、一种数学语言,而未必是一条能被单个实验掐死的具体假说。支持者则回击:正因为它把感知、行动、学习、稳态用一个量串起来,才第一次让"大脑到底在优化什么"有了统一答案;至于意识,它给出的是一个诱人的候选——体验,就是一个系统为自己建的、那个最省意外的模型的内部视角。是深刻的统一,还是漂亮的套套逻辑,这场架还远没打完。

🌀 越界 · 跨学科的联想

"心从不直接碰到世界,只碰到自己造出来的模型"——这个念头,好几路古老的思想早就绕着它转:

// 深入思考

如果动作只是"被身体兑现的预言",那"我决定要动"这个感觉是真的因,还是事后配的字幕?
主动推理把动作说成"为抹平预测误差而自动发生",这就把传统的"意志→命令→肌肉"链条抽掉了中间那根。于是一个尖锐的问题浮出来:你那份"是我主动要拿杯子"的清晰体感,到底是启动了动作,还是大脑在动作已经上路后补贴上去的一段解说?这跟 Libet 那批"决定其实先于意识"的经典实验直接接头。主动推理不否认你有意志感,但它把意志重新定义成"选择相信哪个未来"——而"选择"本身是不是又一层需要解释的推断,问题就这样一环套一环退回去。
暗室问题真被"先验偏好"解决了吗,还是把答案偷偷塞进了前提?
"你预期中的自己包含吃饭探索,所以躺暗室才是大意外"——听着圆满,但批评者会追问:这些先验偏好从哪来?如果答案是"进化写进去的""它们本就定义了这个生物",那自由能原理其实没有单靠自己推出"生物为什么好奇、为什么觅食",而是把这些当输入预设了进去。这不必然是漏洞——每套理论都得从某处起步——但它点出了边界:自由能原理擅长说明"给定你想成为什么,你会怎么行动",却未必能说明"你为什么偏想成为这个"。
"受控的幻觉"和"如实看见世界",从内部到底分不分得出来?
如果知觉自始至终都是大脑的建构、只不过被感官修剪,那"看得准"和"看得歪"就只是修剪多寡之别,而非"碰到真实 vs 没碰到"之别。这在临床上很实在:幻觉、错觉、乃至精神分裂的妄想,都能被重述成预测与误差的配比失衡(比如太信自己的猜测、太不信感官)。但它也留下一道形而上的不安——如果你能体验到的永远只是模型,那"世界真的如我所见"这句话,你从内部根本无从验证。你唯一握得住的,始终是那版幻觉本身。
一个框架能解释细菌、火苗、石头到人脑的一切,是它极深刻,还是它其实什么都没说死?
这是自由能原理头上最大的问号。物理学也追求万用定律,没人嫌牛顿"太万能"。区别在于:牛顿定律能对单次实验给出会被打脸的具体数字,而自由能原理常被批评怎么都能自圆其说——现象出来了,总能反推一个"它在最小化自由能"的说法。一套永远对的理论,可能是万有真理,也可能只是一种重新描述的语言。分野的关键或许在于:它能不能压出别的理论压不出、且真能被证伪的预测。这正是当下这个领域最要紧、也最没定论的战场。

// 延伸阅读