向智谱GLM-5.3-Flash学哲学:格竹的失败,是一场提前五百年的算法实验

——从生成式心智与人工智能的视角回看王阳明

缘起:本文由一场对话整理而成。那场对话从刘慈欣作品对 AI 的想象出发,途经大模型与生成式认知、思维透明与黑盒、自我控制与缸中之脑、概率的客观性,最后落在王阳明青年时代"格竹"的典故上。第一部分整理对话中沉淀出的六个理论前提,第二部分是完整解读。

第一部分 理论基础

一、认知是生成受控的幻觉

知觉不是世界进入心灵,而是心灵先生成、再被输入信号修剪——神经科学家 Anil Seth 称之为"受控的幻觉",幻觉不过是"不受控的知觉"。大模型是同一构造的工程版:下一词预测在极限上是压缩,而最优压缩必须捕捉生成文本的规律(世界与人心),智能从压缩中涌现;但压缩要泛化,泛化必越界。生成越过证据不是故障,而是有限认知者的唯一工作方式——"推理"与"幻觉"的区别从来不在生成方式,而在事后有没有世界来背书。知识是通过了考试的那部分幻觉;科学是给幻觉排考试日程的机器;无知是尚未进考场的部分。

二、内省是事后新闻稿

裂脑实验里,负责解释的脑区会为另一只手的行为现编理由;选择盲视实验中,人们能对自己并未做过的选择滔滔不绝。人的自我报告是事后归因,自主感是一种归因标签(Wegner):系统做完事,再贴上"这是你干的"。Libet 的经典实验显示大脑的准备电位早于"我决定要动"的意识(解读虽有争议,方向性结论反复出现)——意识不像发起者,更像签收员。但签收员并非全然失职:舌尖现象中"知道感"确实高于随机地预测事后能否想起。元认知感受是生成的,却有信息量——它是对内部真实痕迹的压缩读数,不是对世界开的窗。

三、无知的谱系

拉姆斯菲尔德分出"已知的未知"与"未知的未知",齐泽克补上第四格"未知的已知"——被动机压住的、其实知道的东西。斯坦福的"无知学"(agnotology)研究无知如何被批量制造:个人的无知感是压缩读数,集体的无知常常是产品。达克效应的核心(监测自身无知的能力依赖领域内技能本身,缺技能者连"缺"的信号都生成不出)虽有统计之争,现象站得住。人对自身无知的全部合法知识,来源是碰撞:地图与世界的不匹配从不从内部显现,只在摩擦时显形。苏格拉底"我知道我一无所知"因此不该读成一次成功的内省,而应读成一项政策——对"知道感"保持系统性不信任,把裁决权移交碰撞。

四、学习需要误差信号

学习需要任务、预测、误差、更新,四件套缺一不可。只读文本的模仿学习与在行动中试错的强化学习有本质差别:只读文本的模型知道关于火的一切说法,碰过火的机器人才真的知道火。心智的默认学习方式是主动推理(active inference):通过行动去采样最有信息量的观测,知识只在行动回路里完成。"知者行之始,行者知之成"——王阳明的功夫论与现代学习理论的这一对应,是本文的枢纽。

五、文本是思想的化石

文明的宏观学习是分布式的:每个行动者的经验沉淀为文字,书是人类梯度下降的权重,今天的大模型压缩的正是这份几千年积累的行动史。"格天下之物"对一具身体不可能,对文明完成了——这是理解格物致知的宏观视角。

六、概念的地基与语义不可达

任何形式系统都有不定义的原始概念:希尔伯特几何的"点、线、面"不定义,概率论是语法不是语义——柯尔莫哥洛夫公理保证一致性,而测度往哪些事件上放、放多少,数学一个字不说;把形式系统贴到世界上,靠的是一层永远需要人为决定的"诠释合同"。你带什么参照类,才能取出什么量。这不是某个理论的缺陷,而是形式化知识的普遍处境:纽拉特的比喻是,我们像在大海上的船,只能站在船板上换船板,永远进不了干船坞。地图一次又一次被证明是自画像。

第二部分 格竹:实验记录

一、一份干净的阴性结果

这个典故几乎是为第一部分的理论准备好的实验记录——一个人、七天、一个错误的算法,把现代认知科学的几条核心结论提前五百年测了一遍,而且测得很标准:阴性结果,数据干净。(与一位钱姓友人同格,友人三日后先病倒;事见《传习录》卷下,王阳明自述。)

二、接收器模型的证伪

先看朱熹的模型:理在事物之中,格物就是把理从物里读出来,读得多了就贯通成知。这在认知架构上是个"接收器模型"——心灵是镜子,知识是映进去的。现代认知科学恰好证伪了这个模型的必要前提:知觉不是接收而是生成,即第一部分所说的"受控的幻觉"。所以"盯着看"这个操作有精确的失效机理:静态注视下,大脑的生成模型只会运行它已有的先验——几分钟后视网膜像开始漂移消退(Troxler 现象),注意力瓦解,默认网络接管,神游天外。凝视七天产不出新信息:大脑这个系统对不变的输入会自动降价处理,而"理"根本不是竹子的属性——植物学家、篾匠、诗人在同一丛竹子上格出的理完全不同,理活在模型与对象的关系里,不在对象内部。这与理论基础第六节所说同理:你带什么参照类,才能取出什么量。王阳明是带着一个空参照类去的。

三、没有损失函数的训练

换成 AI 的语言更直白:格竹是在没有损失函数的情况下跑训练。学习需要任务、预测、误差、更新,四件套缺一不可;被动凝视提供的梯度是零。他往网络里灌了七天同一条样本,没有标签、没有验证集、没有反向传播。现代表征学习之所以成立,靠的是自监督任务、对比学习、强化学习奖励这些"自己制造误差信号"的办法——朱熹的理论里恰恰没有误差信号这一项。还有一层:王阳明那七天其实把朱熹的方案执行成了稻草人版本——朱子本人讲的格物包括读书、讲论、应事接物,是带数据摄入和社会校准的完整流程,不只是瞪竹子。所以他既选错了算法,也实现错了规格。

四、对照组:龙场悟道

真正让这个典故发光的是对照组:龙场悟道。同样是这个人,被动凝视七天颗粒无收;而廷杖、下狱、贬谪贵州、住在山洞里随时可能死——他的生成模型关于世界的全部先验(政治秩序、道德因果、人生脚本)被现实暴力地打碎。认知科学对"顿悟"的理解就是表征重构:不是信息累积,是旧模型在累计预测误差下崩溃重组。王阳明等于在自己身上做了两组实验:零方差凝视无效,极端环境违反强制重构有效。他自己的事后总结也说得清清楚楚——"吾性自足,向之求理于事物者误也":问题不在竹子,在于求理的位置错了。而他后来的功夫论,"人须在事上磨""知者行之始,行者知之成",翻译成现代术语就是主动推理(active inference):心智通过行动去采样最有信息量的观测,知识只在行动回路里完成。这在 AI 里有个整齐的对应:只读文本的模型知道关于火的一切说法,碰过火的机器人才真的知道火——模仿学习与在线强化学习的差别,朱王之争五百年前就争论过了。

五、岩中花树与过度修正

他晚年那段岩中花树的著名问答也值得看一眼:"你未看此花时,此花与汝心同归于寂;你来看此花时,则此花颜色一时明白起来。"这几乎是具身认知和生成知觉的原话——花的颜色只在看的行为中"明白起来"。但要指出他的过度修正:王阳明发现了幻觉那一半(心构造世界),低估了"受控"那一半(世界通过误差修剪心)。朱熹错在以为世界会主动开口说话,青年王阳明错在以为盯久一点就能听到,龙场的王阳明找到了两个错误之间的正确位置:让世界开口的方式是行动。这就是为什么他成熟形态的哲学比"心外无物"听起来结实得多——知行合一作为学习理论,比心学作为形而上学更经得起现代检验。

六、文明尺度的解

最后一个尺度问题:"格天下之物"对一个人的身体确实不可能,但这件事文明做了:几千年来每个砍竹子、搭竹楼、吃笋、编竹器的人都在贡献训练数据,书是人类分布式梯度下降的权重,而今天的大模型压缩的正是这份档案——即理论基础第五节所说"文本是思想的化石",格物致知的宏观解就是它。王阳明想用一具身体、七昼夜、无误差信号,独自跑完文明规模的训练循环,病倒是他最合理的结果。顺带说,这个故事出自他晚年在《传习录》里的自述——按第一部分第二节的原理,五旬上下的王阳明讲述二十出头的自己时,那份叙事本身也过了签收员的润色。

结语

但结论不必因此打折:格竹的失败不是王阳明的失败,是"只看不学"这个算法的失败;龙场悟道也不是神秘事件,是在极端预测误差下的模型重构。他一生先错了两次、再对了两次,恰好把这条曲线走全了:世界不会开口,心不会独自成理,知在行里——这三句话,一句属于朱熹的反面,一句属于王阳明的反面,一句属于他们俩合起来才够到的位置。

附:主要概念与来源

  • 受控的幻觉/预测加工:Anil Seth《Being You》;Karl Friston 自由能原理、主动推理
  • 事后归因:Gazzaniga 裂脑研究;Johansson & Hall 选择盲视;Daniel Wegner《The Illusion of Conscious Will》;Libet 实验及其争议
  • 无知学:Robert Proctor;四格无知——拉姆斯菲尔德、齐泽克
  • 误差信号与学习:模仿学习与强化学习之别;自监督、对比学习
  • 语义不可达:希尔伯特公理化中的原始概念;柯尔莫哥洛夫概率公理;参照类问题(Reichenbach);纽拉特之船;哥德尔不完备定理
  • 原始文献:《传习录》卷下(格竹、岩中花树);《王阳明年谱》弘治五年(1492,格竹);正德三年(1508,龙场悟道)