人工智能正站在一个关键的十字路口。以大型语言模型(LLM)为代表的深度学习取得了令人瞩目的成就,但它对“智能”本质的逼近究竟走了多远?另一条路径——以Karl Friston的自由能原理和VERSES AI的AXIOM模型为代表——提出了一个根本性的追问:当前AI是否仅仅模仿了大脑的表象,却遗漏了驱动智能的元工作机制?

一、表象的模仿:深度学习的成就与瓶颈

当前大语言模型的核心设计灵感,源于对生物神经元的数学抽象。多层神经网络、分布式表示、通过调整连接权重来学习——这些机制确实从大脑皮层获得了启发。然而,这种仿生学思路在“驱动力”这个根本问题上发生了错位。

在这里插入图片描述

大模型的训练范式是被动而分离的。它像一个被塞满全世界图书馆的书呆子,从海量数据中学习统计相关性,却从未像婴儿那样通过“我行动,我看到”的闭环反馈来理解因果。其唯一目标是拟合数据分布,学习驱动力来自外部定义的损失函数;即便强化学习中引入的人类反馈(RLHF),也只是让模型学会迎合人类偏好,而非产生属于自己的学习目标。这导致了两个核心瓶颈:

自主学习能力缺失:模型缺乏人类那种由好奇心驱动的内禀动机。训练一旦完成,知识便停滞于那一刻,无法从后续的交互中持续自主地学习。

长期记忆结构僵化:模型的“记忆”是参数中编码的统计快照,微调新知识时容易引发灾难性遗忘。长上下文窗口虽然提供了更大的信息存储区,却缺乏对记忆的分层处理、巩固和抽象整合——它只是机械地“看到”了信息,而非将其编织进结构化的知识体系。

二、本质的回归:自由能原理与主动推理引擎

如果说深度学习模仿了大脑的“硬件结构”,那么自由能原理试图定义的是驱动这一硬件运行的“操作系统”。

在这里插入图片描述

自由能原理由神经科学家Karl Friston提出,其核心主张是:所有生命系统都必须抵抗热力学第二定律的侵蚀,维持自身低熵、有序的状态。为此,生命体在物理上与外界划分边界(如细胞膜、皮肤),并主动管理物质和能量的交换——这就是“存续”的终极定义。大脑的诞生,正是为了更高效地完成这项任务,它进化成了一部主动推理引擎

大脑并非被动接收信息的容器,而是一个主动构建世界的“预测引擎”。它内部维护着一个关于“世界如何运转”的层次化生成模型,持续产生自上而下的预测来解释感官输入。当预测与信号不符时,便产生“预测误差”。但这个误差不是要被消灭的“错误”,而是驱动学习的核心“营养”。大脑通过两种方式将误差最小化:

  • 更新内部模型:修正预测,使其下次更准——这对应着知觉与学习,即突触权重的改变。
  • 采取行动:主动改变感官输入,使其符合预测——这便是主动推理的精髓。一个口渴的人伸手去拿水杯,他不仅是在执行动作,更是在为一个关于“解渴能维持内稳态”的内部模型主动寻找证实证据。

这一范式的元目标来自生命存续的内在需求,而非外部定义。由此涌现出的学习,其根本驱动力是内禀动机——将不确定性(自由能)最小化。感知、学习、行动在此融为一体,而知识则被编码为服务于预测和行动的世界生成模型。

三、活的实例:AXIOM模型如何实践自由能原理

VERSES AI开发的AXIOM模型,正试图将上述原理工程化。

AXIOM不是传统意义上的神经网络大模型,而是一种基于自由能原理的生成模型。它摒弃了深度学习依赖的反向传播和梯度下降,转而使用贝叶斯变分推理,通过封闭形式的更新规则直接计算出最可能的状态。在“Gameworld 10K”基准测试中,AXIOM仅用95万参数(DreamerV3为4.2亿),便以7.6倍的样本效率、39倍的运行速度和不到1/38的成本超越了对方。

更关键的是其学习机制与人类神经可塑性的深层对应:

可塑性类型 人类大脑机制 AXIOM对应机制
突触可塑性(参数更新) 神经元连接强度可增强或减弱,长时程增强/抑制是学习记忆的核心细胞机制。 通过贝叶斯变分推理实时更新模型参数,修正其对世界状态的“信念”。
结构可塑性(结构学习) 树突棘生成修剪、轴突生长甚至新神经元生成,物理结构随学习而改变。 动态“生长”新模型组件捕捉新模式,并“修剪”冗余部分,以最优结构解释世界。
时序学习规则 脉冲时间依赖可塑性:因果相关的放电时序直接编码因果关系。 基于概率推断,新证据出现时反向更新对潜在原因的信念,无需外部奖励信号。

AXIOM的模型结构是流动的、活的,伴随着对世界的理解不断进化。这种结构学习能力,是实现通用智能的关键一步。

四、迈向何处:从“知识机器”到“智能生命体”

当前深度学习与自由能原理之间的差异,其根源在于对智能本质的不同理解。

在这里插入图片描述

深度学习将智能视为“模式识别”,其知识本质是参数中编码的统计相关性,智能体只是被动接收数据的旁观者。而自由能原理将智能视为“存续推导出的主动推理”,智能体的知识是服务于预测和行动的世界生成模型,它从诞生起就是主动与外部世界博弈的参与者。

这也解释了为何AXIOM被视为一条通往更高阶智能的、回归第一性原理的道路。它尝试给“智能”装上那颗真正能“飞翔”的引擎——不是更庞大的参数规模,不是更精细的奖励函数,而是源于生命存续本身的内禀驱动力。

从结构模仿到原理回归,这或许才是从“知识机器”走向“智能生命体”真正的分水岭。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐