对于智能系统,改进(学习)的速度和成本,比运行速度和成本,更加重要。
进化赋予生命智能的方式,最初是靠基因级别的进化,将智能策略硬编码到基因中,其改进周期是十万年级。
大脑出现后,脊柱动物可以从自己的经验中学习(上次让自己痛的地方要回避)。
新皮质出现后,哺乳动物可以靠自己的想象来学习:这个悬崖跳不过去,就将粉身碎骨——如果要靠自身经验来学习,这个学习成本实在难以承担。
再后来,颗粒状前额叶皮质让灵长类动物可以通过向同伴甚至其他动物模仿来学习,更进一步提升了学习的效率,降低了学习的成本。
而人类,可以通过语言这种媒介,来共享和学习知识,大幅提升了智能改进的速度,其改进周期可以到秒/分钟级。
通过知识学到的策略,其运行速度肯定不如刻在基因中的策略,但复杂和多变的环境,更奖励策略改进的速度,而不是策略运行的速度。
正如改进AI产品,可以靠硬编码,也可以靠训练模型,也可以靠优化提示词,还可以靠改进知识,其运行速度依次降低,改进速度和效率依次提升,而环境会奖励更靠后的方式。