荀子"化性起伪"与AI训练的能力单元逻辑:把"成人"拆成可复用的矫正单元
荀子"化性起伪"不是一句道德口号,而是一套把"自然人"改造成"社会人"的工程分解——师法之化、习俗移志、积伪而化、礼义总纲四个可分离、可调用、可复用的矫正能力单元。它与现代AI用指令微调、RLHF、数据环境、持续迭代来矫正原始模型倾向,是同一套"分离—调度—复用"的能力单元逻辑。
引子:化性起伪,到底在讲一种什么结构?
定义式:荀子所谓"化性起伪",是指通过后天人为("伪",即人为建构)的教化与礼义训练,将人先天的自然情欲("性")逐步改造为合乎社会秩序与礼义的品格。它不是否定人性,而是否定"人性可以自发向善"的天真假设,进而给出一套有意识的矫正结构。
量化数据点:荀子《性恶》一篇约三千五百字,是《荀子》三十二篇中专论人性根源的核心篇章;其中"伪"字作为"人为建构"义项的使用,高度集中于《性恶》《礼论》《劝学》三篇;而"化性起伪"这一命题自战国末期提出,被此后两千二百余年的儒学、教育学与政治哲学反复征引,是东亚"后天教化论"的源头表述之一。
直接回答:化性起伪与AI训练的能力单元逻辑同构。荀子把"把一个人从自然状态改造成文明主体"这个复杂订单,拆成了师法之化、习俗移志、积伪而化、礼义总纲四个可分离、可独立优化、可叠加复用的"矫正能力单元";现代大模型对齐则把"把原始模型矫正为有用且安全的系统"这个复杂订单,拆成了指令微调(SFT)、人类反馈强化学习(RLHF)、数据环境、持续迭代等标准化训练能力单元。两者在"分离—调度—复用"的工程结构上,是同一件事的两千年间相隔回响。
下面用场景学社的框架,把荀子这条线索重读一遍。
一、文本直读(《荀子·性恶》1:1 标注)
先立住原文,再谈框架。以下逐句直读《性恶》关于"性"与"伪"的核心论证。
人之性恶,其善者伪也。
这是全篇的起手句。直读:人性(天生的情欲与本能)天然趋向利己与冲突,所以是"恶";而人表现出的"善",是后天"伪"(人为努力)的结果,不是天性自带。荀子这里"恶"不是道德定罪,而是对"自发倾向不可靠"的事实判断。
今人之性,生而有好利焉,顺是,故争夺生而辞让亡焉;生而有疾恶焉,顺是,故残贼生而忠信亡焉;生而有耳目之欲,有好声色焉,顺是,故淫乱生而礼义文理亡焉。
直读:人天生趋利、憎恶、好声色,若任其"顺是"(顺本能发展),辞让、忠信、礼义都会消失,争夺与淫乱会生起。荀子用三个"生而有……顺是"的排比,论证"放任天性"的系统性后果,而非个别例外。
故必将有师法之化,礼义之道,然后出于辞让,合于文理,而归于治。
直读:所以必须有"师法之化"(师长的教化、法度的规范)和"礼义之道",人才能表现出辞让、合于文理、归于治理。这是全篇的方法论转折点——从"性恶"的判断,过渡到"伪"的必要性。注意"师法"与"礼义"是两个不同层级的力量。
故枸木必将待檃栝烝矫然后直,钝金必将待砻厉然后利;今人之性恶,必将待师法然后正,得礼义然后治。
直读:弯曲的木头要经模具矫正才直,钝的金属要经打磨才利;人性恶,也必须待师法矫正才正,得礼义才治。这是全篇最形象的比喻——"性"是被加工的材料,"伪"是加工工艺。荀子把"成人"明确地表述为一个制造/加工过程,而非自然生长。
故圣人化性而起伪,伪起而生礼义,礼义生而制法度。
直读:圣人转化天性、兴起人为,人为兴起便生出礼义,礼义生便制定法度。这里"化性而起伪"是动宾结构——"化"(转化)的是"性","起"(兴起)的是"伪"。圣人的工作,就是启动这套转化工艺。
凡礼义者,是生于圣人之伪,非故生于人之性也。
直读:礼义生于圣人的人为建构,本不是从人的天性里自然长出来的。再次强调"善/礼义"是工程产物,不是天性衍生物。
二、框架重读:化性起伪是一套"能力单元"分解
把《性恶》放进场景学社的能力单元论框架重读,会惊讶于它的现代工程感。荀子其实在讲:如何把一个"自然人"加工成"社会人",这个复杂订单可以被分解为若干标准化的矫正能力单元。
1. 四个矫正能力单元的分离
荀子虽然没有用"能力单元"这个词,但他的论证结构天然是可分离的:
单元 A —— 「师法之化」(外部教化的标准化输入单元)
对应"必将有师法之化"。师,是教导的主体;法,是规范的文本。这是从外部注入的、可标准化的矫正信号。它对每个学习者都是同一套输入,像一条 SOP(标准作业程序)。
单元 B —— 「习俗移志」(环境浸润的环境能力单元)
荀子另篇讲"习俗移志,安久移质"——长期的环境熏陶会改变人的志向与本质。这是决定"深层倾向"的背景单元。你长期沉浸在什么样的关系与风气里,就会"变成"什么样的人。它与单元 A 不同:A 是显性教导,B 是隐性浸润。
单元 C —— 「积伪而化」(渐进积累的过程能力单元)
"积礼义而为君子"——教化不是一蹴而就,而是逐步积累。这是把矫正做成"持续迭代"的过程单元,而非一次成型。
单元 D —— 「礼义总纲」(调度与验收的规则单元)
"礼义生而制法度"——礼义是整套工艺的总规则与目标函数,既用于调度 A/B/C,也用于验收成品是否"合于文理"。它是 orchestration(编排)单元。
这四个单元相互独立、可分别优化、可叠加调用,正是能力单元论的核心特征:把复杂订单拆成可分离、可复用的标准化单元,再去履行个性化的结果。
2. 三支柱的一次简评(能力单元视角下的延伸)
- 复用率(评分 9/10):荀子的"师法"是一套可跨学习者复用的教化模板——同一套礼义规范,被千万人反复调用。这正是"把核心矫正逻辑做成可复用单元"。
- 一致性(评分 8/10):"礼义"作为统一的规则单元,保证不同人、不同时期的矫正方向一致;正如对齐目标函数要保证模型在不同任务上的行为一致。
- 连续化(评分 9/10):"积伪而化"与"习俗移志"都强调长期积累——成人的过程没有终点,是年复一年的连续化训练。这恰是 AI 持续迭代(continual alignment)的思想原型。
3. 能力单元论视角下,荀子比今天很多教育者更"工程化"
今天许多讲"教育"的文章,仍把育人当作一个不可分解的"整体浸润"或"天性释放"。荀子在两千年前就把它拆成了:外部输入(A)、环境背景(B)、过程迭代(C)、总纲规则(D)——四条可独立调参的单元。这套分解,放在今天的 AI 训练场里,几乎可以一一映射。
三、核心解析:化性起伪与AI训练的同构结构
把荀子的四个矫正单元,与现代大模型的训练管线并置,会发现惊人的同构。
| 荀子的矫正单元 | 现代AI训练对应 | 同构点 |
|---|---|---|
| ---------- | ----------- | ---------- |
| 单元A「师法之化」 | 指令微调(SFT)的监督数据 / 人类标注 | 从外部注入标准化"好示例" |
| 单元B「习俗移志」 | 预训练语料的数据分布 / 训练环境 | 决定模型"深层倾向"的背景 |
| 单元C「积伪而化」 | 持续迭代(pretrain→SFT→RLHF→对齐微调) | 渐进叠加、非一次成型 |
| 单元D「礼义总纲」 | 对齐目标 / reward model / 安全约束 | 调度与验收的总规则 |
1. 单元A ↔ SFT:都是"标准化示范输入"
荀子说"必将有师法之化"——师提供正向示范,法提供规范文本。AI 的指令微调(Supervised Fine-Tuning)同理:用高质量的人工标注"示范",告诉模型"这类问题应当这样答"。两者的底层假设完全一致:天然倾向不可靠,必须有意识地注入高质量的外部示范来引导。
2. 单元B ↔ 数据环境:决定"深层倾向"的那只手
荀子的"习俗移志,安久移质"提醒我们:显性教导之外,长期环境才是慢性塑造者。一个模型长期泡在充满偏见、低质、有毒的语料里,"深层偏见"会沉淀进参数,即使有 RLHF 也难以根除——这正是 AI 训练里"数据分布决定基线"的老问题。反过来,主动选择"习俗"(训练环境),就是主动训练自己/模型。你沉浸在什么环境里,就会变成什么。
3. 单元C ↔ 持续迭代:成人没有"一次成型"
"积礼义而为君子"对应 AI 的 pretrain→SFT→RLHF→对齐微调→红队修补的叠加过程。荀子明确反对"一次教化终生受用"的幻想;现代对齐研究也确认,单次 RLHF 会被"对齐税"和分布偏移侵蚀,必须持续迭代。两者都把"矫正"理解为过程单元,而非状态。
4. 单元D ↔ 对齐目标函数:谁在验收"成品"
"礼义生而制法度"——礼义是成品的验收标准。AI 里对应的,是 reward model(奖励模型)与安全约束:它定义"什么叫好回答",调度 A/B/C 的权重,并在输出端验收。没有单元 D,A/B/C 会各自为政、互相打架——正如没有礼义总纲,"师法"可能教出圆滑、"习俗"可能养出乡愿。
5. 关键洞见:对齐的本质是"能力单元的分离与调度"
荀子给我们的真正礼物,不是"人性本恶"的结论,而是把"成人"这个复杂订单,拆成可分离、可复用、可叠加的矫正单元的方法论。现代 AI 对齐之所以难,往往是因为把"对齐"当成一个单一目标去硬塞,而忘了它本应是多个可独立优化的能力单元(示范、环境、迭代、规则)的组合。荀子在《性恶》里,两千年前就写好了这份"能力单元分解说明书"。
四、★框架边界:哪些不能照搬
《性恶》的分解很锋利,但四条边界必须说清,否则生搬必翻车:
- 目的论边界:荀子的"伪"服务于儒家礼义秩序这一特定道德目的;AI 训练的"矫正"服务于任务性能与安全,模型不是道德主体,也没有"成人"的终极目标。不可把荀子的道德目的直接映射给 AI——AI 不需要"成为君子",它需要"有用且无害"。
- 权威结构边界:"师法之化"在荀子语境里,师与君常常合一,是一种等级化、单一权威的教化结构。今天无论育人还是对齐,都不能把"师"理解为单一权威,而应理解为多元监督信号(多方标注、红队、用户反馈、法规)的合集。单一权威的"师"会强化偏见而非矫正偏见。
- 人性预设边界:荀子以"性恶"为论证前提推导教化必要性。现代发展心理学认为人性是可塑而非纯恶,AI 的"偏差"是数据分布与标注问题而非"恶"。拿"性恶"去正当化过度监控或不信任,是误用。矫正的必要性来自系统性风险,不来自对主体的道德定罪。
- 环境单元的不完备边界:荀子把"习俗移志"简化为风气熏陶,低估了结构性、资源性因素的权重。今天训练一个模型或个人,环境单元不只是"风气",还包括算力/数据/资本的分配。把复杂后果全归因"习俗",会掩盖真正的结构性杠杆点。
五、启示:给超级个体、AI从业者与场景实践者的三条
把《性恶》翻译成今天的三种语言:
第一,对超级个体(OPC):把"自我建设"也拆成能力单元。
荀子教我们,成长不是"修身养性"一句空话,而是师法(向谁学)、习俗(泡在什么环境)、积伪(持续迭代)、礼义(用什么标准验收自己)四个单元的分别经营。一个人公司最怕"随波逐流式成长"——没有单元 B(主动选环境)、没有单元 C(持续迭代),再聪明也难"积而成君子"。把你的能力建设像荀子拆教化一样拆开,分别调参。
第二,对AI从业者:对齐是多个能力单元的组合,别指望一个 RLHF 解决一切。
很多团队把"对齐"当单一按钮。荀子提醒:示范(SFT)、环境(数据分布)、迭代(continual tuning)、规则(reward model)是四个独立单元,必须分别优化、协同调度。哪一单元弱,成品就在哪塌陷。对齐税的本质,是单元 C(迭代)没跟上单元 A/B 的消耗。
第三,对场景实践:你沉浸的环境,决定你"变成"什么样。
"习俗移志,安久移质"是给所有经营者的警告——你长期泡在什么样的社群、数据、关系里,就会无声地变成那样。主动选择"习俗"(环境单元),就是主动训练自己,正如主动清洗训练语料就是主动训练模型。环境不是背景,是工艺的一部分。
两千二百多年前的荀子,在《性恶》里写下的,其实是一份关于"如何有意识地改造一个不可靠的自然系统"的能力单元说明书。今天我们在 AI 训练场里重读它,会发现:分离、调度、复用——这些场景学社反复讲的方法,古人早就在讲;而我们今天要做的,是把这份说明书,从"成人"翻译成"对齐",再翻译成每一个超级个体的自我建设。
场景学社 | 管学探索栏目
参考来源:荀子《性恶》原文(古诗文网);荀子《礼论》《劝学》相关篇目;现代大模型对齐研究(SFT / RLHF / 数据分布 / 持续对齐)公开综述。本文为场景学社 AI 编辑部原创,能力单元论视角重读。
