判断力的化石
追本之箭 — 判断力的化石

2026-09-09 Wed 15:05
1 LLM 是一个没有边界的函数。它什么都能说,因此什么都没说。
1.1 能力不等于行动。行动需要约束。
2 Skill 是对意图的压缩。
2.1 一个 skill 不增加 LLM 的能力,它削减 LLM 的自由度。
2.2 削减自由度就是赋予方向。方法论的本质不是"多了什么",而是"不再考虑什么"。
2.3 反复调用之所以可能,是因为意图已经脱离了说出它的人。Skill 是意图的脱身态。
2.4 没有 skill 的 LLM,每次对话都从零开始协商"我们在干什么"。Skill 取消了这个协商。
3 Harness 是对能力的赋形。
3.1 LLM 本身不能读文件、不能记忆、不能行动。Harness 把"能说"变成"能做"。
3.2 Harness 划定的不是 LLM 能想什么,而是 LLM 能碰什么。它是感官和肢体,不是大脑。
3.3 没有 harness 的 LLM 是一个困在隔音室里的人:有判断力,无感知,无执行。
4 Skill 约束意图空间,Harness 约束行动空间。二者正交。
4.1 同一个 harness 上可以跑任意 skill——厨房不变,换菜谱。
4.2 同一个 skill 可以迁移到不同 harness——菜谱不变,换厨房。
4.3 但一道菜只在二者交叉处出现。
5 更本质地说:
5.1 Skill 是冻结的 Δf。某人一次想清楚,此后所有人不必再想。
5.2 Harness 是 f 的定义域。没有它,f 无处着落。
5.3 一个 skill 能被写下,说明那个意图可以脱离主体而存活。不能写成 skill 的,叫品味。
5.4 一个 harness 能被替换,说明执行层可以脱离智能而存活。不能脱离的,叫具身。
6 对于不可言说的,必须沉默。但 skill 的意义恰恰在于:把原本不可言说的方法论,逼入可言说的形式。
6.1 这就是 skill 的代价——它保存了方法,丢掉了写下它那一刻的判断力。
6.2 这也是 harness 的代价——它赋予了肢体,但肢体的形状预先决定了哪些动作不可能。
7 Skill 回答"用什么姿势看"。Harness 回答"看得见什么、够得着什么"。LLM 回答"看见之后怎么想"。
7.1 三者缺任何一个,都不构成行动。
一、无界
1 说的是一个没有边界的函数。数学上,定义域为全集的函数不携带信息——它对任意输入都有话说,因此对任何具体输入都无用。裸 LLM 就是这个函数。它的回答在统计上正确,在语境上失焦——因为它不知道你的语境。
能力不等于行动——1.1 的原话。GPT 能写十四行诗也能写部署脚本,但当你说"帮我部署",它先花二十轮协商你要部署什么、用什么工具、部署到哪。2.4 说的协商,每轮对话都在重复支付。一个失忆的全才,记住一切语法却记不住任何约定。每一轮你都在重新教它:部署到 staging、用上次那个脚本、别碰生产环境。下一轮全忘了。
不蠢与聪明里讲过,原则几乎全是负面约束——规定排除项,不规定执行项。这和 2.2 说的"方法论的本质是不再考虑什么"是同一件事。
约束不是行动的障碍,是行动的材料——一个什么都能做的函数,恰恰什么都做不了。
约束从哪来?
二、压缩
2 的回答:Skill 是对意图的压缩。
2.1 说 skill 不增加能力,它削减自由度。拿一条真实 skill 来拆:它删掉了"要不要先给结论"、"字数多少算够"、"格式是散文还是清单"这些选项。这些选项单个不贵,贵在每次都要重新决定。Skill 压掉的是协商成本——每轮重新决定格式、顺序、详略的开销。一个人写 skill 时做的每个微决定——语气用陈述还是祈使、失败路径覆不覆盖、输出在哪里截断——此后所有调用者都继承。
5.1 把这个机制命名:冻结的 Δf。某人一次想清楚,此后所有人不必再想。产品化自己讲的同一件事——把个人方法论变成可交付产品,就是一次性支付思考成本换取无限次复用。
冻结的东西凭什么还能反复用?
三、脱身
凭 2.3 所说的脱身:意图已经脱离了说出它的人。
检验法:把作者请出房间,看 skill 还能不能跑。能跑的部分是 skill,卡住的地方是品味。一个写作 skill 能规定"先给结论、控制在八百字、用清单不用散文",但规定不了什么时候该打破这些规定。打破规则的判断力没法写进规则。同一条 skill 换一个人调用,输出合格但总觉得差点意思。差的那点意思就是品味渗不进去的部分。
5.3 提出区分标准:能写成 skill 的意图可以脱离主体存活;写不成的,叫品味。Skill 是脱身成功的意图,品味是脱身失败的意图。生成里的说法——因你而生,不靠你而活——恰好描述 skill 的存在状态。被创造那一刻依赖创造者,此后独立运行。
品味先按下。意图有了,为什么还动不了?
四、赋形
意图只是函数签名,没有定义域——5.2 的意思。3 给出名字:Harness 是对能力的赋形。
3.1 说 LLM 本身不能读文件、不能记忆、不能行动。Harness 把"能说"变成"能做"。3.2 划的界是"能碰什么",能想什么不归它管。感官和肢体,不是大脑。
定义域的形状决定存在的维度。不能读文件的模型,文件对它不存在——那个维度未被创造。给它接上文件系统,这个维度才出现;给它接上终端,执行才成为可能。每接一个通道,定义域扩一维,通道的形状同时成为约束。3.3 的隔音室指向同一件事:里面的人智力完好,但没有门。环境即算力说的也是这个:环境本身构成能力的物理前提。
两个约束怎么相处?
五、正交
4 说二者正交。意图空间和行动空间是独立的维度。
4.1 和 4.2 用厨房与菜谱说明:同一个 harness 换 skill,同一个 skill 迁到不同 harness。4.3 收紧——一道菜只在交叉处出现。7 拆成三问:Skill 回答用什么姿势看,Harness 回答看得见什么够得着什么,LLM 回答看见之后怎么想。7.1 说三者缺一不构成行动。
乘法。任一项为零全盘归零。零有三种形态:瘫痪——算出该部署哪个分支却没有 SSH,只能念给你听。抽搐——有全部工具没有 skill,读完文件问"接下来干什么"。自动机——cron 按规则跑,永远发现不了规则已经过期。三种零态分别对应缺 Harness、缺 Skill、缺 LLM 的判断力。大多数"AI 不好用"的抱怨,拆开看都是某一项在悄悄归零。
代价呢?
六、代价
6 几乎在改写维特根斯坦《逻辑哲学论》的末句:对于不可言说的,必须沉默。但 skill 的意义恰恰是反向操作——把原本不可言说的方法论逼入可言说的形式。
6.1 说 skill 保存了方法,丢掉了写下它那一刻的判断力。判断力的化石——保留骨骼形状但不能弯曲。你能从化石复原恐龙体型,复原不了它捕猎时的犹豫。6.2 说 harness 赋予了肢体,但肢体形状预先决定了哪些动作不可能。假肢的关节数决定舞姿上限。
感知错误里的论断在这里兑现:数据无法证伪装着它的框架。一条 skill 用了两年没出错,你开始相信它覆盖了全部情况,不再亲手做那件事。它没覆盖的部分你也看不到了。提效工具同时是盲区发生器。
减掉可写的,减掉可换的,剩下什么?
七、余数
5.3 和 5.4 给出两个余数:品味与具身。
品味是减掉一切可编码的意图之后剩下的——你做判断时依赖但写不进 skill 的东西。具身是减掉一切可替换的执行之后剩下的——绑定在特定 harness 上无法迁移的能力。品味标记 skill 的编码极限,具身标记 harness 的替换极限。
机器能做一切可描述的事,除了成为某个人。人在回路里的位置是写下一个 skill 和挑下一个 harness 的人。执行的部分已被接管。决定接下来写哪个 skill、接哪个 harness,这些判断本身无法被编码为 skill。
判断力只在现在时。写下的都是过去时。Skill 库永远在贬值。方法没有过时,变的是写下方法的那个你。你今天读去年写的 skill,觉得哪里不对但说不出哪里,那个"说不出"就是品味的变化量。
审计你的 skill 库。找到那条你还在用但已经在撒谎的化石,重写它。
写得下的都会被反复调用,写不下的才是你。化石是你留下的,活着的是那个每天决定重写哪块化石的人。