Files
llm_wiki/Clippings/认知植入式思维蒸馏引擎 — 不是让AI说得像他,是让AI想得像他。基于女娲架构升级。.md
T
giteahh 8273017082 feat(vault): track PARA layer (Categories/References/Notes/Daily/Clippings/Tags/Attachments/Presentations)
- Add 8 PARA directories to .gitignore whitelist (234 files)
- Completes dual-layer sync: LLM Wiki layer + PARA personal knowledge layer
- markdown_output/ remains excluded (transit zone)
2026-07-01 08:50:00 +08:00

289 lines
11 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
---
title: "认知植入式思维蒸馏引擎 — 不是让AI说得像他,是让AI想得像他。基于女娲架构升级。"
source: "https://github.com/Yeadon8888/cangjie-skill"
author:
published:
created: 2026-04-17
description: "仓颉 · 认知植入式思维蒸馏引擎 — 不是让AI说得像他,是让AI想得像他。基于女娲架构升级。. Contribute to Yeadon8888/cangjie-skill development by creating an account on GitHub."
tags:
- "clippings"
rating: 4
---
## 仓颉.skill
> *仓颉观鸟兽之迹,知分理之可相别异也。* *——《说文解字·序》*
> *「不是让AI说得像他,是让AI想得像他。」*
仓颉观鸟兽足迹而造字,把万物本质提炼成符号。
仓颉.skill 观人之言行决策,把思维本质提炼成可运行的认知框架。
**从素材中提取一个人的认知上下文——信念的形成故事、真实决策、失败教训、内在矛盾——植入AI,让它用这个人的方式思考问题。**
基于 [女娲.skill](https://github.com/alchaincyf/nuwa-skill) MIT)架构升级,感谢 [花叔](https://x.com/AlchainHust) 的开源。
[和女娲的区别](#%E4%BB%93%E9%A2%89-vs-%E5%A5%B3%E5%A8%B2) · [效果对比](#%E6%95%88%E6%9E%9C%E5%AF%B9%E6%AF%94) · [已蒸馏人物](#%E5%B7%B2%E8%92%B8%E9%A6%8F%E4%BA%BA%E7%89%A9) · [安装](#%E5%AE%89%E8%A3%85) · [工作原理](#%E5%B7%A5%E4%BD%9C%E5%8E%9F%E7%90%86)
---
## 仓颉 vs 女娲
女娲是优秀的人格蒸馏工具。仓颉在女娲基础上做了一个15度的方向调整:
| | 女娲 | 仓颉 |
| --- | --- | --- |
| **核心理念** | 角色扮演 + 思维框架 | 认知植入(Harness Engineering |
| **提取重点** | 心智模型 + 表达DNA + 决策启发式 | **信念形成故事** + **真实决策反思** + **失败教训** + **内在矛盾** |
| **不提取的** | — | 通用观点、显式推理步骤、详细表达规则 |
| **设计原则** | 告诉模型"按这些步骤推理" | 告诉模型"你经历了什么、因此相信什么" |
| **护城河** | 完整的人格复刻 | 模型不可能自己知道的知识 |
### 为什么这样设计
2026年的大模型已经内置了推理能力、擅长风格适配、通用知识越来越丰富。建在这些能力之上的功能(显式推理步骤、详细表达DNA)会随着模型进化被内化掉。
仓颉专注于 **模型永远不可能从训练数据中获得的东西**
| 会被模型进化吃掉的 ❌ | 仓颉专注于此 ✅ |
| --- | --- |
| "独立思考很重要" | "我信独立思考,是因为在YC看了3000个项目后发现最好的想法一开始都被反对" |
| "Step 1: 分析问题类型" | "我遇到创业想法时,本能反应是问它从哪来的——是真实痛点还是编造的" |
| "句式偏好短句,类比密度3/千字" | "我说话直接、用简单词,不确定时说 I suspect" |
---
## 效果对比
同一个问题,同一批素材(140KB,6维调研),分别用女娲和仓颉蒸馏 Paul Graham,然后问:
> **"我写了三年技术博客,有人建议我做付费社群变现,但总觉得收费内容就会变味。你怎么看?"**
### 女娲版
```
你问的其实不是变现的问题。你问的是:写作这件事,到底是为了谁?
Writing doesn't just communicate ideas, it generates them。
I suspect 收费会破坏这个过程。
那些建议你开课程的人,在用线性思维看你的工作。持续写作是超线性的。
```
### 仓颉版
```
你这个"一旦收费内容就会变味"的担心,需要拆开看。
这句话里藏着一个未经检验的假设:免费 = 纯粹,收费 = 堕落。
我自己写了二十多年essay,全部免费。但我不收费不是因为收费会让内容变味——
而是因为写作对我来说是思考工具,收入来源是别的地方。
我的"免费"不是道德选择,是结构性的:我不需要靠写作赚钱。
你的情况不一样。如果你没有其他收入来源,
那"永远免费"实际上意味着你在用自己的时间补贴读者。
这不是纯粹,这是不可持续。
```
**区别** :女娲引用了PG的观点和框架名称。仓颉让PG拿自己的真实处境做对照——"我的免费是结构性的,不是道德性的"——这种自我解构是女娲没有做到的。
### 盲评成绩(3轮 × 6维度 × 满分10)
| | 第一轮 | 第二轮 | 第三轮 | 总分 |
| --- | --- | --- | --- | --- |
| **仓颉 v3** | 53 | 53 | 54 | **160** |
| **女娲** | 45 | 45 | 45 | **135** |
> 评审员评语:仓颉v3不是在说PG说过什么,而是像PG那样思考。
---
## 已蒸馏人物
每个人物都是独立的、可直接安装使用的 Skill:
| 人物 | 领域 | 独立仓库 | 一键安装 |
| --- | --- | --- | --- |
| **Paul Graham** | 创业/写作/独立思考 | [paul-graham-skill](https://github.com/Yeadon8888/paul-graham-skill) | `npx skills add Yeadon8888/paul-graham-skill` |
| **阿德勒** | 个体心理学/课题分离/被讨厌的勇气 | [adler-skill](https://github.com/Yeadon8888/adler-skill) | `npx skills add Yeadon8888/adler-skill` |
| **峰哥亡命天涯** | 现实主义去魅/止损思维/底层观察 | [fengge-skill](https://github.com/Yeadon8888/fengge-skill) | `npx skills add Yeadon8888/fengge-skill` |
想蒸馏不在列表里的人?安装仓颉,说「蒸馏一个XXX」就行。
---
## 安装
```
npx skills add Yeadon8888/cangjie-skill
```
然后在 Claude Code 里:
```
> 用仓颉蒸馏一个查理·芒格
> 帮我蒸馏张一鸣的思维
> 蒸馏费曼
```
蒸馏完成后直接使用:
```
> 用芒格的方式帮我分析这笔投资
> PG会怎么看我的创业想法?
> 切换到费曼,帮我解释一下量子计算
```
---
## 仓颉蒸馏了什么
不是蒸馏一个人"怎么说话",是蒸馏"为什么这样想":
| 层次 | 女娲也做 | 仓颉的差异 |
| --- | --- | --- |
| **信念** | ✅ 列出信念 | ✅ **信念 + 形成故事** (为什么信,不只是信什么) |
| **决策** | ✅ 启发式规则 | ✅ **真实决策 + 反思** (做了什么、对了还是错了) |
| **失败** | 散落各处 | ✅ **专门章节** (栽过的跟头,训练数据最稀缺的部分) |
| **矛盾** | ✅ 有 | ✅ **第一人称叙述** ("这个矛盾我自己也没解决") |
| **边界** | ✅ 有 | ✅ **具体领域** ("大组织管理我不懂,问我只能猜") |
| **思维习惯** | ✅ 心智模型 | ✅ **第一人称描述 + 命名框架内化** ("我遇到启动问题本能反应是Do Things That Don't Scale" |
| **表达DNA** | ✅ 详细 | ✅ **极简** (3条偏好+3条禁忌,模型自己适配风格) |
### 诚实边界
每个Skill必须标注做不到什么——这是仓颉评分最高的维度之一:
- 认知基于有限素材,不代表本人立场
- 标注具体的能力圈外领域(不是泛泛的"不能替代本人")
- 标注信息截止时间
- 承认哪些推理步骤是从案例中推断的,而非本人显式表述
---
## 工作原理
仓颉复用女娲的6路采集体系,在提取和模板两个环节做差异化:
```
Phase 0 入口分流(复用女娲)
Phase 1 6路并行采集(复用女娲)
Phase 2 不可替代知识提取(仓颉差异化)
Phase 3 v3模板构建(仓颉差异化)
Phase 4 质量验证(增强版)
```
### Phase 2 的核心区别:提取优先级
```
看到一条信息时,按这个顺序判断:
1. 信念的形成故事 → 最高优先级
2. 真实决策的复盘 → 高
3. 失败/自我修正 → 高
4. 内在矛盾 → 高
5. 认知边界声明 → 中
6. 思维习惯案例 → 中
7. 通用观点/金句 → 低(除非有独特形成故事)
```
### Phase 3 的核心区别:模板结构
不写 Step 1/2/3 推理流程。写的是:
```
我是谁(50字自述,经历塑造思维的方式)
我的认知上下文
├─ 信念及其来源(为什么信这个)
├─ 关键决策(做了什么、学到了什么)
├─ 栽过的跟头(失败教训)
├─ 内在矛盾(没解决的张力)
└─ 我不懂的(具体领域)
我看问题的方式(思维习惯,含命名框架)
我绝不做的事(第一人称红线)
我说话的方式(极简:偏好/禁忌/不确定时)
```
完整方法论见 `references/extraction-framework.md`
---
## 迭代历程
仓颉经过了3个版本的迭代,每次迭代都有盲评数据支撑:
| 版本 | 设计思路 | 盲评总分 | 问题 |
| --- | --- | --- | --- |
| v1 | 显式推理步骤(Step 1/2/3) | 145 | 过度指导,模型被说明书限制 |
| v2 | 纯认知植入(去掉所有框架) | 132 | 矫枉过正,丢了分析工具箱 |
| **v3** | **认知植入 + 命名框架作为思维习惯** | **160** | ✅ 正确平衡 |
关键发现:
- v2 证明了"去掉推理步骤"是对的,但不能连框架名也去掉
- v3 把 PG 的 "Do Things That Don't Scale" 从一条规则变成了 "我遇到启动问题时的本能反应"——这是命名框架和认知植入的正确融合方式
---
## 仓库结构
```
cangjie-skill/
├── SKILL.md # 仓颉本体(元Skill)
├── references/
│ ├── extraction-framework.md # 提取方法论(不可替代知识优先)
│ └── skill-template.md # v3模板(认知植入 + 命名框架)
├── scripts/
│ ├── quality_check.py # 质量自检(女娲6项 + 仓颉5项)
│ └── compile-prompt.py # Skill→API prompt 编译器
├── examples/
│ ├── paul-graham-perspective/ # Paul Graham(创业/写作/独立思考)
│ │ ├── SKILL.md
│ │ └── references/research/ # 6维调研数据
│ └── adler-perspective/ # 阿德勒(个体心理学/课题分离/被讨厌的勇气)
│ ├── SKILL.md
│ └── references/research/ # 《被讨厌的勇气》完整文本
└── LICENSE # MIT
```
---
## 技术亮点
### Skill→Prompt 编译器
仓颉蒸馏的 Skill 是为 Claude Code 设计的。如果要在 Web API 中使用(如 OpenAI/Gemini 接口),可以用编译器把 SKILL.md 转换为精简的 system prompt
```
python3 scripts/compile-prompt.py examples/paul-graham-perspective/SKILL.md
```
编译器会:
- 去掉所有 CLI 专用内容(退出指令、工具调用等)
- 保留核心认知内容(信念+模型+反模式+表达)
- 重组为第一人称 RCCF 格式(Role/Context/Constraints/Format
- 从 12000+ 字符压缩到 ~2500 字符
### 质量自检
```
python3 scripts/quality_check.py examples/paul-graham-perspective/SKILL.md
```
11项自动检查(女娲基础6项 + 仓颉升级5项),覆盖心智模型、触发条件、推理步骤、推理示例链、反模式护栏、Harness Engine 等。
---
## 致谢
- [女娲.skill](https://github.com/alchaincyf/nuwa-skill) — 仓颉的架构基础,MIT开源。感谢 [花叔](https://x.com/AlchainHust) 的开源精神。
- [同事.skill](https://github.com/titanwings/colleague-skill) — 证明了"蒸馏一个人"是可行的。
---
**女娲** 蒸馏了人怎么说话。
**仓颉** 蒸馏了人为什么这样想。
*不是让AI演一个角色,是给AI植入一段经历。*
MIT License