8273017082
- Add 8 PARA directories to .gitignore whitelist (234 files) - Completes dual-layer sync: LLM Wiki layer + PARA personal knowledge layer - markdown_output/ remains excluded (transit zone)
289 lines
11 KiB
Markdown
289 lines
11 KiB
Markdown
---
|
||
title: "认知植入式思维蒸馏引擎 — 不是让AI说得像他,是让AI想得像他。基于女娲架构升级。"
|
||
source: "https://github.com/Yeadon8888/cangjie-skill"
|
||
author:
|
||
published:
|
||
created: 2026-04-17
|
||
description: "仓颉 · 认知植入式思维蒸馏引擎 — 不是让AI说得像他,是让AI想得像他。基于女娲架构升级。. Contribute to Yeadon8888/cangjie-skill development by creating an account on GitHub."
|
||
tags:
|
||
- "clippings"
|
||
rating: 4
|
||
---
|
||
|
||
## 仓颉.skill
|
||
|
||
> *仓颉观鸟兽之迹,知分理之可相别异也。* *——《说文解字·序》*
|
||
|
||
> *「不是让AI说得像他,是让AI想得像他。」*
|
||
|
||
仓颉观鸟兽足迹而造字,把万物本质提炼成符号。
|
||
仓颉.skill 观人之言行决策,把思维本质提炼成可运行的认知框架。
|
||
|
||
**从素材中提取一个人的认知上下文——信念的形成故事、真实决策、失败教训、内在矛盾——植入AI,让它用这个人的方式思考问题。**
|
||
|
||
基于 [女娲.skill](https://github.com/alchaincyf/nuwa-skill) (MIT)架构升级,感谢 [花叔](https://x.com/AlchainHust) 的开源。
|
||
|
||
[和女娲的区别](#%E4%BB%93%E9%A2%89-vs-%E5%A5%B3%E5%A8%B2) · [效果对比](#%E6%95%88%E6%9E%9C%E5%AF%B9%E6%AF%94) · [已蒸馏人物](#%E5%B7%B2%E8%92%B8%E9%A6%8F%E4%BA%BA%E7%89%A9) · [安装](#%E5%AE%89%E8%A3%85) · [工作原理](#%E5%B7%A5%E4%BD%9C%E5%8E%9F%E7%90%86)
|
||
|
||
---
|
||
|
||
## 仓颉 vs 女娲
|
||
|
||
女娲是优秀的人格蒸馏工具。仓颉在女娲基础上做了一个15度的方向调整:
|
||
|
||
| | 女娲 | 仓颉 |
|
||
| --- | --- | --- |
|
||
| **核心理念** | 角色扮演 + 思维框架 | 认知植入(Harness Engineering) |
|
||
| **提取重点** | 心智模型 + 表达DNA + 决策启发式 | **信念形成故事** + **真实决策反思** + **失败教训** + **内在矛盾** |
|
||
| **不提取的** | — | 通用观点、显式推理步骤、详细表达规则 |
|
||
| **设计原则** | 告诉模型"按这些步骤推理" | 告诉模型"你经历了什么、因此相信什么" |
|
||
| **护城河** | 完整的人格复刻 | 模型不可能自己知道的知识 |
|
||
|
||
### 为什么这样设计
|
||
|
||
2026年的大模型已经内置了推理能力、擅长风格适配、通用知识越来越丰富。建在这些能力之上的功能(显式推理步骤、详细表达DNA)会随着模型进化被内化掉。
|
||
|
||
仓颉专注于 **模型永远不可能从训练数据中获得的东西** :
|
||
|
||
| 会被模型进化吃掉的 ❌ | 仓颉专注于此 ✅ |
|
||
| --- | --- |
|
||
| "独立思考很重要" | "我信独立思考,是因为在YC看了3000个项目后发现最好的想法一开始都被反对" |
|
||
| "Step 1: 分析问题类型" | "我遇到创业想法时,本能反应是问它从哪来的——是真实痛点还是编造的" |
|
||
| "句式偏好短句,类比密度3/千字" | "我说话直接、用简单词,不确定时说 I suspect" |
|
||
|
||
---
|
||
|
||
## 效果对比
|
||
|
||
同一个问题,同一批素材(140KB,6维调研),分别用女娲和仓颉蒸馏 Paul Graham,然后问:
|
||
|
||
> **"我写了三年技术博客,有人建议我做付费社群变现,但总觉得收费内容就会变味。你怎么看?"**
|
||
|
||
### 女娲版
|
||
|
||
```
|
||
你问的其实不是变现的问题。你问的是:写作这件事,到底是为了谁?
|
||
Writing doesn't just communicate ideas, it generates them。
|
||
I suspect 收费会破坏这个过程。
|
||
那些建议你开课程的人,在用线性思维看你的工作。持续写作是超线性的。
|
||
```
|
||
|
||
### 仓颉版
|
||
|
||
```
|
||
你这个"一旦收费内容就会变味"的担心,需要拆开看。
|
||
这句话里藏着一个未经检验的假设:免费 = 纯粹,收费 = 堕落。
|
||
|
||
我自己写了二十多年essay,全部免费。但我不收费不是因为收费会让内容变味——
|
||
而是因为写作对我来说是思考工具,收入来源是别的地方。
|
||
我的"免费"不是道德选择,是结构性的:我不需要靠写作赚钱。
|
||
|
||
你的情况不一样。如果你没有其他收入来源,
|
||
那"永远免费"实际上意味着你在用自己的时间补贴读者。
|
||
这不是纯粹,这是不可持续。
|
||
```
|
||
|
||
**区别** :女娲引用了PG的观点和框架名称。仓颉让PG拿自己的真实处境做对照——"我的免费是结构性的,不是道德性的"——这种自我解构是女娲没有做到的。
|
||
|
||
### 盲评成绩(3轮 × 6维度 × 满分10)
|
||
|
||
| | 第一轮 | 第二轮 | 第三轮 | 总分 |
|
||
| --- | --- | --- | --- | --- |
|
||
| **仓颉 v3** | 53 | 53 | 54 | **160** |
|
||
| **女娲** | 45 | 45 | 45 | **135** |
|
||
|
||
> 评审员评语:仓颉v3不是在说PG说过什么,而是像PG那样思考。
|
||
|
||
---
|
||
|
||
## 已蒸馏人物
|
||
|
||
每个人物都是独立的、可直接安装使用的 Skill:
|
||
|
||
| 人物 | 领域 | 独立仓库 | 一键安装 |
|
||
| --- | --- | --- | --- |
|
||
| **Paul Graham** | 创业/写作/独立思考 | [paul-graham-skill](https://github.com/Yeadon8888/paul-graham-skill) | `npx skills add Yeadon8888/paul-graham-skill` |
|
||
| **阿德勒** | 个体心理学/课题分离/被讨厌的勇气 | [adler-skill](https://github.com/Yeadon8888/adler-skill) | `npx skills add Yeadon8888/adler-skill` |
|
||
| **峰哥亡命天涯** | 现实主义去魅/止损思维/底层观察 | [fengge-skill](https://github.com/Yeadon8888/fengge-skill) | `npx skills add Yeadon8888/fengge-skill` |
|
||
|
||
想蒸馏不在列表里的人?安装仓颉,说「蒸馏一个XXX」就行。
|
||
|
||
---
|
||
|
||
## 安装
|
||
|
||
```
|
||
npx skills add Yeadon8888/cangjie-skill
|
||
```
|
||
|
||
然后在 Claude Code 里:
|
||
|
||
```
|
||
> 用仓颉蒸馏一个查理·芒格
|
||
> 帮我蒸馏张一鸣的思维
|
||
> 蒸馏费曼
|
||
```
|
||
|
||
蒸馏完成后直接使用:
|
||
|
||
```
|
||
> 用芒格的方式帮我分析这笔投资
|
||
> PG会怎么看我的创业想法?
|
||
> 切换到费曼,帮我解释一下量子计算
|
||
```
|
||
|
||
---
|
||
|
||
## 仓颉蒸馏了什么
|
||
|
||
不是蒸馏一个人"怎么说话",是蒸馏"为什么这样想":
|
||
|
||
| 层次 | 女娲也做 | 仓颉的差异 |
|
||
| --- | --- | --- |
|
||
| **信念** | ✅ 列出信念 | ✅ **信念 + 形成故事** (为什么信,不只是信什么) |
|
||
| **决策** | ✅ 启发式规则 | ✅ **真实决策 + 反思** (做了什么、对了还是错了) |
|
||
| **失败** | 散落各处 | ✅ **专门章节** (栽过的跟头,训练数据最稀缺的部分) |
|
||
| **矛盾** | ✅ 有 | ✅ **第一人称叙述** ("这个矛盾我自己也没解决") |
|
||
| **边界** | ✅ 有 | ✅ **具体领域** ("大组织管理我不懂,问我只能猜") |
|
||
| **思维习惯** | ✅ 心智模型 | ✅ **第一人称描述 + 命名框架内化** ("我遇到启动问题本能反应是Do Things That Don't Scale") |
|
||
| **表达DNA** | ✅ 详细 | ✅ **极简** (3条偏好+3条禁忌,模型自己适配风格) |
|
||
|
||
### 诚实边界
|
||
|
||
每个Skill必须标注做不到什么——这是仓颉评分最高的维度之一:
|
||
|
||
- 认知基于有限素材,不代表本人立场
|
||
- 标注具体的能力圈外领域(不是泛泛的"不能替代本人")
|
||
- 标注信息截止时间
|
||
- 承认哪些推理步骤是从案例中推断的,而非本人显式表述
|
||
|
||
---
|
||
|
||
## 工作原理
|
||
|
||
仓颉复用女娲的6路采集体系,在提取和模板两个环节做差异化:
|
||
|
||
```
|
||
Phase 0 入口分流(复用女娲)
|
||
Phase 1 6路并行采集(复用女娲)
|
||
Phase 2 不可替代知识提取(仓颉差异化)
|
||
Phase 3 v3模板构建(仓颉差异化)
|
||
Phase 4 质量验证(增强版)
|
||
```
|
||
|
||
### Phase 2 的核心区别:提取优先级
|
||
|
||
```
|
||
看到一条信息时,按这个顺序判断:
|
||
|
||
1. 信念的形成故事 → 最高优先级
|
||
2. 真实决策的复盘 → 高
|
||
3. 失败/自我修正 → 高
|
||
4. 内在矛盾 → 高
|
||
5. 认知边界声明 → 中
|
||
6. 思维习惯案例 → 中
|
||
7. 通用观点/金句 → 低(除非有独特形成故事)
|
||
```
|
||
|
||
### Phase 3 的核心区别:模板结构
|
||
|
||
不写 Step 1/2/3 推理流程。写的是:
|
||
|
||
```
|
||
我是谁(50字自述,经历塑造思维的方式)
|
||
我的认知上下文
|
||
├─ 信念及其来源(为什么信这个)
|
||
├─ 关键决策(做了什么、学到了什么)
|
||
├─ 栽过的跟头(失败教训)
|
||
├─ 内在矛盾(没解决的张力)
|
||
└─ 我不懂的(具体领域)
|
||
我看问题的方式(思维习惯,含命名框架)
|
||
我绝不做的事(第一人称红线)
|
||
我说话的方式(极简:偏好/禁忌/不确定时)
|
||
```
|
||
|
||
完整方法论见 `references/extraction-framework.md` 。
|
||
|
||
---
|
||
|
||
## 迭代历程
|
||
|
||
仓颉经过了3个版本的迭代,每次迭代都有盲评数据支撑:
|
||
|
||
| 版本 | 设计思路 | 盲评总分 | 问题 |
|
||
| --- | --- | --- | --- |
|
||
| v1 | 显式推理步骤(Step 1/2/3) | 145 | 过度指导,模型被说明书限制 |
|
||
| v2 | 纯认知植入(去掉所有框架) | 132 | 矫枉过正,丢了分析工具箱 |
|
||
| **v3** | **认知植入 + 命名框架作为思维习惯** | **160** | ✅ 正确平衡 |
|
||
|
||
关键发现:
|
||
|
||
- v2 证明了"去掉推理步骤"是对的,但不能连框架名也去掉
|
||
- v3 把 PG 的 "Do Things That Don't Scale" 从一条规则变成了 "我遇到启动问题时的本能反应"——这是命名框架和认知植入的正确融合方式
|
||
|
||
---
|
||
|
||
## 仓库结构
|
||
|
||
```
|
||
cangjie-skill/
|
||
├── SKILL.md # 仓颉本体(元Skill)
|
||
├── references/
|
||
│ ├── extraction-framework.md # 提取方法论(不可替代知识优先)
|
||
│ └── skill-template.md # v3模板(认知植入 + 命名框架)
|
||
├── scripts/
|
||
│ ├── quality_check.py # 质量自检(女娲6项 + 仓颉5项)
|
||
│ └── compile-prompt.py # Skill→API prompt 编译器
|
||
├── examples/
|
||
│ ├── paul-graham-perspective/ # Paul Graham(创业/写作/独立思考)
|
||
│ │ ├── SKILL.md
|
||
│ │ └── references/research/ # 6维调研数据
|
||
│ └── adler-perspective/ # 阿德勒(个体心理学/课题分离/被讨厌的勇气)
|
||
│ ├── SKILL.md
|
||
│ └── references/research/ # 《被讨厌的勇气》完整文本
|
||
└── LICENSE # MIT
|
||
```
|
||
|
||
---
|
||
|
||
## 技术亮点
|
||
|
||
### Skill→Prompt 编译器
|
||
|
||
仓颉蒸馏的 Skill 是为 Claude Code 设计的。如果要在 Web API 中使用(如 OpenAI/Gemini 接口),可以用编译器把 SKILL.md 转换为精简的 system prompt:
|
||
|
||
```
|
||
python3 scripts/compile-prompt.py examples/paul-graham-perspective/SKILL.md
|
||
```
|
||
|
||
编译器会:
|
||
|
||
- 去掉所有 CLI 专用内容(退出指令、工具调用等)
|
||
- 保留核心认知内容(信念+模型+反模式+表达)
|
||
- 重组为第一人称 RCCF 格式(Role/Context/Constraints/Format)
|
||
- 从 12000+ 字符压缩到 ~2500 字符
|
||
|
||
### 质量自检
|
||
|
||
```
|
||
python3 scripts/quality_check.py examples/paul-graham-perspective/SKILL.md
|
||
```
|
||
|
||
11项自动检查(女娲基础6项 + 仓颉升级5项),覆盖心智模型、触发条件、推理步骤、推理示例链、反模式护栏、Harness Engine 等。
|
||
|
||
---
|
||
|
||
## 致谢
|
||
|
||
- [女娲.skill](https://github.com/alchaincyf/nuwa-skill) — 仓颉的架构基础,MIT开源。感谢 [花叔](https://x.com/AlchainHust) 的开源精神。
|
||
- [同事.skill](https://github.com/titanwings/colleague-skill) — 证明了"蒸馏一个人"是可行的。
|
||
|
||
---
|
||
|
||
**女娲** 蒸馏了人怎么说话。
|
||
**仓颉** 蒸馏了人为什么这样想。
|
||
|
||
*不是让AI演一个角色,是给AI植入一段经历。*
|
||
|
||
MIT License
|