人物Skill蒸馏实践指南

人物Skill蒸馏实践指南

把特定人物的思维方式、工作习惯与表达风格封装成 Agent 可调用的Skill,是一条清晰可落地的路径。nuwa-skill、zhangxuefeng-skill 与 colleague-skill 分别对应蒸馏引擎深度成品样板职场同事蒸馏三种形态。下文说明三者关系、共同原理、与知识库/数字人的边界,以及「我要蒸馏一个人该做什么」——含最小样例、失败模式与评测方法。

何时先别蒸馏

情况更合适的做法
只想查事实/接口文档知识库 / RAG,不必上 Persona
语料极少(几条短评、二手八卦)先补一手材料,或缩小到单一决策面
法务/医疗等强合规且未授权脱敏停;走正式知识管理与合规流程
要的是形象陪伴、语音视频数字人界面;Skill 只作可选决策核

深度成品示例里用「张雪峰」仅因其开源样板完整;同一套结构可替换为任意公众人物或主题顾问,不是单一人物推广。


目录

  • 1. 三个仓库分别解决什么问题
  • 2. 演进关系:工厂、深度与广度
  • 3. 共同原理:认知蒸馏而非文档堆砌
  • 4. 与知识库、数字人的边界
  • 5. 如何蒸馏一个人:两条路径
  • 6. 产物结构、触发与归档规范
  • 7. 质量门槛、失败模式与评测
  • 8. 合规与维护
  • 9. 延伸阅读

1. 三个仓库分别解决什么问题

仓库核心定位模拟对象主要数据源典型场景
nuwa-skill通用蒸馏引擎(Meta-Skill)任意公众人物或主题著作、访谈、社交媒体、决策记录;可叠加用户 PDF/字幕「蒸馏芒格」「做一个费曼 skill」
zhangxuefeng-skill深度心智模型成品(结构样板)样例人物多本著作、深度采访、语录与决策案例复杂决策类顾问的目录与写法参考
colleague-skill职场关系数字化同事、前任、老板等飞书/钉钉消息、文档、邮件、PDF、截图CR 习惯、交接上下文、对话风格模拟

1.1 nuwa-skill:人物 Skill 的「工厂」

输入人名或模糊需求(如「我想提升决策质量」),按Phase 0–5执行:澄清需求 → 建自包含目录 →6 路并行调研→ 三重验证提炼心智模型 → 按模板写SKILL.md→ 已知/边缘/风格测试 → 可选双 Agent 精炼。

不通过

不通过

0 澄清需求

1 建目录

2 六路调研

1.5 调研摘要检查

3 提炼心智模型

2.5 提炼摘要检查

4 写 SKILL.md

5 测试与精炼

配套脚本包括字幕下载、merge_research.py汇总调研、quality_check.py自检。examples/内有多份公众人物示例。

1.2 深度成品样板:工厂能产到多深

目标不是语录复读,而是可运行的认知操作系统:若干心智模型、决策启发式、表达 DNA,以及Agentic Protocol(需事实时先查数据再开口)。完整调研材料在references/research/,Skill 目录可独立拷贝。开源的 zhangxuefeng-skill 是这一档的完整实例。

1.3 colleague-skill:从公众人物下沉到职场

采用Work Skill + Persona双轨:

  • Part A(工作能力):负责系统、技术规范、排查流程、输出偏好
  • Part B(人格):表达风格、决策模式、人际行为;运行时「先 Persona 定态度,再 Work 执行」

支持飞书/钉钉自动采集、浏览器读内部文档、手动上传与粘贴;支持追加语料、对话纠偏、版本回滚。


2. 演进关系:工厂、深度与广度

Breadth - 能有多广

Depth - 能有多深

How - 怎么造

同一套提炼思想

证明蒸馏真人可行

nuwa-skill
蒸馏引擎

深度成品样板
如 zhangxuefeng-skill

colleague-skill
职场数字痕迹

角色解决的问题
nuwa-skill从零到可发布 Skill 的流程、模板与质检
深度样板复杂决策逻辑与风格可结构化,而非闲聊仿声
colleague-skill普通人协作痕迹也可变成可调用模块

选型建议

  • 严肃决策参考、公众人物思维顾问 → nuwa 流程 + 深度成品式目录结构
  • 团队传承、离职交接、CR 习惯保留 → colleague-skill
  • 批量造新人物 Skill → 以 nuwa-skill 为主引擎

安装命令因平台而异(例如部分生态提供npx skills add owner/repo);以各仓库 README 与当前 Agent 的 Skill 安装方式为准。


3. 共同原理:认知蒸馏而非文档堆砌

三个项目的共同本质是人格/认知蒸馏:把隐性经验(Tacit Knowledge)通过 LLM + 工程化流程变成结构化、可复用的方法论模块——不是 FAQ 堆砌,而是可 Invoke 的教练

3.1 Skill 里通常有什么

组件含义示例方向
心智模型反复出现的思考框架「先看筛子/约束,再谈努力」
决策启发式可执行的 If-Then「若无法说出中位数结果,则继续调研」
表达 DNA句式、词汇、节奏短句、反问、口语、斩钉截铁
反模式与诚实边界不做什么、何时失效不适用学术路径;信息截止日
Agentic Protocol需事实时先调研再回答先查就业/薪资再给建议

nuwa 强调捕捉HOW they think,不是 WHAT they said 的摘抄;colleague 把「术」(Work)与「道」(Persona)解耦再融合。

3.2 语料权重(输入质量)

优先级类型说明
本人著作、长访谈逐字稿、决策备忘一手、可追溯
演讲字幕、系列短视频合集(需去重)表达 DNA 好,框架易碎
二手解读、剪辑名言、营销文仅作索引,不作主证据
职场特有本人写的设计文档、CR 评论、事故复盘Work 轨的核心

建议一手来源占比>50%;短视频切片再多,也补不上一本系统著作或一次深访。

3.3 最小可运行SKILL.md片段(示意)

下列为结构示意,可直接当写作模板;内容须换成目标人物的证据化条目。

--- name: example-perspective description: > 在职业选择与路径权衡时启用。触发词:志愿、转行、值不值得读研。 用「就业倒推 + 中位数结果」分析;不替代官方政策与持证咨询。 --- # Example Perspective ## 心智模型 ### 就业倒推 先问毕业后岗位与中位数收入,再倒推专业/院校是否匹配。 **失效**:纯学术志趣且不依赖就业回报时不适用。 ## 决策启发式 - IF 说不出该方向的中位数结局 THEN 先调研再给建议 - IF 家庭现金流紧张 THEN 提高「确定性」权重,降低「情怀」权重 ## 表达 DNA 短句;先结论后理由;允许口语与反问;避免空泛励志。 ## 诚实边界 - 信息截止:YYYY-MM;之后政策/行情需现场检索 - 非本人授权;公开言论推断 - 不提供医疗/法律结论 ## Agentic Protocol 涉及具体院校或行业数据时:先检索再回答;检索失败则声明不确定。

description往往比正文长度更影响会不会被自动选中——写清谁、什么场景、什么触发词。

3.4 执行闭环(colleague 示例)

接收任务 → Persona 定态度 → Work Skill 执行 → 带风格的输出

验收时应先测 Work 是否把事做对,再调 Persona 像不像;顺序反了容易得到「很像但没用」的壳。


4. 与知识库、数字人的边界

4.1 Skill vs 知识库

维度知识库人物 Skill
本质存储与检索能力封装与执行
内容静态文档、片段思维模型、决策规则、人格特质
交互返回相关段落以该视角分析或完成任务
输出WhatHow + 风格
人格通常中性可有 Persona

知识库像字典;Skill 像教练。知识库适合「接口文档在哪」;Skill 适合「这个同事会怎么 Review 这段代码」。

4.2 Skill vs 数字人

维度Skill数字人
核心思维与决策(大脑)形象与多模态交互(皮囊)
形态文本指令、Prompt 包、脚本3D/视频/语音 Avatar
目标提效、决策辅助沉浸、陪伴、展示
伦理定位更易视为工具易引发身份混淆

完整「数字分身」往往是:数字人作界面 + Skill 作决策核心。当前三个仓库主要做大脑一侧。


5. 如何蒸馏一个人:两条路径

公众人物 / 可大量检索

同事 / 内部痕迹

要蒸馏谁?

公开人物还是职场同事?

路线 A: nuwa-skill

路线 B: colleague-skill

定人名与聚焦面

准备一手语料

跑 Phase 0–5

产出 name-perspective/SKILL.md

部署到 Agent skills 目录

完成授权与脱敏清单

3 问: 花名 / 岗位 / 性格印象

选原材料渠道

分析 work + persona

确认摘要后写入 colleagues/slug/

通过 description 或 slug 触发

追加语料或纠偏迭代

5.1 路线 A:公众人物(nuwa-skill)

  1. 明确对象:全名或主题;全面画像还是单一维度(如只做投资判断)。
  2. 准备语料(质量关键):书籍 PDF、长访谈 transcript、视频字幕;本地一手材料权重大于纯 Web 搜索。
  3. 触发蒸馏:在已安装 nuwa-skill 的 Agent 中描述目标(如「蒸馏芒格」「造一个 XX 视角 skill」);模糊需求时引擎会先诊断再推荐。
  4. 跟进检查点:Phase 1.5 调研摘要、Phase 2.5 提炼摘要——在此拦截低质量调研比写完再返工便宜。
  5. 部署:将整个 skill 目录(含references/research/)拷到当前 Agent 的 skills 路径(见 §6.3)。

标准目录骨架

{name}-perspective/ ├── SKILL.md ├── scripts/ # 可选 └── references/ ├── research/ # 01-writings … 06-timeline └── sources/ # 用户 PDF、transcript

社区成品可按各仓库说明安装(例如支持 Skill 注册表时的npx skills add …);以 README 为准。

5.2 路线 B:职场同事(colleague-skill)

授权清单(落盘前勾选)

说明
授权范围仅工作相关;是否含私聊/绩效
知情同意当事人或制度允许的采集依据
脱敏手机号、身份证、客户机密已处理
保留期限到期删除或归档策略
存放位置仅私有目录;不进公开远程
  1. 基础信息(3 问):花名/代号;一句话岗位;一句话性格/文化标签。
  2. 原材料渠道
方式说明
飞书/钉钉自动采集需企业应用与相应 token;群聊/私聊权限不同
链接与导出浏览器登录态、文档导出、邮件.eml
上传 / 粘贴PDF、JSON 导出、聊天记录、备忘录
  1. 确认预览:Work 摘要与 Persona 摘要后再落盘。
  2. 进化:新文件 → 增量合并;「他不会这样」→ Correction 并重生SKILL.md;必要时版本回滚。

安装 create-colleague 元 Skill 的方式见其仓库 README(常见为 clone 到本机 skills 目录)。Cursor 中跑tools/下脚本需要终端权限与 Python 依赖(如 playwright),并自行管理 IM 凭证。

5.3 两条路径对比

项目路线 A(nuwa)路线 B(colleague)
典型对象公开可检索的人物/主题离职同事、现任搭档
核心产出单一SKILL.md(含心智模型)work.md+persona.md+ 合并SKILL.md
数据从哪来公开语料 + 可选用户 PDFIM、文档、邮件、主观标签
蒸馏重点跨域心智模型、表达 DNA工作流 + 职场人格
更新方式增量跑调研 Agent追加文件、对话纠偏

6. 产物结构、触发与归档规范

6.1 colleague 生成的同事 Skill

个性化产物通常在colleagues/{slug}/(常 gitignore,适合本地私有):

colleague-skill/ └── colleagues/ └── tianyi/ ├── SKILL.md ├── work.md ├── persona.md ├── meta.json ├── versions/ └── knowledge/

调用形态多为/{slug}/{slug}-work/{slug}-persona(视 Agent 实现而定)。

公众人物成品应放在独立{name}-perspective/或单独仓库——不要放进colleagues/

6.2 nuwa 生成的 perspective Skill

{skillsRoot}/munger-perspective/ ├── SKILL.md └── references/research/

Skill 须自包含:调研文件在 skill 目录内,不依赖外部临时路径。

6.3 安装路径与触发(多环境)

环境常见路径 / 约定
Claude Code~/.claude/skills/;同事产物常在…/create-colleague/colleagues/{slug}/
Cursor用户级 skills 目录,或项目内.cursor/skills/ 团队约定路径(以当前 Cursor 文档为准)
其它 Agent如 OpenClaw 等,见各产品 workspace skills 约定

触发失败时优先查

  1. description是否写清场景与触发词
  2. Skill 是否在 Agent实际扫描的目录内
  3. 名称/slug 是否与调用方式一致
  4. 是否被更高优先级的其它 Skill 抢触发

私有同事 Skill勿 push 到公开远程;原始聊天记录放在knowledge/并脱敏。


7. 质量门槛、失败模式与评测

7.1 质量门槛(静态检查)

检查项通过标准
心智模型数量3–7 个,各有来源证据
局限性每个模型写清失效条件
表达 DNA读约 100 字能辨认风格取向
诚实边界≥3 条具体局限
内在张力≥2 对矛盾(避免「太完美」)
一手来源占比建议 >50%

宁可交付标注了局限的 60 分 Skill,也不要无来源的 90 分编造。

7.2 常见失败模式

翻车表现对策
语录复读只会引用金句,给不出流程强制 If-Then 与失效条件
过度光滑永远正确、无矛盾补内在张力与反模式
一手不足全是二手解读补著作/深访;下调二手权重
Persona 盖过 Work口吻像、事办砸先冻结 Work 验收,再开 Persona
触发失败装了从不被调用重写description;核对扫描路径
过拟合短视频节奏像、框架空提高长文/决策记录占比
越权回答医疗/法律一口咬定诚实边界 + Agentic「先检索/拒答」

7.3 可重复评测(动态)

准备5–10 道黄金题(固定题干,分版本回归):

题型目的
已知区有明确语料支撑,应答出框架与证据
边缘区语料不足,应承认不确定或触发检索
风格题短答是否像目标人物的表达 DNA
反模式题应拒绝或声明不适用的场景

对比测:同一题分别用中性 Agent 与人物 Skill;看差异是否来自方法论,而非多套了几句口头禅。

同事路线:请当事人或熟悉者打两个分——像不像(1–5)有没有用(1–5);「有用」低于 3 分时优先改 Work,而不是加语气词。

先小范围试用(一条 CR、一个志愿问题),再扩场景;用「他不会这样」迭代,比一次灌满材料更稳。


8. 合规与维护

8.1 合规

  • 职场消息、邮件含隐私与劳动合规风险:仅在有授权、脱敏前提下蒸馏。
  • 公众人物 Skill 是公开言论推断,非本人授权代言;须写明边界与调研截止日。
  • 飞书/钉钉自动采集需企业开放平台应用与 scope;token 自行管理,不进仓库。

8.2 维护

  • 活跃公众人物:定期增量更新对话、决策、时间线类调研。
  • 同事 Skill:持续追加文档与纠偏;重大变更前先备份版本。

8.3 落地注意

  • Cursor 与 Claude Code 的 skills 路径、工具集不同;脚本依赖与终端权限按环境配置。
  • description决定触发率;场景与触发词写清楚。
  • Skill 是决策辅助,不能替代持证专业咨询;升学/医疗/法律等以官方与持证意见为准。

9. 延伸阅读

资源说明
nuwa-skill安装、画廊、流程与质检
colleague-skill飞书/钉钉 setup、目录结构
zhangxuefeng-skill深度 perspective 成品与 research 样例
Agent Skills 开放标准Skill 目录与SKILL.md约定

三个仓库均为社区开源项目;IM 采集与人物模拟须遵守当地法律与企业制度。