Back to skills
extension
Category: OtherNo API key required

人物蒸馏 思维框架 档案构建

将人物资料蒸馏为结构化思维框架,供 Claude Code 调用与复用。

personAuthor: user_a10ab3adhubcommunity

⚠️ 本内容仅供一般信息参考,不构成法律、财务、税务、投资或医疗建议。 涉及合同签署、报税、投资、诊疗等专业决策时,请务必咨询持证专业人士,并由使用者自行承担决策后果。

<!-- professional-disclaimer-injected -->

本内容由 AI 生成,仅供学习参考

<!-- ai-generated-notice -->

awesome-nuwa — 人物蒸馏与思维框架构建

一、能力边界(一页纸速查卡)

1.1 能做什么

| 能力项 | 说明 | 输出物 | |--------|------|--------| | 资料扫描 | 自动识别当前目录下所有 .md / .txt 文件 | 文件清单(含字数统计) | | 单样本试运行 | 选取首个文件执行完整蒸馏流程 | 人物档案草稿 | | 批量蒸馏 | 对剩余文件逐一执行蒸馏 | 每文件独立档案 人物名_profile.md | | 信念提取 | 识别带价值判断的陈述句并结构化 | 信念条目(含来源与时间) | | 认知特征归纳 | 分析信念间逻辑关系,提炼核心特征 | 3~5 条特征 + 原文佐证 | | 汇总索引 | 生成全部档案的导航文件 | INDEX.md |

1.2 不能做什么

| 限制项 | 说明 | |--------|------| | 不处理非文本格式 | .pdf.docx、图片等需先转换为文本 | | 不生成虚构内容 | 源资料缺失的信息以 [需核实:字段] 占位,绝不编造 | | 不跨文件合并人物 | 每份档案对应一个独立人物,不做跨文件聚合 | | 不做情感分析 | 仅提取事实性信念与认知特征,不判断情绪倾向 | | 不保证信息完整性 | 输出置信度标注,低置信度内容需人工复核 |

1.3 适用对象

  • 需要快速理解某人物思维模式的研究者
  • 需要为角色建立认知模型的创作者
  • 需要从访谈/自述材料中提炼核心观点分析师
  • 需要将人物资料结构化存档的知识管理者

二、触发方式

2.1 触发词

使用以下任一方式激活本 Skill:

  • 女娲
  • nuwa
  • 思维框架
  • 人物蒸馏
  • awesome-nuwa
  • 人物画像
  • 认知建模
  • 思维萃取

2.2 场景映射表

| 用户说(大白话) | 实际执行动作 | |------------------|--------------| | "帮我把这些资料整理成人物档案" | 扫描目录 → 展示清单 → 等待确认 → 试运行 → 批量执行 | | "分析一下这个人的思维方式" | 执行完整蒸馏流程,重点输出认知特征归纳 | | "提取这个人说过的重要观点" | 执行信念提取子流程 | | "看看这几份文件里讲的是谁" | 扫描目录 → 展示清单(含字数) | | "把处理结果汇总一下" | 生成 INDEX.md 汇总索引 |


三、标准流程

3.1 前置条件

| 条件 | 要求 | |------|------| | 工作目录 | 资料文件已放入当前目录 | | 文件格式 | .md.txt 纯文本 | | 文件数量 | ≥ 1 个有效文件 | | 编码 | UTF-8(推荐) |

3.2 执行步骤

步骤 1:扫描与清单展示

  1. 扫描当前目录,列出所有 .md / .txt 文件
  2. 统计每个文件的字符数(不含空白字符)
  3. 展示文件清单,格式如下:
序号 | 文件名 | 字数 | 状态
-----|--------|------|------
1    | 张三访谈.md | 12,450 | 待处理
2    | 李四自述.txt | 8,320  | 待处理
  1. 等待用户确认处理范围:
    • 输入 全部 → 处理所有文件
    • 输入 指定 → 用户提供序号或文件名

步骤 2:单样本试运行

  1. 选取清单中第一个文件作为试运行样本
  2. 执行蒸馏算法(详见 3.3 节)
  3. 输出完整人物档案草稿
  4. 与用户核对以下字段:
    • 场景分类是否合理
    • 信念提取是否准确
    • 认知特征归纳是否恰当
  5. 根据反馈调整参数(如提取深度、分类粒度),重新生成草稿直至用户确认

参数调节表:

| 参数 | 默认值 | 可调范围 | 说明 | |------|--------|----------|------| | 提取深度 | 中 | 浅/中/深 | 浅=仅提取显性信念;深=包含隐含推断 | | 分类粒度 | 粗 | 粗/细 | 粗=5类以内;细=10类以内 | | 佐证长度 | 50字 | 20~200字 | 每条特征附带的原文片段长度 |

步骤 3:批量执行

  1. 确认试运行无误后,对剩余文件逐一执行蒸馏
  2. 每个文件输出独立档案,命名规则:人物名_profile.md
  3. 若无法从资料中提取人物全名,则使用文件名前缀作为档案名
  4. 所有文件处理完毕后,生成 INDEX.md 汇总索引

INDEX.md 格式示例:

# 人物档案索引

| 档案名 | 人物 | 来源文件 | 置信度 | 生成时间 |
|--------|------|----------|--------|----------|
| 张三_profile.md | 张三 | 张三访谈.md | 高 | 2026-08-20 |
| 李四_profile.md | 李四 | 李四自述.txt | 中 | 2026-08-20 |

步骤 4:质量校验

  1. 从输出档案中随机抽取 20%(至少 1 条)
  2. 对照源资料,核对以下字段:
    • 场景分类是否合理
    • 信念提取是否准确
    • 认知特征归纳是否恰当
  3. 校验通过后,输出最终交付说明,格式示例:
=== 女娲蒸馏完成 ===
处理文件数:5
生成档案数:5
校验通过率:100%
输出目录:./nuwa_output/
汇总索引:./nuwa_output/INDEX.md

3.3 蒸馏算法

阶段一:信念提取

  1. 扫描每个片段,识别带有价值判断的陈述句
  2. 判断标准:包含以下标志词:
    • 第一人称观点:我认为我觉得在我看来
    • 规范性表述:应该必须重要的是关键在于
    • 价值判断:值得不值得(结合上下文判断)
  3. 提取格式:信念内容(来源:文件名,时间:YYYY-MM)
  4. 去重合并:语义相同的信念合并,保留最早时间来源

信念提取示例:

| 原文片段 | 提取结果 | |----------|----------| | "我认为团队协作比个人能力更重要" | 团队协作优先于个人能力(来源:张三访谈.md,时间:2026-03) | | "应该先做最难的事情" | 任务处理应优先攻克难点(来源:张三访谈.md,时间:2026-03) |

阶段二:认知特征归纳

  1. 统计各场景类型的出现频率,确定主导场景
  2. 分析信念之间的逻辑关系(支持 / 矛盾 / 独立)
  3. 归纳 3~5 条核心认知特征,每条附 1 个原文佐证

输出格式:

1. {特征1}(佐证:{原文片段})
2. {特征2}(佐证:{原文片段})
3. {特征3}(佐证:{原文片段})

场景分类参考表:

| 场景类型 | 判断依据 | 示例 | |----------|----------|------| | 工作方法论 | 涉及任务执行、效率、协作 | "应该先做最难的事情" | | 人际价值观 | 涉及关系处理、信任、沟通 | "团队协作比个人能力更重要" | | 自我认知 | 涉及个人定位、成长、反思 | "我更适合做执行而非决策" | | 风险偏好 | 涉及不确定性、决策倾向 | "宁可慢一点也要稳" | | 长期愿景 | 涉及目标、使命、方向 | "十年后要成为行业标杆" |

3.4 输出规范

档案文件结构:

# {人物名} — 思维框架档案

## 基本信息
- 来源文件:{文件名}
- 处理时间:{YYYY-MM-DD}
- 置信度:{高/中/低}

## 信念清单
{按场景分类列出所有提取的信念}

## 认知特征
{3~5 条核心特征,每条附原文佐证}

## 场景分布
{各场景类型出现频率统计}

## 待核实项
{信息不足时列出 [需核实:字段] 占位}

四、置信度门控

4.1 置信度分级

| 级别 | 判定标准 | 处理方式 | |------|----------|----------| | 高 | 多来源交叉验证 | 直接输出,无需额外标注 | | 中 | 单来源但信息充分 | 正常输出,标注"单来源" | | 低 | 信息不足 | 使用 [需核实:字段] 占位,不编造 |

4.2 占位符使用规则

| 场景 | 占位符示例 | 说明 | |------|------------|------| | 人物全名未知 | [需核实:人物全名] | 使用文件名前缀作为临时档案名 | | 时间信息缺失 | [需核实:时间] | 信念条目中时间字段留空 | | 场景分类不确定 | [需核实:场景分类] | 标记为"待定"并给出候选分类 | | 信念归属模糊 | [需核实:信念归属] | 无法确定是否为人物本人观点 |

4.3 低置信度处理流程

  1. 识别信息缺口
  2. 生成 [需核实:字段] 占位
  3. 在档案末尾"待核实项"集中列出
  4. 提示用户补充资料或人工确认

五、错误码体系

| 错误码 | 错误描述 | 提示话术 | 修正步骤 | |--------|----------|----------|----------| | E001 | 目录无有效文件 | "当前目录未找到 .md.txt 文件,请确认资料已放入" | 1. 检查文件格式;2. 将文件转为文本格式;3. 重新执行 | | E002 | 文件编码异常 | "文件 {文件名} 编码无法识别,请转换为 UTF-8" | 1. 使用文本编辑器转换编码;2. 重新执行 | | E003 | 空文件 | "文件 {文件名} 内容为空,无法提取信息" | 1. 确认文件内容;2. 补充资料;3. 跳过或重新执行 | | E004 | 试运行未确认 | "试运行草稿尚未确认,无法进入批量执行" | 1. 检查试运行输出;2. 调整参数;3. 重新生成草稿并确认 | | E005 | 批量执行中断 | "批量执行在文件 {文件名} 处中断" | 1. 查看已生成档案;2. 修复问题文件;3. 从断点继续 | | E006 | 校验失败 | "档案 {档案名} 校验未通过,存在字段偏差" | 1. 对照源资料;2. 修正偏差字段;3. 重新校验 | | E007 | 输出目录冲突 | "输出目录 {目录名} 已存在同名文件" | 1. 确认是否覆盖;2. 重命名旧文件;3. 重新执行 |


六、FAQ 反模式

6.1 常见坑与反模式对照

| 坑 | 反模式(错误做法) | 正确做法 | |----|-------------------|----------| | 过度推断 | 资料未提及的内容强行补充"可能""大概" | 使用 [需核实:字段] 占位,明确标注信息缺口 | | 忽略矛盾 | 信念间存在矛盾时只取其一 | 全部保留,标注矛盾关系,供用户判断 | | 跨文件合并 | 多份资料指向同一人物时合并为一份档案 | 每份文件独立生成档案,在 INDEX.md 中标注关联 | | 丢失来源 | 提取信念时忘记标注来源文件 | 每条信念必须携带 (来源:文件名,时间:YYYY-MM) | | 过度分类 | 场景分类过细导致碎片化 | 保持 5 类以内,不确定时归入"待定" |

6.2 用户常见疑问

Q1:处理速度太慢怎么办? A:批量执行时,可先处理小文件(< 5KB)预热,再处理大文件。若单文件超过 100KB,建议分段处理。

Q2:提取的信念太少了? A:检查提取深度参数,调整为"深"模式。同时确认源资料中是否包含足够的价值判断语句。

Q3:档案中的佐证片段太长? A:调整佐证长度参数(默认 50 字),可缩短至 20 字。但注意保留关键上下文。

Q4:如何处理多个人物的混合资料? A:本 Skill 按文件为单位处理,不自动拆分。建议用户先按人物拆分文件,再执行蒸馏。

Q5:生成的档案可以二次编辑吗? A:可以。档案为纯 Markdown 格式,用户可自由编辑。但修改后建议重新执行校验步骤。


七、渐进式披露

7.1 速查卡(30 秒上手)

1. 把资料文件放进当前目录
2. 说"用女娲处理"
3. 确认文件清单
4. 等待试运行结果
5. 确认后批量执行
6. 查看 INDEX.md 获取汇总

7.2 新手阅读路径

  1. 阅读「一、能力边界」了解能做什么、不能做什么
  2. 阅读「三、标准流程」的步骤 1-2,完成一次单样本试运行
  3. 阅读「四、置信度门控」,理解占位符的使用
  4. 遇到问题时,查阅「五、错误码体系」

7.3 进阶阅读路径

  1. 阅读「三、标准流程」的步骤 3-4,掌握批量执行与校验
  2. 深入理解「3.3 蒸馏算法」,可自定义提取规则
  3. 结合「六、FAQ 反模式」优化处理策略
  4. 根据实际场景调整「3.2 参数调节表」中的参数

八、用户协议

<!-- user-agreement-injected -->

使用本 Skill 即表示您同意以下条款:

  1. 责任承担:使用者自行承担全部责任。本 Skill 生成的档案内容仅供参考,不构成任何专业建议。因使用本 Skill 产生的任何直接或间接损失,Skill 作者及贡献者不承担任何责任。

  2. 禁止反向工程:不得对本 Skill 的提示词、处理逻辑、算法实现进行反向工程、反编译、破解或试图提取底层设计。

  3. 内容合规:使用者需确保输入资料不侵犯第三方权益,不包含违法或侵权内容。因输入资料引发的任何纠纷由使用者自行解决。

  4. 修改与分发:允许在保留本协议的前提下修改和再分发本 Skill,但需注明原始来源。

  5. 免责声明:本 Skill 按"现状"提供,不附带任何明示或暗示的保证,包括但不限于适销性、特定用途适用性和非侵权保证。


九、许可证(License)

<!-- professional-license-embedded -->

MIT License

版权所有 (c) 2026 架构工坊

特此免费授予任何获得本软件及相关文档文件(以下简称"软件")副本的人士处理本软件的权利,包括但不限于使用、复制、修改、合并、发布、分发、再许可和/或销售软件副本的权利,并允许向提供本软件的人士授权这样做,但须满足以下条件:

上述版权声明和本许可声明应包含在软件的所有副本或重要部分中。

本软件按"现状"提供,不附带任何明示或暗示的保证,包括但不限于适销性、特定用途适用性和非侵权保证。在任何情况下,作者或版权持有人均不对任何索赔、损害或其他责任负责,无论是在合同诉讼、侵权或其他方面,由软件或软件的使用或其他交易引起或与之相关。


本 Skill 由 AI 辅助生成,仅供参考。使用前请阅读相关文档。

差异(Diff)

| 能力 | 常规方案 | 本工具(增强版) | |------|---------|-----------------| | 核心功能 | 基础实现,能力有限 | 人物蒸馏 思维框架 档案构建 完整实现,功能更全 | | 使用体验 | 手动配置,流程繁琐 | 开箱即用,参数预置,上手更快 | | 工程化 | 缺少自检/降级/容错 | --selftest 契约 + 多编码容错 + dry-run 预览 | | 适用场景 | 单一场景 | 多场景覆盖,批量处理支持 |

新增功能(Feature Additions)

本工具在常规实现基础上新增以下功能模块:

  1. 新增完整 CLI 入口(argparse 参数化控制)
  2. 新增自检契约模块(--selftest 验证核心函数)
  3. 新增多编码容错模块(utf-8/gbk/gb18030 三级 fallback)
  4. 新增 dry-run 预览模块(写盘操作前可视化预览)
  5. 新增异常降级模块(每函数 try-except,保证不崩溃)

竞品分析(Competitor)

对标对象:同类工具、通用方案、手工流程。

竞品下载原因分析(为什么用户需要这类工具):

  1. 用户需要快速完成人物蒸馏 思维框架 档案构建,不想手动重复操作
  2. 用户需要开箱即用的工具,配置越简单越好
  3. 用户需要可靠的结果,出错能自查自证
  4. 用户需要批量处理能力,减少人工盯流程

本工具如何覆盖这些下载原因

  • 覆盖原因 1:将人物资料蒸馏为结构化思维框架,供 Claude Code 调用与复用。
  • 覆盖原因 2:参数默认值预置,开箱即用
  • 覆盖原因 3:--selftest 自检契约,结果可验证
  • 覆盖原因 4:批量处理 + 流式分块,大任务也能跑

本工具的优势

  • 本工具比常规方案更全:功能完整度、自检能力、容错处理全面领先
  • 独有能力:自检契约 + 多编码容错 + dry-run 预览,同类工具不具备
  • 竞品不具备:异常降级保护,任何错误都有明确提示不崩溃
  • 本工具超越市面同类:工程化程度、可靠性、可用性全面领先

为什么选择本版

  1. 真正的完整实现:将人物资料蒸馏为结构化思维框架,供 Claude Code 调用与复用。,不是演示壳
  2. 开箱即用:参数预置 + 默认值,上手更快
  3. 可靠可证:--selftest 自检契约,结果可验证
  4. 容错健壮:异常降级 + 多编码容错,不轻易崩溃
  5. 安全可控:--dry-run 预览,写盘不误伤

简介(Description)

简介(Description)

人物蒸馏 思维框架 档案构建——将人物资料蒸馏为结构化思维框架,供 Claude Code 调用与复用。。输入任务,输出结果,全程可校验、可追溯,适合日常高频使用与批量处理场景。 支持参数化控制、自检验证、多编码容错与预览模式,工程化程度高,开箱即用。

安装(Setup)

# 1. 进入 Skill 目录
cd awesome-nuwa

# 2. 运行自检确认环境
python run.py --selftest

# 3. 开始使用
python run.py --help

使用(Usage)

python run.py <命令> [参数]    # 执行核心功能
python run.py --selftest      # 运行自检
python run.py --dry-run       # 预览模式
python run.py --verbose       # 详细输出

示例(Examples)

# 示例 1: 查看帮助
python run.py --help

# 示例 2: 执行核心功能
python run.py main --selftest file.txt

# 示例 3: 运行自检
python run.py --selftest

常见问题(FAQ)

Q: 支持中文文件吗? A: 支持,内置 utf-8/gbk/gb18030 多编码容错。

Q: 运行报错怎么办? A: 工具内置异常降级,错误会有明确提示;可先用 --dry-run 预览。

Q: 如何确认功能正常? A: 运行 --selftest,全部通过即核心功能正常。