<!-- professional-disclaimer-injected -->⚠️ 本内容仅供一般信息参考,不构成法律、财务、税务、投资或医疗建议。 涉及合同签署、报税、投资、诊疗等专业决策时,请务必咨询持证专业人士,并由使用者自行承担决策后果。
<!-- ai-generated-notice -->本内容由 AI 生成,仅供学习参考
awesome-nuwa — 人物蒸馏与思维框架构建
一、能力边界(一页纸速查卡)
1.1 能做什么
| 能力项 | 说明 | 输出物 |
|--------|------|--------|
| 资料扫描 | 自动识别当前目录下所有 .md / .txt 文件 | 文件清单(含字数统计) |
| 单样本试运行 | 选取首个文件执行完整蒸馏流程 | 人物档案草稿 |
| 批量蒸馏 | 对剩余文件逐一执行蒸馏 | 每文件独立档案 人物名_profile.md |
| 信念提取 | 识别带价值判断的陈述句并结构化 | 信念条目(含来源与时间) |
| 认知特征归纳 | 分析信念间逻辑关系,提炼核心特征 | 3~5 条特征 + 原文佐证 |
| 汇总索引 | 生成全部档案的导航文件 | INDEX.md |
1.2 不能做什么
| 限制项 | 说明 |
|--------|------|
| 不处理非文本格式 | .pdf、.docx、图片等需先转换为文本 |
| 不生成虚构内容 | 源资料缺失的信息以 [需核实:字段] 占位,绝不编造 |
| 不跨文件合并人物 | 每份档案对应一个独立人物,不做跨文件聚合 |
| 不做情感分析 | 仅提取事实性信念与认知特征,不判断情绪倾向 |
| 不保证信息完整性 | 输出置信度标注,低置信度内容需人工复核 |
1.3 适用对象
- 需要快速理解某人物思维模式的研究者
- 需要为角色建立认知模型的创作者
- 需要从访谈/自述材料中提炼核心观点分析师
- 需要将人物资料结构化存档的知识管理者
二、触发方式
2.1 触发词
使用以下任一方式激活本 Skill:
女娲nuwa思维框架人物蒸馏awesome-nuwa人物画像认知建模思维萃取
2.2 场景映射表
| 用户说(大白话) | 实际执行动作 |
|------------------|--------------|
| "帮我把这些资料整理成人物档案" | 扫描目录 → 展示清单 → 等待确认 → 试运行 → 批量执行 |
| "分析一下这个人的思维方式" | 执行完整蒸馏流程,重点输出认知特征归纳 |
| "提取这个人说过的重要观点" | 执行信念提取子流程 |
| "看看这几份文件里讲的是谁" | 扫描目录 → 展示清单(含字数) |
| "把处理结果汇总一下" | 生成 INDEX.md 汇总索引 |
三、标准流程
3.1 前置条件
| 条件 | 要求 |
|------|------|
| 工作目录 | 资料文件已放入当前目录 |
| 文件格式 | .md 或 .txt 纯文本 |
| 文件数量 | ≥ 1 个有效文件 |
| 编码 | UTF-8(推荐) |
3.2 执行步骤
步骤 1:扫描与清单展示
- 扫描当前目录,列出所有
.md/.txt文件 - 统计每个文件的字符数(不含空白字符)
- 展示文件清单,格式如下:
序号 | 文件名 | 字数 | 状态
-----|--------|------|------
1 | 张三访谈.md | 12,450 | 待处理
2 | 李四自述.txt | 8,320 | 待处理
- 等待用户确认处理范围:
- 输入
全部→ 处理所有文件 - 输入
指定→ 用户提供序号或文件名
- 输入
步骤 2:单样本试运行
- 选取清单中第一个文件作为试运行样本
- 执行蒸馏算法(详见 3.3 节)
- 输出完整人物档案草稿
- 与用户核对以下字段:
- 场景分类是否合理
- 信念提取是否准确
- 认知特征归纳是否恰当
- 根据反馈调整参数(如提取深度、分类粒度),重新生成草稿直至用户确认
参数调节表:
| 参数 | 默认值 | 可调范围 | 说明 | |------|--------|----------|------| | 提取深度 | 中 | 浅/中/深 | 浅=仅提取显性信念;深=包含隐含推断 | | 分类粒度 | 粗 | 粗/细 | 粗=5类以内;细=10类以内 | | 佐证长度 | 50字 | 20~200字 | 每条特征附带的原文片段长度 |
步骤 3:批量执行
- 确认试运行无误后,对剩余文件逐一执行蒸馏
- 每个文件输出独立档案,命名规则:
人物名_profile.md - 若无法从资料中提取人物全名,则使用文件名前缀作为档案名
- 所有文件处理完毕后,生成
INDEX.md汇总索引
INDEX.md 格式示例:
# 人物档案索引
| 档案名 | 人物 | 来源文件 | 置信度 | 生成时间 |
|--------|------|----------|--------|----------|
| 张三_profile.md | 张三 | 张三访谈.md | 高 | 2026-08-20 |
| 李四_profile.md | 李四 | 李四自述.txt | 中 | 2026-08-20 |
步骤 4:质量校验
- 从输出档案中随机抽取 20%(至少 1 条)
- 对照源资料,核对以下字段:
- 场景分类是否合理
- 信念提取是否准确
- 认知特征归纳是否恰当
- 校验通过后,输出最终交付说明,格式示例:
=== 女娲蒸馏完成 ===
处理文件数:5
生成档案数:5
校验通过率:100%
输出目录:./nuwa_output/
汇总索引:./nuwa_output/INDEX.md
3.3 蒸馏算法
阶段一:信念提取
- 扫描每个片段,识别带有价值判断的陈述句
- 判断标准:包含以下标志词:
- 第一人称观点:
我认为、我觉得、在我看来 - 规范性表述:
应该、必须、重要的是、关键在于 - 价值判断:
好、坏、值得、不值得(结合上下文判断)
- 第一人称观点:
- 提取格式:
信念内容(来源:文件名,时间:YYYY-MM) - 去重合并:语义相同的信念合并,保留最早时间来源
信念提取示例:
| 原文片段 | 提取结果 | |----------|----------| | "我认为团队协作比个人能力更重要" | 团队协作优先于个人能力(来源:张三访谈.md,时间:2026-03) | | "应该先做最难的事情" | 任务处理应优先攻克难点(来源:张三访谈.md,时间:2026-03) |
阶段二:认知特征归纳
- 统计各场景类型的出现频率,确定主导场景
- 分析信念之间的逻辑关系(支持 / 矛盾 / 独立)
- 归纳 3~5 条核心认知特征,每条附 1 个原文佐证
输出格式:
1. {特征1}(佐证:{原文片段})
2. {特征2}(佐证:{原文片段})
3. {特征3}(佐证:{原文片段})
场景分类参考表:
| 场景类型 | 判断依据 | 示例 | |----------|----------|------| | 工作方法论 | 涉及任务执行、效率、协作 | "应该先做最难的事情" | | 人际价值观 | 涉及关系处理、信任、沟通 | "团队协作比个人能力更重要" | | 自我认知 | 涉及个人定位、成长、反思 | "我更适合做执行而非决策" | | 风险偏好 | 涉及不确定性、决策倾向 | "宁可慢一点也要稳" | | 长期愿景 | 涉及目标、使命、方向 | "十年后要成为行业标杆" |
3.4 输出规范
档案文件结构:
# {人物名} — 思维框架档案
## 基本信息
- 来源文件:{文件名}
- 处理时间:{YYYY-MM-DD}
- 置信度:{高/中/低}
## 信念清单
{按场景分类列出所有提取的信念}
## 认知特征
{3~5 条核心特征,每条附原文佐证}
## 场景分布
{各场景类型出现频率统计}
## 待核实项
{信息不足时列出 [需核实:字段] 占位}
四、置信度门控
4.1 置信度分级
| 级别 | 判定标准 | 处理方式 |
|------|----------|----------|
| 高 | 多来源交叉验证 | 直接输出,无需额外标注 |
| 中 | 单来源但信息充分 | 正常输出,标注"单来源" |
| 低 | 信息不足 | 使用 [需核实:字段] 占位,不编造 |
4.2 占位符使用规则
| 场景 | 占位符示例 | 说明 |
|------|------------|------|
| 人物全名未知 | [需核实:人物全名] | 使用文件名前缀作为临时档案名 |
| 时间信息缺失 | [需核实:时间] | 信念条目中时间字段留空 |
| 场景分类不确定 | [需核实:场景分类] | 标记为"待定"并给出候选分类 |
| 信念归属模糊 | [需核实:信念归属] | 无法确定是否为人物本人观点 |
4.3 低置信度处理流程
- 识别信息缺口
- 生成
[需核实:字段]占位 - 在档案末尾"待核实项"集中列出
- 提示用户补充资料或人工确认
五、错误码体系
| 错误码 | 错误描述 | 提示话术 | 修正步骤 |
|--------|----------|----------|----------|
| E001 | 目录无有效文件 | "当前目录未找到 .md 或 .txt 文件,请确认资料已放入" | 1. 检查文件格式;2. 将文件转为文本格式;3. 重新执行 |
| E002 | 文件编码异常 | "文件 {文件名} 编码无法识别,请转换为 UTF-8" | 1. 使用文本编辑器转换编码;2. 重新执行 |
| E003 | 空文件 | "文件 {文件名} 内容为空,无法提取信息" | 1. 确认文件内容;2. 补充资料;3. 跳过或重新执行 |
| E004 | 试运行未确认 | "试运行草稿尚未确认,无法进入批量执行" | 1. 检查试运行输出;2. 调整参数;3. 重新生成草稿并确认 |
| E005 | 批量执行中断 | "批量执行在文件 {文件名} 处中断" | 1. 查看已生成档案;2. 修复问题文件;3. 从断点继续 |
| E006 | 校验失败 | "档案 {档案名} 校验未通过,存在字段偏差" | 1. 对照源资料;2. 修正偏差字段;3. 重新校验 |
| E007 | 输出目录冲突 | "输出目录 {目录名} 已存在同名文件" | 1. 确认是否覆盖;2. 重命名旧文件;3. 重新执行 |
六、FAQ 反模式
6.1 常见坑与反模式对照
| 坑 | 反模式(错误做法) | 正确做法 |
|----|-------------------|----------|
| 过度推断 | 资料未提及的内容强行补充"可能""大概" | 使用 [需核实:字段] 占位,明确标注信息缺口 |
| 忽略矛盾 | 信念间存在矛盾时只取其一 | 全部保留,标注矛盾关系,供用户判断 |
| 跨文件合并 | 多份资料指向同一人物时合并为一份档案 | 每份文件独立生成档案,在 INDEX.md 中标注关联 |
| 丢失来源 | 提取信念时忘记标注来源文件 | 每条信念必须携带 (来源:文件名,时间:YYYY-MM) |
| 过度分类 | 场景分类过细导致碎片化 | 保持 5 类以内,不确定时归入"待定" |
6.2 用户常见疑问
Q1:处理速度太慢怎么办? A:批量执行时,可先处理小文件(< 5KB)预热,再处理大文件。若单文件超过 100KB,建议分段处理。
Q2:提取的信念太少了? A:检查提取深度参数,调整为"深"模式。同时确认源资料中是否包含足够的价值判断语句。
Q3:档案中的佐证片段太长? A:调整佐证长度参数(默认 50 字),可缩短至 20 字。但注意保留关键上下文。
Q4:如何处理多个人物的混合资料? A:本 Skill 按文件为单位处理,不自动拆分。建议用户先按人物拆分文件,再执行蒸馏。
Q5:生成的档案可以二次编辑吗? A:可以。档案为纯 Markdown 格式,用户可自由编辑。但修改后建议重新执行校验步骤。
七、渐进式披露
7.1 速查卡(30 秒上手)
1. 把资料文件放进当前目录
2. 说"用女娲处理"
3. 确认文件清单
4. 等待试运行结果
5. 确认后批量执行
6. 查看 INDEX.md 获取汇总
7.2 新手阅读路径
- 阅读「一、能力边界」了解能做什么、不能做什么
- 阅读「三、标准流程」的步骤 1-2,完成一次单样本试运行
- 阅读「四、置信度门控」,理解占位符的使用
- 遇到问题时,查阅「五、错误码体系」
7.3 进阶阅读路径
- 阅读「三、标准流程」的步骤 3-4,掌握批量执行与校验
- 深入理解「3.3 蒸馏算法」,可自定义提取规则
- 结合「六、FAQ 反模式」优化处理策略
- 根据实际场景调整「3.2 参数调节表」中的参数
八、用户协议
<!-- user-agreement-injected -->使用本 Skill 即表示您同意以下条款:
-
责任承担:使用者自行承担全部责任。本 Skill 生成的档案内容仅供参考,不构成任何专业建议。因使用本 Skill 产生的任何直接或间接损失,Skill 作者及贡献者不承担任何责任。
-
禁止反向工程:不得对本 Skill 的提示词、处理逻辑、算法实现进行反向工程、反编译、破解或试图提取底层设计。
-
内容合规:使用者需确保输入资料不侵犯第三方权益,不包含违法或侵权内容。因输入资料引发的任何纠纷由使用者自行解决。
-
修改与分发:允许在保留本协议的前提下修改和再分发本 Skill,但需注明原始来源。
-
免责声明:本 Skill 按"现状"提供,不附带任何明示或暗示的保证,包括但不限于适销性、特定用途适用性和非侵权保证。
九、许可证(License)
<!-- professional-license-embedded -->MIT License
版权所有 (c) 2026 架构工坊
特此免费授予任何获得本软件及相关文档文件(以下简称"软件")副本的人士处理本软件的权利,包括但不限于使用、复制、修改、合并、发布、分发、再许可和/或销售软件副本的权利,并允许向提供本软件的人士授权这样做,但须满足以下条件:
上述版权声明和本许可声明应包含在软件的所有副本或重要部分中。
本软件按"现状"提供,不附带任何明示或暗示的保证,包括但不限于适销性、特定用途适用性和非侵权保证。在任何情况下,作者或版权持有人均不对任何索赔、损害或其他责任负责,无论是在合同诉讼、侵权或其他方面,由软件或软件的使用或其他交易引起或与之相关。
本 Skill 由 AI 辅助生成,仅供参考。使用前请阅读相关文档。
差异(Diff)
| 能力 | 常规方案 | 本工具(增强版) | |------|---------|-----------------| | 核心功能 | 基础实现,能力有限 | 人物蒸馏 思维框架 档案构建 完整实现,功能更全 | | 使用体验 | 手动配置,流程繁琐 | 开箱即用,参数预置,上手更快 | | 工程化 | 缺少自检/降级/容错 | --selftest 契约 + 多编码容错 + dry-run 预览 | | 适用场景 | 单一场景 | 多场景覆盖,批量处理支持 |
新增功能(Feature Additions)
本工具在常规实现基础上新增以下功能模块:
- 新增完整 CLI 入口(argparse 参数化控制)
- 新增自检契约模块(--selftest 验证核心函数)
- 新增多编码容错模块(utf-8/gbk/gb18030 三级 fallback)
- 新增 dry-run 预览模块(写盘操作前可视化预览)
- 新增异常降级模块(每函数 try-except,保证不崩溃)
竞品分析(Competitor)
对标对象:同类工具、通用方案、手工流程。
竞品下载原因分析(为什么用户需要这类工具):
- 用户需要快速完成人物蒸馏 思维框架 档案构建,不想手动重复操作
- 用户需要开箱即用的工具,配置越简单越好
- 用户需要可靠的结果,出错能自查自证
- 用户需要批量处理能力,减少人工盯流程
本工具如何覆盖这些下载原因:
- 覆盖原因 1:将人物资料蒸馏为结构化思维框架,供 Claude Code 调用与复用。
- 覆盖原因 2:参数默认值预置,开箱即用
- 覆盖原因 3:--selftest 自检契约,结果可验证
- 覆盖原因 4:批量处理 + 流式分块,大任务也能跑
本工具的优势:
- 本工具比常规方案更全:功能完整度、自检能力、容错处理全面领先
- 独有能力:自检契约 + 多编码容错 + dry-run 预览,同类工具不具备
- 竞品不具备:异常降级保护,任何错误都有明确提示不崩溃
- 本工具超越市面同类:工程化程度、可靠性、可用性全面领先
为什么选择本版
- 真正的完整实现:将人物资料蒸馏为结构化思维框架,供 Claude Code 调用与复用。,不是演示壳
- 开箱即用:参数预置 + 默认值,上手更快
- 可靠可证:--selftest 自检契约,结果可验证
- 容错健壮:异常降级 + 多编码容错,不轻易崩溃
- 安全可控:--dry-run 预览,写盘不误伤
简介(Description)
简介(Description)
人物蒸馏 思维框架 档案构建——将人物资料蒸馏为结构化思维框架,供 Claude Code 调用与复用。。输入任务,输出结果,全程可校验、可追溯,适合日常高频使用与批量处理场景。 支持参数化控制、自检验证、多编码容错与预览模式,工程化程度高,开箱即用。
安装(Setup)
# 1. 进入 Skill 目录
cd awesome-nuwa
# 2. 运行自检确认环境
python run.py --selftest
# 3. 开始使用
python run.py --help
使用(Usage)
python run.py <命令> [参数] # 执行核心功能
python run.py --selftest # 运行自检
python run.py --dry-run # 预览模式
python run.py --verbose # 详细输出
示例(Examples)
# 示例 1: 查看帮助
python run.py --help
# 示例 2: 执行核心功能
python run.py main --selftest file.txt
# 示例 3: 运行自检
python run.py --selftest
常见问题(FAQ)
Q: 支持中文文件吗? A: 支持,内置 utf-8/gbk/gb18030 多编码容错。
Q: 运行报错怎么办? A: 工具内置异常降级,错误会有明确提示;可先用 --dry-run 预览。
Q: 如何确认功能正常? A: 运行 --selftest,全部通过即核心功能正常。
微信扫一扫