Back to skills
extension
Category: Data & AnalyticsNo API key required

代恒春-语音转文字-数据知识产权

将会议纪要/语音转写提炼为结构化数据集,脱敏后用于数据知识产权登记(江苏)及许可使用。流水线:原始纪要保留不动 → 按 schema 提炼结构化数据集 → 脱敏(敏感内容清除 + 人名主体化)→ 登记前置检查 → 登记申请材料准备。触发词:数据知识产权登记、数据产品化、会议纪要提炼数据集、脱敏登记、数据存证、数据许可使用、数据产品知识产权。

personAuthor: user_ee1c0336hubcommunity

meeting-minutes-data-product

将会议纪要 / 语音转写提炼为结构化数据集,脱敏后用于数据知识产权登记(江苏)及许可使用

功能

一条端到端流水线:

原始纪要(保留不动) → 提炼结构化数据集 → 脱敏 → 登记前置检查 → 登记申请材料
  • 提炼:从会议纪要抽取四类结构化数据 —— OPC 模式要素、园区运营规则、合作方观点、AI 产业判断
  • 脱敏:敏感内容清除(只删敏感词、留中性表述)+ 人名主体化(主体N,按出现顺序各自分配)
  • 登记前置检查:对齐《江苏省数据知识产权登记管理办法》(苏知规〔2026〕1号)硬门槛
  • 登记申请材料:生成 20 字段制式 xlsx(登记信息填充稿)

触发场景

  • 数据知识产权登记、数据产品化
  • 会议纪要提炼数据集、脱敏登记
  • 数据存证、数据许可使用

核心规则

  1. 脱敏对象 = 提炼后的数据集,原始纪要永不改动(证据力)
  2. 敏感内容只删敏感词、留中性表述;登记红线 = 第18条(七)「危害国家安全 / 违背社会主义核心价值观不予登记」
  3. 人名 → 主体N,按出现顺序各自分配,不做同人归一
  4. 隐晦称呼必须识别(如对领导人姓名的谐音 / 误转变体)
  5. 数据来源合法证明:涉及个人数据须取得知情同意 / 授权(第三条)

文件与文件夹命名规范

  • 数据集文件夹:{登记主体}_{数据名称}(如 苏州国智知识产权有限公司_OPC生态科创底座会议数据产品/
  • 文件夹内文件:{登记主体}_{数据名称}_{年-月-日}-{序号}
  • 登记信息填充稿 xlsx 单独加前缀:江苏省数据知识产权登记_

文件结构

meeting-minutes-data-product/
├── SKILL.md        # 技能主文件(完整规则)
├── README.md       # 本说明
└── LICENSE.txt     # MIT 许可证

用法

详见 SKILL.md 的「处理流程(6 步)」「敏感内容识别框架」「数据集 schema」「登记申请字段填写规范」等章节。本地 xlsx 编辑务必走 editor_sdk 通道并 save_file 落盘(见 SKILL.md「本地 xlsx 编辑落盘规范」)。