Back to skills
extension
Category: Data & AnalyticsNo API key required

化妆品原料-剂型应用适配分析

化妆品原料应用分布与性能差异分析。当用户提供候选原料群(如蜡、增稠剂、合成酯、成膜剂)和目标产品群的全成分(备案成分导出 Excel),需要统计一类原料在目标产品中的使用频率、剂型/功效分化、共现关系,画应用分布图,并从数据侧解读候选原料的性能差异时使用。触发词:原料应用分布、使用频率统计、成分使用率、原料性能差异、配方原料统计。

personAuthor: user_c8a8ae55hubcommunity

化妆品原料应用分布与性能差异分析

概述

把「候选原料群」与「目标产品群全成分」两路输入,解析后统计一类原料在目标产品中的使用频率、分组分化、共现关系与成分表位置分布,产出应用分布图;再基于数据侧信号解读候选原料之间的性能差异,输出可复用的 Excel 与报告。

核心价值在"性能差异解读":不只数谁用得多,还要回答"谁更适合什么剂型/功效、谁和谁是复配还是替代、谁是主体谁是辅助"。

适用场景

  • 建立一类原料(蜡、合成/天然增稠剂、合成酯类、成膜剂等)在某剂型或某功效产品中的应用分布图。
  • 对比候选原料群中各原料的使用频率与场景偏好,支撑配方原料选型。
  • 判断新原料在目标品类中的机会点与冷门风险。

工作流

第 1 步:确认输入

用户需提供两类输入:

  1. 候选原料群:一类原料的名称清单,含别名合并规则(如「蜂蜡」要合并「白蜂蜡、合成蜂蜡」)。
  2. 目标产品群全成分:备案成分导出 Excel,含名为「成分表」的工作表,字段见 references/analysis-protocol.md §1。

数据源使用平台导出的备案成分文件,不爬取国家药监局(其有反爬,直接抓取不可行)。

第 2 步:构造配置

运行前先检查环境:

python scripts/check_environment.py

环境可用后,写一个 config.json

{
  "candidates": [
    {"name": "合成蜡", "exact": ["合成蜡"], "prefix": []},
    {"name": "蜂蜡", "exact": ["蜂蜡", "白蜂蜡", "合成蜂蜡"], "prefix": []},
    {"name": "小烛树蜡", "exact": [], "prefix": ["小烛树"]}
  ],
  "products": [
    {"group": "防晒棒", "files": ["D:/path/防晒棒-国产特殊.xlsx", "D:/path/防晒棒-进口特殊.xlsx"]},
    {"group": "防晒润唇膏", "files": ["D:/path/润唇膏-国产特殊.xlsx"]}
  ]
}
  • exact 按成分名精确匹配;prefix 按前缀匹配(用于带 INCI 括注的名称)。
  • products[].group 即分组标签(剂型/功效),每个分组可含多个成分文件。
  • 别名规则、分割点口径见 references/analysis-protocol.md;蜡类成分名变体与别名坑点见 references/category-wax.md
  • 候选原料清单与产品文件均由使用者每次录入,技能不内置任何候选清单或统计结果。

第 3 步:运行分析脚本

python scripts/analyze.py config.json --out 应用分布统计.xlsx --json 汇总.json

脚本输出一个 Excel(3 个工作表)和一份汇总 JSON:

  • 统计汇总:每原料 × 每分组的频率(命中数/分母 + 百分比)、位置中位数、合计。
  • 逐款明细:每产品命中的原料及位置。
  • 共现矩阵:原料两两共现次数。

第 4 步:读取结果,输出报告

references/report-template.md,按模板产出报告。性能差异解读遵循 references/analysis-protocol.md §5 的六维框架,逐原料给出"数据 → 结论",并配合分组对比柱状图。

数据侧性能差异解读

性能差异结论只由数据信号支撑,不臆造原料理化参数。核心维度:

  1. 使用频率(主流 vs 冷门)
  2. 分组分化(谁在哪个剂型/功效更集中)
  3. 成分表位置(主体 vs 辅助)
  4. 共现关系(复配 vs 替代)
  5. 冷门信号(适用性存疑)
  6. 同类内部对比(角色分工)

每一结论必须回溯到具体数字;数字给不出时标注「推断」并说明依据。

质量自查

  • [ ] 分母 = 有成分数据产品数,缺失产品已排除并单独列出。
  • [ ] 分割点判定正确(微量标记 → 香精 → 无标记)。
  • [ ] 别名合并正确,相似原料未误并(如微晶蜡 ≠ 氢化微晶蜡)。
  • [ ] 每个性能结论都对应可回溯数字,推断已标注。

停止条件

  • 成分文件无「成分表」工作表或格式无法解析 → 停止,要求标准导出。
  • 候选原料未定义别名 → 宁漏计不猜测。
  • 无法获得可解析成分数据 → 不产出频率结论。

资源

  • scripts/analyze.py — 核心分析脚本(解析 + 统计 + 共现 + 输出 Excel/JSON)。
  • scripts/check_environment.py — 环境检查(Python 与 openpyxl)。
  • references/analysis-protocol.md — 通用分析协议(输入口径、分割点、别名、六维解读框架)。
  • references/category-wax.md — 蜡类录入参考(成分名变体、别名坑点、配方角色)。
  • references/report-template.md — 报告模板。
  • references/setup-guide.md — 运行环境配置说明。