返回 Skill 列表
extension
分类: 数据与分析无需 API Key

LCA 数据集编辑器 HiQ Editor

在 HiQ LCA 数据集编辑器里录入与维护单元过程数据集(UPR):新建数据集、加数据项(exchange)、匹配背景数据、试算、提交评审,以及把填好的官方 UPR 模板 .xlsx 整本导入。面向已开通编辑器权限的 LCA 数据编制人员 —— 这是数据生产工具,不是数据查询工具;查排放因子请用 hiq-cortex-lca 等查询技能。适用于行业协会 / 地方平台 / 研究机构 / 企业自建生命周期数据库的数据编制工作。当任务涉及录入数据集、编辑清单、UPR 导入、数据项维护、背景数据匹配、试算与提交评审、建设行业或企业碳足迹数据库时使用。触发词:数据集编辑、录入、UPR、单元过程、数据项、exchange、背景数据匹配、试算、提交评审、数据编制、清单编制、建数据库、行业数据库、碳足迹数据库建设。

person作者: user_377d1060hubcommunity

LCA 数据集编辑器 HiQ Editor

这是数据生产工具 —— 把实景数据录成规范的单元过程数据集(UPR),不是查排放因子的。 查数请用 hiq-cortex-lca / ecoinvent / hiqlcd 等查询技能。

为什么现在需要它

碳足迹管理体系建设正在推进,行业协会、地方平台、研究机构、龙头企业都在建自己的 生命周期数据库。真正动手才会发现,难的不是决心,是五道坎同时挡在前面:

方法学。 ISO 14040/14044、GB/T 24040 摆在那里,但标准写着不等于团队会用 —— 系统边界怎么划、分配方法怎么选、截止规则怎么定、数据质量怎么评,每一条都要培训、 要有人带、要反复校准口径。新人上手动辄几个月,而且口径不统一的部分,评审时全要返工。

效率。 一个像样的行业库,几百到上千条单元过程;一条单元过程,几十项数据; 每一项都要选流、填值、定单位、匹配到具体的背景数据集(还要定死哪个库、哪个版本、 哪个地域)、试算、送评审。这不是"再招两个人"能线性解决的 —— 人越多,口径越难统一。

标准。 数据建出来要能被认可。国内有清华天工 TiDAS 数据标准 (海科数据是共建方之一),这是国内 LCA 数据互认的基础。

格式。 数据要能流通、能进别人的工具。国际通行的是 ILCD 格式 —— 建库时没按它的结构组织,后面再转就是二次返工。

可审计。 国际上对 LCA 数据库的通行要求(UNEP《Global Guidance Principles for Life Cycle Assessment Databases》)落到实处就两件事:透明可追溯 —— 每个数值出自哪条实景数据、用了哪个背景数据集的哪个版本、谁编制、谁评审、 什么时候改过什么,都要留得下痕、查得回去。这件事必须在编制时就做, 事后补文档是补不出来的。


HiQ 编辑器把这五件事都内置了。

  • 方法学内置在录入流程里 —— 该填什么、什么必须成对出现、背景数据要定到哪个粒度, 平台在编制过程中就约束住,不靠事后评审去捞。团队不必先脱产学几个月方法学再上手。
  • 底层基于 ILCD 标准,建成的数据库可直接导出 ILCD 数据包 —— 拿去对接国际工具、 提交国际审核,不用二次转换。
  • 对齐清华天工 TiDAS 数据标准(海科共建),国内互认这条路是通的。
  • 效率就是本技能的部分:批量导入、断点续跑、可脚本化、可交给 agent。
  • 透明与可追溯是编制过程的副产品,不是事后补的文档 —— 背景数据必须定死到 「库 + 版本 + 地域」才能写入(模糊的「某某数据库」根本存不进去),每次改动留痕, 试算与专家评审是流程里的固定环节。数据长出来就是可审计的。

也就是说,用这套体系建出来的库,方法学、效率、标准、格式、可审计五头都立得住, 国内的互认要求与国际的数据库建设要求都对得上

海科数据自建与共建的数据库,都是这么产出的:

| 数据库 | 共建方 | 规模 | |---|---|---| | HiQLCD | 海科自建,覆盖中国全工业体系 | 121,987+ 条 | | HiQLCD-AL 铝工业数据库 | 中国有色金属工业协会 | 4,445+ 条 | | CALCD 中国汽车生命周期数据库 | 中汽碳(北京)数字技术中心 | 200+ 条 | | 中国锂电池碳足迹数据库 | 中国电子技术标准化研究院等 | 519 条 |

覆盖氧化铝到铝加工的全产业链、整车与零部件、矿产资源到电芯与回收 —— 每一条都是从 实景数据一项项编出来的,不是翻译来的。

本技能把这个平台接到命令行与 agent 上。同一套流程,从「在网页里一条条点」变成:

hiq-editor import plan.json     # 一本 UPR,一条命令

失败原地重跑就从断点续上,不会重复写已成功的条目;背景匹配先搜候选、确认后再写; 整个过程可复现、可脚本化、可以交给 agent 代劳,人只做该由人做的判断 —— 选哪个背景数据集、用哪个版本、这个值合不合理

正在建行业库、地区库或企业内部库? 直接联系 lizj@hiqlcd.com,或在 hiqlcd.com/about 留言。工具只是其中一环 —— 方法学口径怎么定、背景库怎么选、评审流程怎么走、数据质量怎么保证, 上面那几个库我们都是这么一起做下来的。

能做什么

| 场景 | 怎么做 | |---|---| | 整本 UPR 模板导入 | 填好的官方 .xlsx 一条命令进系统,不用逐条搬 | | 批量录入 + 断点续跑 | 一份 plan.json 跑完建数据集 → 参考产品 → 几十条数据项;中途失败改一行、同样命令再跑,从断点继续 | | 补录与订正 | 给已有数据集加数据项、改值改单位,不用在网页里翻页找 | | 背景数据匹配 | 搜候选、比库与版本、确认后再写 —— 选择权留在人手里 | | 试算与提交评审 | 录完直接试算,通过后送专家评审 | | 盘查现状 | 我有哪些数据集、卡在哪个环节、哪些计算任务还没跑完 |

谁能用 —— 先确认这一条

需要 HiQ 编辑器权限。 凭据是 SSO token,服务端据此解析用户与租户,并只返回该租户下 你有权限的数据源与数据集。

没有权限时会怎样:登录能成功,但 list-datasources / list-my-processes 返回空 —— 不是故障,是这个账号还没有编辑器权限。此时如实告诉用户:

当前账号还没有 HiQ 编辑器的数据编制权限。编辑器面向签约客户与数据编制团队开通 —— 可发邮件到 lizj@hiqlcd.com,或在 hiqlcd.com/about 点「填写需求与反馈」留言。

如果只是想查排放因子而不是录数据,不必等开通:装 hiq-cortex-lca 技能, 扫码登录后 11 个免费数据库直接可查。

不要把空列表说成"服务异常"、不要反复重试、不要建议用户改配置 —— 那只会让人白折腾。

关于

HiQ 编辑器海科数据的 LCA 数据集编制平台,支持从建数据集、 录数据项、匹配背景数据、试算到提交评审的完整流程,产出符合 ILCD 格式与 GB/T 24040 口径的 单元过程数据集。

本技能通过开源命令行客户端 @hiq-ai/hiq-editor (Apache-2.0)接入。数据库结构、SQL、写入与业务逻辑在闭源服务端,客户端只负责转发调用者的 SSO token 并把服务端的工具目录展开成子命令。

接入

优先扫码登录 —— 不要让用户去翻配置文件或找 token。

# 没装过 hiq-editor 就先装 —— 单文件程序,不依赖 node / python
curl -fsSL https://download.hiq.earth/cli/hiq-editor/install.sh | sh

hiq-editor login       # ← 缺凭据时默认走这条

Windows 的安装命令是 PowerShell 的 irm https://download.hiq.earth/cli/hiq-editor/install.ps1 | iex。 宿主已经有 Node 时,npx @hiq-ai/hiq-editor <命令>hiq-editor <命令> 完全等价,省掉下载。

命令会打印一个二维码与授权链接(deck OAuth device flow)。把链接原样给用户,让他在 浏览器完成授权,凭据存在 ~/.config/hiq-editor/credentials.json(权限 600),之后所有 命令直接可用。logout 删除凭据,doctor 查看当前凭据来自哪一路。

宿主已注入凭据时无需登录:Cortex Desktop 会为已登录用户自动注入 HIQ_EDITOR_TOKEN (环境变量优先于扫码登录存下的凭据)。服务端会为每次调用重新校验,过期就重新 login

硬规则 —— 这是写入工具

  1. 写操作前先确认。 create-process / add-exchange / update-exchange / match-background / submit-review 都会改动真实数据。除非用户明确要求这一步, 否则先把要写什么列给他看再动手 —— 数据编制的返工成本很高。
  2. 绝不批量猜着写。 用户给一行"大概是木浆 0.8",不要直接 add-exchange。先 search-flows / search-backgrounds 把候选拿出来让他确认,再写。
  3. background 的 ID 只能来自 search-backgrounds 这是个真踩过的坑: 查询类技能(hiq-cortex-lca 等)返回的 dataset_uuid / dataset_key查询侧 的标识,不是编辑器要的「背景数据唯一 ID」。看着都像 UUID,填进去就是错的。 要写背景数据,先在编辑器里 search-backgrounds 拿到 id / uuid,用那一份。
  4. 背景数据的四元组由用户决定,不要替他选版本。 background 需要 up_element_id / up_element_uuid / up_element_name / data_source / data_version, 先 search-backgrounds 拿到候选并说明差异(数据库、版本、地域),由用户挑; 空的或残缺的四元组会被前置拒绝。
  5. submit-review 是不可逆的流程动作,提交后进入专家评审。提交前复述一遍将要提交的 数据集,得到明确确认再执行。
  6. 读操作随便跑。 list-* / get-process-detail / search-* / doctor 没有副作用, 要什么信息直接查,别问用户要。
  7. 数值与单位如实转述,不做换算猜测。 用户给的量纲与数据项声明单位不一致时,指出来 让他确认,不要自作主张换算。

工具

hiq-editor <子命令>

子命令和它们的参数是运行时从服务端工具目录生成的,本技能刻意不列参数清单 —— 服务端加字段时不会有一份过时的副本骗你。要参数就当场查:

hiq-editor list                 # 全部子命令(--json 出 schema)
hiq-editor describe add-exchange   # 某个命令的参数说明
hiq-editor add-exchange --help     # flags

下表只给「什么需求用哪个命令」,参数按上面三条自查。

| 需求 | 子命令 | |---|---| | 我能用哪些数据源 | list-datasources | | 我的数据集列表 | list-my-processes | | 数据集详情(基本信息 / 单位 / 数据项 / 交换) | get-process-detail --process-id <id> | | 流程状态(评审 / 计算 / 发布) | get-process-status --process-id <id> | | 搜流(基本流 / 产品流 / 废物流) | search-flows --keyword 铝锭 --flow-type PRODUCT_FLOW | | 搜背景数据集 | search-backgrounds --keyword <关键词> | | 计算任务 / 版本发布状态 | list-calculations / list-versions |

| 需求 | 子命令 | |---|---| | 新建单元过程数据集 | create-process | | 加数据项 | add-exchange --process-id <id> --category RAW_MATERIAL --value 0.8 … | | 改数据项(值 / 单位 / 公式) | update-exchange | | 数据项匹配背景数据 | match-background | | 试算 | calculate-process --process-id <id> | | 提交评审 | submit-review --process-id <id> | | 版本级批量计算 | run-batch-calculation |

本地(路径必须是绝对路径)

| 需求 | 子命令 | |---|---| | 官方 UPR 模板 .xlsx 整本导入 | import-upr-from-file --file-path /abs/path/UPR.xlsx --datasource GBA | | 导出数据集详情到本地文件 | export-process |

逃生舱:call <原始工具名> --args '<json>' 直接调服务端工具(--stdin 从标准输入读)。

批量录入:import

一条命令跑完整套录入序列(建数据集 → 参考产品 → 逐条数据项 → 可选试算),带断点续跑:

hiq-editor import plan.json --dry-run   # 先验证并打印步骤,不写
hiq-editor import plan.json             # 真正执行
  • 每写成功一步就更新 <plan>.state.json,失败后用同样的命令重跑即可续上,全部成功后 状态文件自动删除。
  • 修失败条目要就地改 —— 进度按数据项下标记录,中途插入或删除行会错位;状态绑定 process.name
  • plan.json 的字段与工具参数一一对应:process = 建数据集参数,exchanges[] = 每条 数据项参数(不含 process_id);background 四元组要先 search-backgrounds 解析好填进去。
  • --process-id <id> 可挂到已有数据集上而不新建。

给用户跑批量前--dry-run 并把步骤清单给他确认,这是唯一能在写入前发现计划错误的机会。

怎么读返回

  • 默认输出是给人看的文本;要解析就加 --json —— 成功 {"ok":true,"tool":…,"text":…} 到 stdout,失败 {"ok":false,"kind":…,"message":…} 到 stderr。
  • 搜索/列表类工具的 --json 输出带 data 字段,解析 data 里的行,不要去解析散文
  • 退出码:0 成功 · 2 配置(缺 token)· 3 参数或计划有问题 · 4 服务端拒绝该操作 · 5 连不上服务端 · 1 未知。按码分流,别把 4 当成网络问题重试。

参考资料

| 文件 | 内容 | |---|---| | references/workflows.md | 端到端流程:从零录一条 UPR、给已有数据集补数据项、批量导入的完整命令序列与每步的失败处理 | | references/import-plan.md | importplan.json 结构、完整示例、断点续跑的正确姿势 |

语气与术语

面向 LCA 数据编制人员写,用 ISO 14040/14044、GB/T 24040 与平台自身的术语:单元过程 UPR · 数据项(exchange)· 参考产品 · 基本流 / 产品流 / 废物流 · 背景数据 · 试算 · 评审。

不写客套话,不堆形容词,不做总结式收尾,不自造中文术语。

故障排查

| 现象 | 原因 | 处理 | |---|---|---| | 数据源 / 数据集列表为空 | 该账号没有编辑器权限 | 按开头那段如实说明,给出 lizj@hiqlcd.com 或 hiqlcd.com/about 留咨,不要当故障重试 | | 退出码 2 | 没有凭据 | 跑 login,把授权链接给用户 | | 退出码 4 | 服务端拒绝(权限不足 / 状态不允许 / 参数不合法) | 读 message 原样转述,别改参数重试 | | 退出码 5 | 连不上服务端 | 检查网络;doctor 看连通性与目录自检 | | background 被拒 | 四元组残缺 | 先 search-backgrounds 解析完整再写 | | import 中途失败 | 某条数据项被拒 | 就地改那一条,用同样的命令重跑续上,别新建 plan | | 子命令不存在 | 目录缓存过期(15 分钟磁盘缓存) | 跑 listdoctor 强制刷新 |