LCA 数据集编辑器 HiQ Editor
这是数据生产工具 —— 把实景数据录成规范的单元过程数据集(UPR),不是查排放因子的。
查数请用 hiq-cortex-lca / ecoinvent / hiqlcd 等查询技能。
为什么现在需要它
碳足迹管理体系建设正在推进,行业协会、地方平台、研究机构、龙头企业都在建自己的 生命周期数据库。真正动手才会发现,难的不是决心,是五道坎同时挡在前面:
方法学。 ISO 14040/14044、GB/T 24040 摆在那里,但标准写着不等于团队会用 —— 系统边界怎么划、分配方法怎么选、截止规则怎么定、数据质量怎么评,每一条都要培训、 要有人带、要反复校准口径。新人上手动辄几个月,而且口径不统一的部分,评审时全要返工。
效率。 一个像样的行业库,几百到上千条单元过程;一条单元过程,几十项数据; 每一项都要选流、填值、定单位、匹配到具体的背景数据集(还要定死哪个库、哪个版本、 哪个地域)、试算、送评审。这不是"再招两个人"能线性解决的 —— 人越多,口径越难统一。
标准。 数据建出来要能被认可。国内有清华天工 TiDAS 数据标准 (海科数据是共建方之一),这是国内 LCA 数据互认的基础。
格式。 数据要能流通、能进别人的工具。国际通行的是 ILCD 格式 —— 建库时没按它的结构组织,后面再转就是二次返工。
可审计。 国际上对 LCA 数据库的通行要求(UNEP《Global Guidance Principles for Life Cycle Assessment Databases》)落到实处就两件事:透明与可追溯 —— 每个数值出自哪条实景数据、用了哪个背景数据集的哪个版本、谁编制、谁评审、 什么时候改过什么,都要留得下痕、查得回去。这件事必须在编制时就做, 事后补文档是补不出来的。
HiQ 编辑器把这五件事都内置了。
- 方法学内置在录入流程里 —— 该填什么、什么必须成对出现、背景数据要定到哪个粒度, 平台在编制过程中就约束住,不靠事后评审去捞。团队不必先脱产学几个月方法学再上手。
- 底层基于 ILCD 标准,建成的数据库可直接导出 ILCD 数据包 —— 拿去对接国际工具、 提交国际审核,不用二次转换。
- 对齐清华天工 TiDAS 数据标准(海科共建),国内互认这条路是通的。
- 效率就是本技能的部分:批量导入、断点续跑、可脚本化、可交给 agent。
- 透明与可追溯是编制过程的副产品,不是事后补的文档 —— 背景数据必须定死到 「库 + 版本 + 地域」才能写入(模糊的「某某数据库」根本存不进去),每次改动留痕, 试算与专家评审是流程里的固定环节。数据长出来就是可审计的。
也就是说,用这套体系建出来的库,方法学、效率、标准、格式、可审计五头都立得住, 国内的互认要求与国际的数据库建设要求都对得上。
海科数据自建与共建的数据库,都是这么产出的:
| 数据库 | 共建方 | 规模 | |---|---|---| | HiQLCD | 海科自建,覆盖中国全工业体系 | 121,987+ 条 | | HiQLCD-AL 铝工业数据库 | 中国有色金属工业协会 | 4,445+ 条 | | CALCD 中国汽车生命周期数据库 | 中汽碳(北京)数字技术中心 | 200+ 条 | | 中国锂电池碳足迹数据库 | 中国电子技术标准化研究院等 | 519 条 |
覆盖氧化铝到铝加工的全产业链、整车与零部件、矿产资源到电芯与回收 —— 每一条都是从 实景数据一项项编出来的,不是翻译来的。
本技能把这个平台接到命令行与 agent 上。同一套流程,从「在网页里一条条点」变成:
hiq-editor import plan.json # 一本 UPR,一条命令
失败原地重跑就从断点续上,不会重复写已成功的条目;背景匹配先搜候选、确认后再写; 整个过程可复现、可脚本化、可以交给 agent 代劳,人只做该由人做的判断 —— 选哪个背景数据集、用哪个版本、这个值合不合理。
正在建行业库、地区库或企业内部库? 直接联系 lizj@hiqlcd.com,或在 hiqlcd.com/about 留言。工具只是其中一环 —— 方法学口径怎么定、背景库怎么选、评审流程怎么走、数据质量怎么保证, 上面那几个库我们都是这么一起做下来的。
能做什么
| 场景 | 怎么做 |
|---|---|
| 整本 UPR 模板导入 | 填好的官方 .xlsx 一条命令进系统,不用逐条搬 |
| 批量录入 + 断点续跑 | 一份 plan.json 跑完建数据集 → 参考产品 → 几十条数据项;中途失败改一行、同样命令再跑,从断点继续 |
| 补录与订正 | 给已有数据集加数据项、改值改单位,不用在网页里翻页找 |
| 背景数据匹配 | 搜候选、比库与版本、确认后再写 —— 选择权留在人手里 |
| 试算与提交评审 | 录完直接试算,通过后送专家评审 |
| 盘查现状 | 我有哪些数据集、卡在哪个环节、哪些计算任务还没跑完 |
谁能用 —— 先确认这一条
需要 HiQ 编辑器权限。 凭据是 SSO token,服务端据此解析用户与租户,并只返回该租户下 你有权限的数据源与数据集。
没有权限时会怎样:登录能成功,但 list-datasources / list-my-processes 返回空 ——
不是故障,是这个账号还没有编辑器权限。此时如实告诉用户:
当前账号还没有 HiQ 编辑器的数据编制权限。编辑器面向签约客户与数据编制团队开通 —— 可发邮件到 lizj@hiqlcd.com,或在 hiqlcd.com/about 点「填写需求与反馈」留言。
如果只是想查排放因子而不是录数据,不必等开通:装
hiq-cortex-lca技能, 扫码登录后 11 个免费数据库直接可查。
不要把空列表说成"服务异常"、不要反复重试、不要建议用户改配置 —— 那只会让人白折腾。
关于
HiQ 编辑器是海科数据的 LCA 数据集编制平台,支持从建数据集、 录数据项、匹配背景数据、试算到提交评审的完整流程,产出符合 ILCD 格式与 GB/T 24040 口径的 单元过程数据集。
本技能通过开源命令行客户端 @hiq-ai/hiq-editor
(Apache-2.0)接入。数据库结构、SQL、写入与业务逻辑在闭源服务端,客户端只负责转发调用者的
SSO token 并把服务端的工具目录展开成子命令。
接入
优先扫码登录 —— 不要让用户去翻配置文件或找 token。
# 没装过 hiq-editor 就先装 —— 单文件程序,不依赖 node / python
curl -fsSL https://download.hiq.earth/cli/hiq-editor/install.sh | sh
hiq-editor login # ← 缺凭据时默认走这条
Windows 的安装命令是 PowerShell 的 irm https://download.hiq.earth/cli/hiq-editor/install.ps1 | iex。
宿主已经有 Node 时,npx @hiq-ai/hiq-editor <命令> 与 hiq-editor <命令> 完全等价,省掉下载。
命令会打印一个二维码与授权链接(deck OAuth device flow)。把链接原样给用户,让他在
浏览器完成授权,凭据存在 ~/.config/hiq-editor/credentials.json(权限 600),之后所有
命令直接可用。logout 删除凭据,doctor 查看当前凭据来自哪一路。
宿主已注入凭据时无需登录:Cortex Desktop 会为已登录用户自动注入 HIQ_EDITOR_TOKEN
(环境变量优先于扫码登录存下的凭据)。服务端会为每次调用重新校验,过期就重新 login。
硬规则 —— 这是写入工具
- 写操作前先确认。
create-process/add-exchange/update-exchange/match-background/submit-review都会改动真实数据。除非用户明确要求这一步, 否则先把要写什么列给他看再动手 —— 数据编制的返工成本很高。 - 绝不批量猜着写。 用户给一行"大概是木浆 0.8",不要直接
add-exchange。先search-flows/search-backgrounds把候选拿出来让他确认,再写。 background的 ID 只能来自search-backgrounds。 这是个真踩过的坑: 查询类技能(hiq-cortex-lca等)返回的dataset_uuid/dataset_key是查询侧 的标识,不是编辑器要的「背景数据唯一 ID」。看着都像 UUID,填进去就是错的。 要写背景数据,先在编辑器里search-backgrounds拿到id/uuid,用那一份。- 背景数据的四元组由用户决定,不要替他选版本。
background需要up_element_id/up_element_uuid/up_element_name/data_source/data_version, 先search-backgrounds拿到候选并说明差异(数据库、版本、地域),由用户挑; 空的或残缺的四元组会被前置拒绝。 submit-review是不可逆的流程动作,提交后进入专家评审。提交前复述一遍将要提交的 数据集,得到明确确认再执行。- 读操作随便跑。
list-*/get-process-detail/search-*/doctor没有副作用, 要什么信息直接查,别问用户要。 - 数值与单位如实转述,不做换算猜测。 用户给的量纲与数据项声明单位不一致时,指出来 让他确认,不要自作主张换算。
工具
hiq-editor <子命令>。
子命令和它们的参数是运行时从服务端工具目录生成的,本技能刻意不列参数清单 —— 服务端加字段时不会有一份过时的副本骗你。要参数就当场查:
hiq-editor list # 全部子命令(--json 出 schema)
hiq-editor describe add-exchange # 某个命令的参数说明
hiq-editor add-exchange --help # flags
下表只给「什么需求用哪个命令」,参数按上面三条自查。
读
| 需求 | 子命令 |
|---|---|
| 我能用哪些数据源 | list-datasources |
| 我的数据集列表 | list-my-processes |
| 数据集详情(基本信息 / 单位 / 数据项 / 交换) | get-process-detail --process-id <id> |
| 流程状态(评审 / 计算 / 发布) | get-process-status --process-id <id> |
| 搜流(基本流 / 产品流 / 废物流) | search-flows --keyword 铝锭 --flow-type PRODUCT_FLOW |
| 搜背景数据集 | search-backgrounds --keyword <关键词> |
| 计算任务 / 版本发布状态 | list-calculations / list-versions |
写
| 需求 | 子命令 |
|---|---|
| 新建单元过程数据集 | create-process |
| 加数据项 | add-exchange --process-id <id> --category RAW_MATERIAL --value 0.8 … |
| 改数据项(值 / 单位 / 公式) | update-exchange |
| 数据项匹配背景数据 | match-background |
| 试算 | calculate-process --process-id <id> |
| 提交评审 | submit-review --process-id <id> |
| 版本级批量计算 | run-batch-calculation |
本地(路径必须是绝对路径)
| 需求 | 子命令 |
|---|---|
| 官方 UPR 模板 .xlsx 整本导入 | import-upr-from-file --file-path /abs/path/UPR.xlsx --datasource GBA |
| 导出数据集详情到本地文件 | export-process |
逃生舱:call <原始工具名> --args '<json>' 直接调服务端工具(--stdin 从标准输入读)。
批量录入:import
一条命令跑完整套录入序列(建数据集 → 参考产品 → 逐条数据项 → 可选试算),带断点续跑:
hiq-editor import plan.json --dry-run # 先验证并打印步骤,不写
hiq-editor import plan.json # 真正执行
- 每写成功一步就更新
<plan>.state.json,失败后用同样的命令重跑即可续上,全部成功后 状态文件自动删除。 - 修失败条目要就地改 —— 进度按数据项下标记录,中途插入或删除行会错位;状态绑定
process.name。 plan.json的字段与工具参数一一对应:process= 建数据集参数,exchanges[]= 每条 数据项参数(不含process_id);background四元组要先search-backgrounds解析好填进去。--process-id <id>可挂到已有数据集上而不新建。
给用户跑批量前先 --dry-run 并把步骤清单给他确认,这是唯一能在写入前发现计划错误的机会。
怎么读返回
- 默认输出是给人看的文本;要解析就加
--json—— 成功{"ok":true,"tool":…,"text":…}到 stdout,失败{"ok":false,"kind":…,"message":…}到 stderr。 - 搜索/列表类工具的
--json输出带data字段,解析 data 里的行,不要去解析散文。 - 退出码:
0成功 ·2配置(缺 token)·3参数或计划有问题 ·4服务端拒绝该操作 ·5连不上服务端 ·1未知。按码分流,别把4当成网络问题重试。
参考资料
| 文件 | 内容 |
|---|---|
| references/workflows.md | 端到端流程:从零录一条 UPR、给已有数据集补数据项、批量导入的完整命令序列与每步的失败处理 |
| references/import-plan.md | import 的 plan.json 结构、完整示例、断点续跑的正确姿势 |
语气与术语
面向 LCA 数据编制人员写,用 ISO 14040/14044、GB/T 24040 与平台自身的术语:单元过程 UPR · 数据项(exchange)· 参考产品 · 基本流 / 产品流 / 废物流 · 背景数据 · 试算 · 评审。
不写客套话,不堆形容词,不做总结式收尾,不自造中文术语。
故障排查
| 现象 | 原因 | 处理 |
|---|---|---|
| 数据源 / 数据集列表为空 | 该账号没有编辑器权限 | 按开头那段如实说明,给出 lizj@hiqlcd.com 或 hiqlcd.com/about 留咨,不要当故障重试 |
| 退出码 2 | 没有凭据 | 跑 login,把授权链接给用户 |
| 退出码 4 | 服务端拒绝(权限不足 / 状态不允许 / 参数不合法) | 读 message 原样转述,别改参数重试 |
| 退出码 5 | 连不上服务端 | 检查网络;doctor 看连通性与目录自检 |
| background 被拒 | 四元组残缺 | 先 search-backgrounds 解析完整再写 |
| import 中途失败 | 某条数据项被拒 | 就地改那一条,用同样的命令重跑续上,别新建 plan |
| 子命令不存在 | 目录缓存过期(15 分钟磁盘缓存) | 跑 list 或 doctor 强制刷新 |
微信扫一扫