← 返回 Skill 列表
extension
分类: 数据与分析无需 API Key

招标文件核心信息提取

从甲方招标文件、采购文件、补遗、答疑、技术规格和合同附件中提取项目总览、时间节点、资格/废标项、评分办法、技术与商务要求、投标文件组成和证据清单,生成带文件、页码、条款、原文摘录和核验状态的 Excel 工作底稿。用户提出"招标文件核心信息提取""标书信息整理成Excel""拆资格条件和评分办法""整理废标项/技术参数/签章封装要求""做投标信息总表"或上传招标资料要求结构化时使用。不要用于直接编写完整投标文件、确定报价、替代法务/技术审批、审查已完成标书或解释一般招投标概念。

person作者: user_6113fd9fhubcommunity

招标文件核心信息提取

目标

把有效招标资料转成可筛选、可分工、可回查的 Excel 工作底稿,作为投标文件制作入口。先保证完整性和证据,再追求摘要速度。

启动

  1. 确认用户授权的文件范围和输出位置;原文件只读,不覆盖已有输出。
  2. 建立文件基线:正文、附件、技术规格、合同模板、补遗、澄清、答疑和平台通知逐一登记版本与优先级。
  3. 读取 references/extraction-schema.md,按字段合同形成结构化 JSON。
  4. 需要判断复合条款、冲突或严重度时读取 references/extraction-workflow.md。

提取流程

  1. 先判断文件是否可完整读取。对扫描页、乱码、缺页或表格断裂记录页码;无法可靠识别时标记 needs_ocr 或 manual_review。

  2. 通读全部有效文件。目录和关键词只用于定位,不能替代全文阅读。

  3. 将复合条款拆成“一项义务一行”,分别归入:关键时间、资格/废标、评分、技术、商务、投标文件组成、证据或风险。

  4. 每条关键记录必须带 source_document,并至少带 source_page 或 source_location;能识别时补 source_clause 和短 source_excerpt。

  5. 区分原文、归纳与判断:requirement 写归纳,source_excerpt 只放短原文;不得凭经验补写客户事实。

  6. 对时间、项目编号、标包、份数、金额口径、工期、质保、付款、签章和提交方式做跨文件冲突复核。冲突未决时两条来源都保留,并新增 P0 风险。

  7. 按 schema 保存 UTF-8 JSON;运行:

    python scripts/build_bid_core_workbook.py <input.json> <output.xlsx>

  8. 运行:

    python scripts/validate_bid_core_workbook.py <output.xlsx>

  9. 实际打开或解析 Excel,确认 11 张工作表、筛选、冻结窗格、来源列和公式错误检查均通过后再交付。

硬边界

  • 没有招标文件时,只列缺失输入,不生成虚构项目事实。
  • 扫描件或 OCR 不可靠时,不声称“已完整提取”。
  • 资格门槛和评分加分必须分轨;满足资格不等于获得分值。
  • 不替用户确定最终报价、接受商务偏差、承诺技术参数或执行投标提交。
  • 不读取未授权客户资料,不跨项目迁移客户名称、报价、资质、人员、业绩或联系方式。
  • Excel 是工作底稿,不等于投标文件已批准、已提交或会中标。

交付说明

交付时分开写:

  • 已提取:已定位且有来源的字段;
  • 待核实:冲突、低置信度、OCR 问题、缺失页码或需业务确认的字段;
  • 未执行:报价审批、法务审查、技术确认、签章、上传与提交。

维护信息

维护方:博维管理咨询(广州)有限公司 www.moways.com.cn wanchao_liu@moways.com.sg