衍生模型统计与列表
确定口径
- 从用户消息及可见上下文提取精确的
owner/model与平台。支持任意基座,不固定 Qwen 版本。只给出系列名而无法确定具体基座时,先确认模型集合。 - 沿用会话已确定的平台;没有平台上下文时,默认 HF、魔搭国内站、魔搭国际站,明确说明。分别查询三站,不将
.cn数字代入.ai。 - 默认统计平台元数据登记的直接衍生关系,包含
adapter、finetune、merge、quantized。不将名称关键词匹配视为完整血缘统计,不声称覆盖未登记关系的模型。 - 同时报告包含所有匹配仓库的数量,以及排除用户指定基座自身后的数量。按模型 ID 实际求交集扣除,不能固定减 3 或减基座总数。此口径不等于排除全部官方账号模型。
- 默认不递归。若用户明确要求全部后代,按 ID 构建带 visited 集合的遍历,保留每条直接边与原始根;将递归结果与直接统计分开,不能将本脚本的直接结果标作递归结果。
执行
优先使用附带的 Python 标准库脚本,避免重写分页逻辑:
python scripts/collect.py \
--base Qwen/Qwen3.8-27B \
--base Qwen/Qwen3.8-27B-FP8 \
--platform hf --platform ms-cn --platform ms-ai \
--out /absolute/temporary/result-directory
从本 Skill 根目录执行或用脚本绝对路径。输出目录必须新建且位于 Skill 目录外,避免覆盖历史数据。脚本获取完整列表并生成:
report.json:时间、查询来源、完成状态、按基座/类型计数、去重总数、排除基座后的总数、警告、完整关系记录。models.csv:平台内唯一模型列表;包含platform、model_id、url、base_models、relations、is_requested_base。数组字段为标准 CSV 引号内的单行 JSON。relations.csv:一行一个平台/基座/类型/模型关系;保留多基座关系,便于复核。
读取 report.json 后再回答。脚本非零退出表示至少一个平台或基座未完整完成;失败不是零。检查各 complete、error 和 warnings,只将完整分组作为完整统计。脚本保留部分列表供排查,但不能将它当作全量。
若 API 不可用或结构改变,读取 references/api.md 核对接口;必要时使用可用连接工具或网页。通过合适的浏览器技能遵守当前环境的网页访问规则。网页只提供计数时,可以报告来源明确的计数,但不能声称取得完整列表或完成 ID 去重。API 与网页/截图不一致时,记录两者和时间,不擅自断言原因。
验证与交付
- 检查基座存在、API 成功、关系 tag 或
BaseModel精确匹配、分页全部完成。检查 ModelScope 汇总与列表差异;有差异时标注,必要时仅重查受影响分组。 - 同一平台按模型 ID 去重,同时保留多条血缘边。每行计数之和可能大于平台唯一仓库数。
- 跨平台合计是仓库条目数,明确标注“跨平台未去重”。同名仓库不保证权重相同;没有进一步证据不要声称全生态独立模型总数。
- 用用户语言给出每个平台的基座×四类型表、平台去重数、排除指定基座数、抓取时间及源链接。长表可放文件,正文先给结果。
- 用户要求列表时交付完整列表文件,不能只给前几个示例。将需要交付的 CSV/JSON 按当前环境文件保存规则持久保存;临时 API 数据可留 scratch。不要将统计结果或用户数据写入 Skill 本身。
微信扫一扫