仓库协作分析工具(免费版)
概述
actor-identifier-tool-free 为个人开发者提供 Git 仓库级别的协作模式分析能力。它通过原生只读 git 命令收集聚合指标,输出仓库级的协作模式报告,帮助你洞察个人或小团队项目的提交节奏、代码流失率、约定式合规率与巴士因子风险。
本工具严格遵循隐私优先原则:零安装依赖、零网络、零个人评估,仅输出仓库级聚合数据,不做任何个人评判、排名或绩效评估。
核心能力
| 能力 | 说明 |
| --- | --- |
| 只读数据收集 | 仅使用 git log、git shortlog、git diff --stat 等只读命令 |
| 零安装依赖 | 仅依赖系统自带的 git、cut、sort、awk、grep 等 |
| 隐私保护 | 不收集邮箱、不做个人评估、不输出个人排名 |
| 仓库级聚合 | 所有指标在仓库整体层面聚合,不拆分到个人 |
| 巴士因子提示 | 仅在文件级风险披露中出现贡献者姓名(知识转移用途) |
| 安全输入校验 | 严格校验路径、日期、分支参数,防止命令注入 |
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。
核心功能执行
用input_params参数进行配置。
输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
参数配置与调用
用config_options参数进行配置。
输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
config_options参数,支持修改/重置/导入操作
结果处理与输出
用output_format参数进行配置。
输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:面向个人开发者的、仓库协作模式分析、零依赖、隐私优先、输出仓库级聚合报、仓库协作分析工具、免费版为个人开发、者提供、仓库级别的协作模、式分析能力、基于只读、仓库级提交节奏分、天分布、仓库级代码流失率、与重做信号、仓库级约定式提交、合规率、文件级巴士因子风、险提示等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
使用场景
场景 1:分析个人项目的提交节奏
分析一下 /path/to/my-project 这个仓库的协作模式
工具会:
- 校验仓库路径(绝对路径,无危险字符)
- 用只读 git 命令收集聚合数据
- 输出仓库级协作模式报告
报告包含:
- 仓库整体提交频率(小时/天分布)
- 仓库整体代码增长与流失率
- 仓库级约定式提交合规率
- 文件级巴士因子风险提示(如有)
场景 2:分析指定时间段的提交模式
从 2024-01-01 开始,分析 main 分支的提交节奏分布
# 仓库级小时分布
git -C /path/to/my-project log --pretty=format:"%aI" \
--since=2024-01-01 main \
| cut -c12-13 | sort | uniq -c | sort -rn
# 仓库级星期分布
git -C /path/to/my-project log --pretty=format:"%ad" \
--date=format:"%u" --since=2024-01-01 main \
| sort | uniq -c | sort -rn
场景 3:检查巴士因子风险
看看这个仓库有没有巴士因子风险
# 文件级作者数统计(仅披露风险文件)
git -C /path/to/my-project log --pretty=format:"%an" --name-only \
| sort | uniq -c | sort -rn | head -30
工具会列出"仅有单一历史作者"的文件,提示知识转移需求。报告中的贡献者姓名仅出现在此处的风险披露,不与任何评估性指标关联。
快速开始
领先步:确认分析意图与权限
工具会确认:
- 你明确要分析某个具体的 Git 仓库
- 你提供了具体的仓库路径(绝对路径)
- 你确认有权分析该仓库
- 你知晓报告不用于个人评估
第二步:Dry-Run 预览(推荐首次使用)
先列出要执行的命令,不要运行
工具会打印所有将执行的只读 git 命令,供你审查。
第三步:执行分析
分析 /path/to/my-project
工具执行只读命令,输出仓库级协作模式报告。
示例
参数说明
| 参数 | 说明 | 是否必需 | 默认值 |
| --- | --- | --- | --- |
| repo_path | 目标 Git 仓库的绝对路径 | 是 | — |
| since | 起始日期(ISO 格式 YYYY-MM-DD) | 否 | 全部历史 |
| until | 结束日期(ISO 格式 YYYY-MM-DD) | 否 | 全部历史 |
| branch | 目标分支 | 否 | 当前活动分支 |
命令白名单(安全契约)
仅允许以下只读 git 子命令:
| 命令 | 用途 | 是否修改仓库 |
| --- | --- | --- |
| git -C <path> rev-parse --is-inside-work-tree | 验证路径是有效 Git 仓库 | 否 |
| git -C <path> rev-parse --show-toplevel | 解析仓库根目录 | 否 |
| git -C <path> shortlog -sn --all | 获取贡献者数量 | 否 |
| git -C <path> log ... | 获取提交历史(只读 flag) | 否 |
| git -C <path> diff --stat ... | 获取变更统计 | 否 |
优选实践
- 首次使用先 Dry-Run:让工具列出将执行的命令,审查后再实际运行。
- 只用绝对路径:相对路径可能导致意外访问其他目录。
- 限制日期范围:大型仓库用
since/until限制范围,控制命令耗时。 - 不用于个人评估:报告仅描述仓库级工作流模式,不可用于绩效、排名或人事决策。
- 知晓边界:报告仅反映 Git 可见的活动,不反映代码审查、设计、文档、指导等非提交工作。
- 敏感数据本地处理:提交消息与文件路径属于本地数据,仅聚合数值进入分析。
- 邮箱不收集:所有 git 命令仅使用
%an(作者名),永不使用%ae(邮箱)。 - 路径限制工作区:仅访问用户提供的仓库路径,不遍历父目录,不访问工作区外文件。
常见问题
Q1: 工具会收集开发者邮箱吗?
不会。所有 git 命令仅使用 %an(作者名),永不使用 %ae(邮箱)。git shortlog 使用 -sn 而非 -sne,避免泄露邮箱。
Q2: 工具能对个人进行绩效评估吗?
不能,也不允许。工具仅输出仓库级聚合指标,不做个人拆分、排名或评估。任何要求个人评估的请求都会被拒绝。
Q3: 工具会修改仓库吗?
不会。工具仅使用只读 git 子命令(白名单内),无写入、无网络、无仓库外访问。
Q4: 工具如何保护敏感数据?
提交消息与文件路径属于本地数据,仅通过本地 Unix 工具(awk/grep/wc)折叠为聚合数值后才能进入分析。原始文本永不进入 AI 模型的提示词。常见密钥模式(API Key、Token、私钥、连接串)在显示前自动替换为 [REDACTED]。
Q5: Windows 上能用吗?
可以。Windows 用户需使用 Git Bash 或 WSL,因为工具依赖 cut、sort、awk、grep 等 Unix 文本工具。这些工具在 Git Bash 与 WSL 中默认可用。
Q6: 免费版与 Pro 版的区别?
免费版聚焦个人仓库的聚合分析;Pro 版扩展团队场景、多仓库批量分析、自定义指标、CI 集成与企业级报告能力。
依赖说明
运行环境
- Agent 平台:支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- 操作系统:Windows(需 Git Bash 或 WSL)/ macOS / Linux
- Git:任意现代版本(2.0+)
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 | |:-------|:-----|:---------|:---------| | git | 系统工具 | 必需 | 系统包管理器 | | cut / sort / uniq | 系统工具 | 必需 | 系统预装(Unix) | | awk | 系统工具 | 必需 | 系统预装(Unix) | | grep / sed / wc / head | 系统工具 | 必需 | 系统预装(Unix) | | LLM API | API | 必需 | 由 Agent 内置 LLM 提供 |
API Key 配置
- 本 Skill 完全基于本地 git 命令,无需额外 API Key
- 不涉及任何网络请求,所有数据本地处理
可用性分类
- 分类: MD+execute(纯 Markdown 指令,部分功能需要 exec 命令行执行能力)
- 说明: 基于自然语言指令驱动 Agent 执行只读 git 命令并输出仓库级聚合报告;所有命令在本地执行,无网络、无写入、无仓库外访问
错误处理
| 错误场景 | 原因 | 处理方式 | |---------|------|---------| | 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 | | 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 | | 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
已知限制
- 需LLM支持,无LLM环境不可用
- 复杂业务场景建议结合人工经验判断
- 执行效率受模型能力与网络环境影响
- 当前为免费版本,如需完整功能请升级到付费版获取全部能力
安全注意事项
| 风险类型 | 防范措施 | |----------|---------| | API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 | | 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 | | 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 | | 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。
微信扫一扫