evaluate-mmi
MMI评估代理 - 通过模块化成熟度指数(Modularity Maturity Index)对模块的成熟度进行评估(内聚/耦合/独立性/可重用性)。使用/evaluate-mmi [目标路径] 调用。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
MMI评估代理 - 通过模块化成熟度指数(Modularity Maturity Index)对模块的成熟度进行评估(内聚/耦合/独立性/可重用性)。使用/evaluate-mmi [目标路径] 调用。
支持对开发工具、框架、库的评估和比较。提供PoC计划、多个候选方案的比较分析、决策框架。在需要进行技术选型、工具引入判断时使用。
构建可重复的评估系统,包括黄金数据集、评分标准、通过/失败阈值和回归报告。可用于“大语言模型评估”、“测试AI系统”、“质量保证”或“模型基准测试”。
通过使用子代理在sonnet、opus和haiku模型上执行技能来评估技能。当测试某项技能是否正确工作、比较模型性能或寻找最便宜的兼容模型时,请使用此方法。返回数值分数(0-100)以区分模型能力。
为Bob The Skull的事件驱动架构添加新事件。在创建新事件、事件发布者、事件处理程序或通过新事件类型扩展事件系统时使用。
事件溯源模式和设计决策
深入探讨Event Storming,超越宏观视角
为网站创建新的事件抓取脚本。在向Asheville Event Feed添加新的事件源时使用。始终先检测CMS/平台,并尝试已知的API端点。不支持浏览器抓取(Vercel限制)。处理基于API、HTML/JSON-LD以及混合模式,具有全面的测试工作流程。
审查LLM生成的差异分类,用于diffview评估系统。当用户调用此技能或从evalreview粘贴包含“# 差异分类审查”标题的数据时使用。评估分类是否准确地帮助了代码审查者,并提供带有详细评论的通过/失败裁决。
运行Microsoft的eval-recipes基准测试,以验证amplihack改进相对于基线代理的有效性。在测试改进、运行评估或基准测试更改时自动激活。
评估TappsCodingAgents框架的有效性并提供持续改进建议。用于分析使用模式、工作流程遵守情况和代码质量指标。
用于外部集成和钩子的JSONL事件流
设计基于事件驱动的架构,包括事件溯源、CQRS、发布/订阅模式以及领域事件,用于解耦系统。当用户请求“事件溯源”、“CQRS”、“领域事件”、“发布/订阅”或“事件驱动”时使用。
用于为ProductTank SF活动生成带有品牌标识的二维码 - 演讲者的LinkedIn个人资料、赞助商网站或Slack加入链接。处理单个/批量生成,正确的logo映射,GDrive上传,并强制进行测试扫描。
设计和实现面向事件系统的事件存储。在构建事件溯源基础设施、选择事件存储技术或实现事件持久化模式时使用。
事件驱动架构模式包括消息队列、发布/订阅、事件溯源、CQRS和Saga。当实现异步消息传递、分布式事务、事件存储、命令查询分离、领域事件、集成事件、数据流、编排或与RabbitMQ、Kafka、Apache Pulsar、AWS SQS、AWS SNS、NATS、事件总线或消息代理集成时使用。
帮助用户评估新兴技术。当有人在评估新工具、做出构建与购买决策、评估AI供应商或决定技术架构时使用。
仪器评估指标、质量分数和反馈循环
使用质量门和LLM作为评判来评估代理系统。当您需要衡量组件质量或实施质量门时使用。不适用于没有细微差别的简单单元测试或二元通过/失败检查。
使用Kafka、RabbitMQ、事件溯源、CQRS和Saga模式设计事件驱动架构。当用户需要关于事件驱动设计、消息队列、事件溯源或异步通信模式的帮助时激活。
全面的EVE Online项目管理和ESI集成工具包。在更新、审核或将ESI集成到如EVE_Rebellion、EVE_Gatekeeper、EVE_Ships或任何与EVE相关的开发项目时使用。触发条件包括项目更新、ESI集成、合规性检查、资产管理或多项目协调。
使用事件溯源来构建可审计、可重放的UI状态系统,使其与并发渲染兼容。
自定义事件命名、分发和处理的约定,在实现组件间通信时使用。
创建常青笔记的原则——随着时间积累的原子化、持久性的见解。在讨论笔记质量、什么是好的常青笔记或“只记录探索过的内容”原则时使用。这些概念与使用的笔记工具无关。