chaos-runner
使用Chaos Monkey、Litmus或Gremlin运行混沌工程实验
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
使用Chaos Monkey、Litmus或Gremlin运行混沌工程实验
用于Web应用程序的Docker容器化、多阶段构建及优化。
专长于AWS/Azure/GCP多云环境的资深云架构师
业务运营工作区设置,与workIQ集成。创建报告生成、任务管理和客户管理系统。使用场景:设置新的工作区、初始化业务运营环境、创建业务管理系统。
通过分析system.part_log(分区创建、合并、变更、下载、移除、移动)来诊断ClickHouse问题。用于处理过多的分区/微批插入、合并积压或慢合并、变更风暴(ALTER DELETE/UPDATE)、异常的复制DownloadPart波动、意外的RemovePart峰值,或者与分区活动相关的ZooKeeper/Keeper znode增长。
在Kubernetes上开发和排查Tekton管道问题。当创建云原生CI/CD管道、调试TaskRuns和PipelineRuns、理解Tekton CRDs或构建可重用的任务和管道时使用。
使用inlets和outlets为Airflow任务添加数据血缘注释。当用户希望向任务添加血缘元数据、指定输入/输出数据集,或为没有内置OpenLineage提取的操作启用血缘跟踪时使用。
评估并迁移跨云工作负载到Azure。生成评估报告,并将来自AWS、GCP或其他提供商的代码转换为Azure服务。何时使用:将Lambda迁移到Azure Functions,从AWS迁移到Azure,Lambda迁移评估,将AWS无服务器转换为Azure,迁移准备情况报告,从AWS迁移,从GCP迁移,跨云迁移。
验证Kubernetes清单文件的安全性、最佳实践和资源限制
CI/CD流水线设计、优化、DevSecOps安全扫描和故障排除。用于创建工作流、调试流水线故障、实施SAST/DAST/SCA、优化构建性能、实现缓存策略、设置部署、使用OIDC/密钥管理保护流水线,以及解决GitHub Actions、GitLab CI和其他平台上的常见问题。
云基础设施和DevOps工作流程,涵盖AWS、Azure、GCP、Kubernetes、Terraform、CI/CD、监控以及云原生开发。
事件指挥官技能
自动迁移构建系统和CI/CD配置到目标平台。在现代化构建基础设施、切换CI/CD提供商或跨项目标准化时使用。支持常见的迁移路径,包括Maven↔Gradle、npm↔Yarn、Travis CI→GitHub Actions、CircleCI→GitHub Actions、Jenkins→GitLab CI以及GitLab CI→GitHub Actions。分析现有配置,生成等效的目标配置,映射…
设计、组织和管理Helm图表,用于模板化和打包具有可重用配置的Kubernetes应用程序。在创建Helm图表、打包Kubernetes应用程序或实现模板化部署时使用。
用于事件驱动工作负载的无服务器FaaS,基础设施需求极小
全面的Azure合规性和安全审核功能,包括最佳实践评估、Key Vault过期监控和资源配置验证。何时使用:合规性扫描、安全审计、azqr、Azure最佳实践、Key Vault过期检查、合规性评估、资源审查、配置验证、已过期证书、即将过期的秘密、孤立资源、策略合规性、安全态势评估。
AWS Amplify 部署、托管和后端资源。
当用户询问根据所需权限应为某个身份分配哪个角色时,此代理帮助他们理解能够以最小权限满足需求的角色以及如何应用该角色。
Terraform 基础设施即代码的最佳实践
分析ClickHouse系统日志表的健康状况,包括TTL配置、磁盘使用情况、数据新鲜度以及清理情况。用于处理系统日志问题和TTL配置。
开发和排查Gitea Actions工作流。在创建工作流YAML文件、调试CI失败、了解Gitea与GitHub Actions之间特定的语法差异,或在平台间迁移工作流时使用。
ASCN工作空间MCP控制工具的工作流和工具导出操作员。
用于高流量有状态工作负载的线性数据网格架构
根据工作负载需求、性能需求和预算限制推荐Azure虚拟机大小、虚拟机规模集(VMSS)和配置。无需Azure帐户——使用公开文档和Azure零售价格API。何时使用:推荐虚拟机大小,我应该使用哪个虚拟机,选择Azure虚拟机,用于Web/数据库/ML/批处理/HPC的虚拟机,GPU虚拟机,比较虚拟机大小,最便宜的虚拟机,最适合工作负载的虚拟机,虚拟机定价,成本估算,可突发/计算/内存/存储优化的虚…