ai-image-gen
使用AI SDK通过ai-img CLI生成或编辑图像(支持多个提供商:OpenAI、Google、Fal)。使用场景:(1) 根据文本提示生成图像,(2) 使用AI编辑现有图像,(3) 批量处理多个提示。需要提供者API密钥(OPENAI_API_KEY、GOOGLE_API_KEY 或 FAL_API_KEY)。位于 ~/Developer/ai-img。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
使用AI SDK通过ai-img CLI生成或编辑图像(支持多个提供商:OpenAI、Google、Fal)。使用场景:(1) 根据文本提示生成图像,(2) 使用AI编辑现有图像,(3) 批量处理多个提示。需要提供者API密钥(OPENAI_API_KEY、GOOGLE_API_KEY 或 FAL_API_KEY)。位于 ~/Developer/ai-img。
使用simplicity-cli从本地文件或URL自动填充PDF表单,监控异步任务执行,并下载已填写的PDF。当用户要求使用AI填写表单、从上下文/源文档运行表单自动填充、检查任务状态、等待完成或调试CLI工作流/授权行为时使用。
从World Weaver构建当前任务的全面记忆上下文
智能截图和屏幕捕捉,具备OCR、Markdown转换和注释功能。通过PrtSc键触发,可以捕获屏幕区域,使用OCR提取文本,利用MarkItDown将内容转换为Markdown格式,并自动格式化保存。类似于Windows截图工具,但增加了AI增强的文本提取和文档处理功能。
将媒体资源(GIF、视频)以垂直/水平方式组合成复合教程
将一个复杂的问题委托给Gemini Deep Think
使用[Harbor](https://github.com/av/harbor)设置和运行本地LLM的指南。当用户希望在本地运行LLM、设置Ollama、打开WebUI、llama.cpp、vLLM或类似的本地AI服务时使用。涵盖了从Docker先决条件到运行模型、配置、配置文件、隧道以及高级功能的完整设置过程。
当用户要求“从照片创建头像”、“生成肖像头像”、“制作个人资料图片”、“将头像转换为风格化肖像”、“团队成员头像”、“角色风格头像”,或需要在任何风格(包括像素艺术)中保留相似性的头像时,应使用此技能。
AISBench Benchmark - 用于Ascend NPU的AI模型评估工具。支持准确度评估(文本、多模态数据集上的服务/本地模型)、性能评估(延迟、吞吐量、压力测试、稳态、真实流量模拟)、vLLM/Triton推理服务、15+基准测试(如MMLU、GSM8K、MMMU、docvqa、ocrbench_v2等)、多轮对话、函数调用(BFCL)以及自定义数据集。
查询并贡献Radar,这是一个共享的知识库,为代理提供关于网站的结构化知识——包括导航流程、选择器、脚本、注意事项等。
世界编织系统中的内存可视化和图表绘制
将任务委派给具有配额和日志记录功能的外部LLM服务(Gemini,Qwen)
使用VHS磁带文件生成终端录制,输出GIF格式。
利用Slack用户资料、在线状态、勿扰状态和工作区上下文来个性化响应、路由升级请求以及协调团队操作
使用tinygrad进行深度学习框架开发 - 一个带有自动梯度、即时编译和多设备支持的最小张量库。在编写神经网络、训练模型、实现张量操作、使用UOps/PatternMatcher进行图转换或贡献tinygrad内部时使用。当导入tinygrad、执行张量操作、使用nn模块、优化器,或者处理调度/代码生成工作,或是设备后端时触发。
兼容性别名,用于处理遗留的像素头像请求。当旧提示明确引用了pixel-avatar时,请使用此技能,然后以像素艺术风格的要求路由到avatar-portrait。
使用@google/genai SDK(JavaScript/TypeScript)通过Google的Veo 3.1 API生成视频。当用户想要:从文本提示生成视频、将图像动画化为视频、在两帧之间插值、扩展现有视频、使用参考图像进行样式/资产指导,或构建任何涉及使用Veo进行AI视频生成的应用程序时,请使用此功能。触发条件包括提到:Veo、视频生成、文本到视频、图像到视频、AI视频。
触发和管理世界编织者的记忆整合
从世界编织者中使用多策略检索回忆记忆
使用Playwright记录浏览器会话,用于网页UI教程和转换
将技术文章草稿或原始材料转化为类似人类撰写的高质量日语技术文章。当用户希望按照特定的人类写作模式和风格指南生成、重写或使技术文章(特别是关于TypeScript、JavaScript、React或前端主题的文章)更加人性化时,使用此技能。触发条件包括诸如“記事を人間風に”、“生成 tech article”、“humanize this article”或提供文章原始材料等请求。
使用edge-tts对Slack中的语音片段同时进行文本和MP3语音回复。语音输入已经由OpenClaw转录处理。
基于 Langfuse 的引导式内省循环 Agent 配置调优。用户要求"调优 agent/优化 prompt/改进 agent 表现/agent-tuning"时触发,通过「调用 → 轨迹分析 → 内省 → 配置修改」循环迭代优化 TargetAgent 的系统提示词、工具描述和 few-shot 示例。
当用户要求“询问Gemini”、“获取Gemini的意见”、“让Gemini审查”、“改进写作风格”、“减少AI感”、“对文章进行反馈”、“审查此草稿”、“Nano Banana”、“Gemini API帮助”、“Gemini模型”,或需要对内容、写作、代码或设计的第二意见时,应使用此技能。支持文本问题和最多10张图片。