computer-vision-expert
SOTA 计算机视觉专家(2026)。专长于YOLO26、Segment Anything 3 (SAM 3)、视觉语言模型以及实时空间分析。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
SOTA 计算机视觉专家(2026)。专长于YOLO26、Segment Anything 3 (SAM 3)、视觉语言模型以及实时空间分析。
分析用户上传的文档(PDF、TXT、Word等),提取关键信息,生成摘要、大纲或详细分析报告。
深入的像素艺术专业知识,涵盖基础、有限调色板、抖动图案、子像素动画、瓷砖设计、复古硬件限制以及HD-2D混合技术。这些知识是Claude通常不会从像Pedro Medeiros (saint11)这样的独立大师那里获得的。当提到“像素艺术、精灵艺术、抖动、有限调色板、子像素动画、图块集、自动平铺、枕头阴影、选择性轮廓、selout、色调偏移、色彩渐变、NES风格、SNES风格、HD-2D、Asep…
AI屏幕记忆 — 搜索您在电脑上看到或听到的所有内容。与Screenpipe的本地MCP服务器集成,用于OCR文本、音频转录和应用程序使用历史记录。
`ecomm-video-allinone` 是一个电商视频生产技能,包含 1 个主编排文件 + 8 个子能力文档 + 3 组执行脚本,协同完成从参考视频拆解、脚本拆解、宫格生图、视频提示词到最终图片/视频下载的完整流程。
通过 MiniMax MCP 进行图像理解,适用于 OpenClaw 平台。如果你是 Claude Code 用户,请忽略此技能。
支持多种风格的知识漫画创作者(如Logicomix、Ligne Claire、欧姆社漫画指南)。能够创作出具有详细分镜布局和连续图像生成的原创教育漫画。当用户要求创建“知识漫画”、“教育漫画”、“传记漫画”、“教程漫画”或“Logicomix风格漫画”时使用。
聚合多个图片 API 的脚本技能(动漫/随机美图等)。
公众号初稿写作技能。用于在选题和大纲已确认后,基于参考资料、语音底稿和文风 DNA 生成一版高保真初稿。适用于正文写作阶段,不负责选题、大纲和标题决策。
精通所有流派的音乐创作、MIDI编程、音频合成、音乐理论和编曲。在创作音乐、创建MIDI文件、生成旋律/和声/节奏、编排曲目或处理音阶、和弦、进行和管弦乐编配等音乐概念时使用。
RNN+Transformer混合模型,具有O(n)推理。线性时间,无限上下文,无KV缓存。像GPT一样并行训练,像RNN一样顺序推理。Linux基金会AI项目。已在Windows、Office、NeMo中投入生产。RWKV-7(2025年3月)。模型参数多达140亿。
使用AI模型(FLUX,Nano Banana 2)生成或编辑图像。适用于包括照片、插图、艺术品、视觉素材、概念艺术在内的通用图像生成,但不包括技术图表或示意图。对于流程图、电路图、路径和技术图表,请改用scientific-schematics技能。
合同分析和谈判支持技能,包括条款提取和风险识别
OpenAI的通用语音识别模型。支持99种语言,转录,翻译成英文,以及语言识别。六种型号大小从微型(39M参数)到大型(1550M参数)。可用于语音转文字、播客转录或多种语言音频处理。最适合强大且多语言的自动语音识别(ASR)。
使用Qwen3-TTS-12Hz-1.7B-CustomVoice进行本地文本转语音。当从文本生成音频、创建语音消息或请求TTS时使用。支持包括意大利语在内的10种语言,9种高级发音人声以及基于指令的声音控制(情感、语调、风格)。是像ElevenLabs这样的基于云的TTS服务的替代方案。在初次下载模型后完全离线运行。
自我学习能力,用于代理。捕获执行轨迹,提取见解,并适应代理行为。在完成复杂任务后、当代理遇到重复问题时或随着时间推移优化工作流程时使用。对于像协调者、工作者和审查者这样的多代理系统至关重要。
面向公众号作者的文风 DNA 梳理技能。用于从 3-10 篇参考文章中建立可复用的风格画像,输出 14 维分析、标点符号偏好、分块习惯、段落配方、叙述方法体系、内容推进方式和默认 DNA 文件,并通过用户校准确保画像可直接给写稿技能调用。
收集每日股市热点问题和主要波动股票,为MeowStreet Wars视频制作提供素材。识别出价格有显著变化的股票代码,并设置冲突叙述(多头与空头)。
全面的科学研究工具包,包含139项专门技能,涵盖生物学、化学、医学、数据科学和计算研究。将Claude转变为具有访问科学数据库、分析工具和特定领域工作流程能力的人工智能研究助手。
Recommend suitable prompts from 10,000+ Nano Banana Pro image generation prompts based on user needs. Optimized for Nano Banana Pro (Gemini), but prompts also work with Nano Banana 2, Seedream 5.0, GP…
专门用于AI产品摄影的技能。当您需要专业的产品照片、主图、生活方式摄影或电商视觉时使用。触发条件:产品照片、主图、电商照片。输出可用于生产的成品照片。
记忆是智能代理的基石。没有它,每次互动都得从零开始。这项技能涵盖了代理记忆的架构:短期(上下文窗口)、长期(向量存储)以及组织它们的认知架构。关键见解:记忆不仅仅是存储——它是检索。即使存储了一百万个事实,如果你找不到正确的那一个,这些事实也没有意义。分块、嵌入和检索策略决定了你的代理是否记得或忘记。这个领域是零碎的
查找超过450个日语电影、摄影和制作术语,包括英文对应词和适用于Seedance 2.0的提示短语,涵盖20个类别,包括动作、武器和战斗的安全过滤词汇。在用日语编写提示或把制作概念翻译成日语Seedance词汇时使用。
一个通用的4x4网格贴纸生成器。使用严格的视觉指南(无文本,透明背景),并支持从资源中加载主题模板。