alicloud-ai-audio-tts-voice-clone
使用阿里云Model Studio的Qwen TTS VC模型进行声音克隆工作流。当从样本音频创建克隆声音并用克隆的音色合成文本时使用。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
使用阿里云Model Studio的Qwen TTS VC模型进行声音克隆工作流。当从样本音频创建克隆声音并用克隆的音色合成文本时使用。
为自力更生的初创企业提供AI CFO服务。提供财务管理框架,包括现金管理、跑道计算、单位经济效益(LTV:CAC)、资本分配、招聘投资回报率、烧钱率分析、营运资金优化以及预测。
使用DDC CWICR数据库和LLM分类,从Revit/IFC构建n8n流水线以实现自动化成本估算。
为AI代理提供视觉上下文分析。提供网页的屏幕截图、可访问性扫描、DOM快照以及元素描述。当您需要查看网页外观、分析可访问性问题、检查DOM结构或获取详细的元素信息时使用。在收到如“截个图”、“检查可访问性”、“这个页面看起来怎么样”、“分析用户界面”、“检查此元素”或任何视觉/用户界面分析任务请求时触发。
表格数据的探索性数据分析。用于分析列分布、检查数据质量、检查类别平衡、检测缺失模式或为数据集生成汇总统计信息时使用。
AI热点采集工具。从Twitter/X、Product Hunt、Reddit、Hacker News、博客等采集AI相关热点内容。当用户说"开始今日选题"、"采集热点"、"看看今天有什么新闻"、"今日AI热点"时触发。聚焦领域:Vibe Coding、Claude Skill、AI知识管理、AI模型更新、AI新产品、海外热点。支持输出 Markdown 和 HTML 文件。
轻量级本地语音转文字和文字转语音服务,适用于OpenClaw
在iOS应用中实现计算机视觉功能,包括文本识别(OCR)、面部检测、条形码扫描、图像分割、对象跟踪和文档扫描。涵盖了现代的Swift原生Vision API(iOS 16+)以及传统的VNRequest模式,使用VisionKit的DataScannerViewController进行实时相机扫描,并使用VNCoreMLRequest执行自定义模型推理。当需要添加OCR、条形码扫描、面部检测或带有…
使用Seedream生成或优化图像(文本到图像+图像到图像)。
总结过去N小时的通讯/电子邮件信息并提出跟进建议。
将原始会议记录转换为高保真、结构化的会议纪要,并通过迭代审查确保完整性。此技能应在以下情况下使用:(1) 提供了会议记录并要求生成会议纪要、笔记或摘要;(2) 需要合并多个版本的会议纪要而不丢失内容;(3) 需要根据原始记录审查现有纪要,查找缺失项;(4) 记录中包含匿名发言人(如“发言人1/2/3”)需要识别。功能包括:通过特征分析(词数、说话风格、主题焦点)和context.md团队目录映射进…
使用Seedance 2.0(字节跳动/Dreamina/吉盟)生成并指导电影级AI视频。涵盖文本到视频、图像到视频、视频到视频以及参考到视频的工作流程,支持@Tag资产引用、多角色场景、音频设计和后期处理。适用于制作AI视频、编写Seedance提示词、导演场景、修复生成错误或构建AI短片、产品广告或音乐视频。
使用字节跳动Seedream 4.5模型生成专业的AI增强照片。当用户想要:(1) 创建具有各种风格的肖像,(2) 生成情侣或家庭合影,(3) 与电影角色合影,(4) 编辑图片(更换服装、背景、材质、风格),(5) 合并多张照片(服装融合、人物风景融合、品牌设计),(6) 创建一系列相关图片(季节、角色状态、故事序列),(7) 设计海报(电影、活动、产品)或者(8) 使用自定义提示以完全掌控创意时…
使用Nano Banana PRO(Gemini 3 Pro 图像)和Nano Banana(Gemini 2.5 Flash 图像)生成AI图像。在以下情况下使用此技能:(1) 从文本提示生成图像,(2) 编辑现有图像,(3) 创建专业的视觉资产如信息图、标志、产品照片、贴纸,(4) 在多张图片中保持角色一致性,(5) 创建具有准确文本渲染的图像,(6) 任何需要AI生成视觉的任务。触发词包括:…
小红书评论回复自动化工具
基于YOLOv8的摄像头监控系统,支持物体检测。兼容任何支持RTSP流或HTTP快照的IP摄像头(如海康威视、大华、Reolink、Amcrest、Unifi等)。能够识别80多种物体类型(人、汽车、狗等),并在检测到目标时发送带有快照的通知。可用于运动检测、夜间巡逻或安全监控。
图像处理和优化。Sharp (Node.js),Pillow (Python),Cloudinary,响应式图像,WebP/AVIF转换,缩略图以及基于CDN的图像变换。使用时机:用户提到“图像大小调整”,“缩略图”,“图像优化”,“Sharp”,“Pillow”,“Cloudinary”,“WebP”,“AVIF”,“图像上传处理”。不用于:文件上传处理 - 请使用`file-upload`;云…
运行具有明确回退策略和可审计执行记录的弹性多工具问题解决程序。
使用Kling AI从文本提示生成视频。在根据描述创建视频或学习提示技巧时使用。可以通过诸如'kling ai text to video'、'klingai prompt'、'generate video from text'、'text2video kling'等短语触发。
AI驱动的渗透测试工具、红队框架和自主安全代理指南
适用于跨代适应的进化稳健技能模式。达尔文-哥德尔机器原理用于自我改进的技能生态系统。
透明、严谨的研究,包含完整的方法论 —— 而不是一个黑盒API封装。通过每个主题要求的2轮研究周期、APA 7th引用格式、证据层次结构以及3个用户检查点来进行详尽调查。使用原生OpenClaw工具(web_search, web_fetch, sessions_spawn)自给自足。适用于文献综述、竞争情报或任何需要学术严谨性和可重复性的研究。
当要求从图像中的二维码或条形码扫描、解码、读取或提取数据时使用。
图像提示模板、模型选择指南以及生成视觉素材时的反通用模式。当用户需要为登录页面、营销或产品生成AI图像时使用。涵盖英雄图像、功能插图、OG卡片、图标和背景。