sound-design-direction
创建全面的音频设计,包括音乐提示、音效、拟音和配乐指导
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
创建全面的音频设计,包括音乐提示、音效、拟音和配乐指导
机器人操作任务的抓取规划与执行
使用仿真进行机器人控制的RL训练,并实现从仿真到现实的迁移
使用AI图像生成技术为广告创意进行产品摄影增强。接收一张产品图片,并生成5种专业摄影风格供广告使用:工作室、悬浮、成分、使用中和生活方式。需要GOOGLE_API_KEY或配置ADS_IMAGE_PROVIDER。触发词包括:“产品照片”、“产品摄影”、“拍摄”、“增强产品图片”、“产品拍摄”、“广告用产品照片”、“生成产品照片”、“工作室拍摄”、“生活方式照片”。
一个多才多艺的写作助手,可以帮助撰写、改进和转换文本,适用于多种用途,包括电子邮件、信件、报告、社交媒体等
当用户要求“压缩上下文”、“总结对话历史”、“执行紧凑化处理”、“减少令牌使用”,或者提到上下文压缩、结构化摘要、每任务令牌优化,或长时间运行的代理会话超出上下文限制时,应使用此技能。
通过scripts/使用Google Gemini TTS模型从文本生成语音。可用于文本转语音、音频生成、语音合成、多说话人对话以及创建音频内容。支持多种声音和流式传输。触发词包括“text to speech”、“TTS”、“generate audio”、“voice synthesis”、“speak this text”。
Remotion的最佳实践 - 在React中进行编程视频创作。当用户想要创建或编辑视频(动画、字幕、时间、素材)时使用。规则位于rules/目录下;模板位于templates/目录下。
使用理赔数据、临床数据和社会决定因素按风险级别对患者群体进行分层,以优先考虑护理管理干预措施
基于采样和基于优化的运动规划算法
减少仿真与现实差距及验证转移的技术
基于给定文字内容创建精美信息图。当用户请求创建信息图时使用。
世界级的提示工程技能,用于LLM优化、提示模式、结构化输出和AI产品开发。擅长Claude、GPT-4、提示设计模式、少量学习、思维链以及AI评估。包括RAG优化、代理设计和LLM系统架构。在构建AI产品、优化LLM性能、设计代理系统或实现高级提示技术时使用。
处理Unite-Hub的传入电子邮件。提取发件人数据,识别沟通意图,链接到CRM联系人,分析情绪,并使用AI洞察更新联系人记录。
多渠道搜索新产品新技术,交叉验证后存入知识库。当用户提到"最新信息"、"新产品"、"搜索资料"、"查资料"、"了解XX"时使用。
生成高质量的图像提示,专注于建筑几何、戏剧性照明和孤独的人物,突出材料纹理和氛围深度。
从多个来源汇总和分析客户反馈以获取产品洞察
NVIDIA Isaac Sim照片级仿真和合成数据生成的专业技能
AI图像生成用于付费广告创意。读取campaign-brief.md和brand-profile.json文件,使用Gemini(默认)或配置的提供者生成平台尺寸的广告图片。需要GOOGLE_API_KEY或ADS_IMAGE_PROVIDER以及相应的密钥。触发命令包括:“generate ads”、“create images”、“make ad creatives”、“generate vi…
将文本转换为语音音频文件,支持多种声音和语言。
世界级的机器学习工程技能,用于将机器学习模型投入生产、MLOps以及构建可扩展的机器学习系统。精通PyTorch、TensorFlow、模型部署、特征存储、模型监控和机器学习基础设施。包括大语言模型集成、微调、RAG系统和代理AI。当部署机器学习模型、构建机器学习平台、实施MLOps或将大语言模型集成到生产系统中时使用。
在RAG系统中,针对知识质量的预摄入验证,采用9点验证法和两轮HITL工作流程
DALL-E 3图像生成:文本转图像、变体、修复、大小/质量/风格控制
算法自我发现是使AI代理能够启用的上帝模式协议