steering-behaviors
用于群集、避障和群体移动的转向行为技能。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
用于群集、避障和群体移动的转向行为技能。
用于回声消除和编解码优化的语音聊天技能
从文本描述生成多种格式的图表。创建包括流程图、序列图、架构图(C4)和数据模型在内的Mermaid、PlantUML、D2和Graphviz图表。
从模拟图像中提取设计规范,包括颜色、字体、间距和组件细节
使用transformers库、BERT、GPT构建NLP应用程序,进行文本分类、命名实体识别和情感分析
分析时间数据模式,包括趋势、季节性、自相关以及用于时间序列分解、趋势分析和预测模型的预测
将视频脚本转换为更适合实际录制的口语化表达,去除书面化语言,增加自然感和亲和力。当用户提到"视频脚本"、"录制"、"口语化"、"自然一点"、"像说话一样"、"太书面了"时使用此技能。
代理工作流设计器
Substance Painter/Designer技能,用于烘焙和材质导出。
NVIDIA硬件视频编码/解码集成。配置NVENC编码参数,设置NVDEC解码流水线,处理编解码器配置,与CUDA集成进行预处理和后处理,并管理视频内存表面。
生成符合WCAG标准的可访问颜色调色板
AI图像生成用于付费广告创意。读取campaign-brief.md和brand-profile.json文件,使用Gemini(默认)或配置的提供者生成平台尺寸的广告图片。需要GOOGLE_API_KEY或ADS_IMAGE_PROVIDER以及相应的密钥。触发命令包括:“generate ads”、“create images”、“make ad creatives”、“generate vi…
使用协同过滤、基于内容的过滤、矩阵分解和神经网络方法构建推荐系统
通过scripts/使用Gemini Embedding API生成文本嵌入。用于创建文本的向量表示、语义搜索、相似度匹配、聚类以及RAG应用。触发词包括“embeddings”、“semantic search”、“vector search”、“text similarity”、“RAG”、“retrieval”。
消除会侵蚀读者信任的人工智能生成的写作模式。在撰写文章、文档、新闻稿或任何人工智能模式会损害可信度的内容时激活。对于需要听起来像人类输出的使用人工智能辅助的记者来说是必不可少的。
管理AI网关,用于路由、保护和监控ML操作中的AI服务请求。
用于评分函数和决策的实用AI技能
AI/ML模型的安全测试和对抗性研究能力。生成对抗样本,测试模型的鲁棒性,执行模型提取攻击,测试数据投毒,分析模型公平性,并支持ART框架集成。
生成响应式图像集,包括srcset、WebP/AVIF转换和艺术指导
使用AI图像生成技术为广告创意进行产品摄影增强。接收一张产品图片,并生成5种专业摄影风格供广告使用:工作室、悬浮、成分、使用中和生活方式。需要GOOGLE_API_KEY或配置ADS_IMAGE_PROVIDER。触发词包括:“产品照片”、“产品摄影”、“拍摄”、“增强产品图片”、“产品拍摄”、“广告用产品照片”、“生成产品照片”、“工作室拍摄”、“生活方式照片”。
构建协同过滤和基于内容的推荐引擎,用于产品推荐、个性化服务以及提高用户参与度
OCR領収书自动分类工具。通过OCR读取图像(JPEG/PNG)/PDF/ZIP/视频(MP4/MOV)中的领収书,并提取日期、金额、国家、卡片和用途等信息,然后按标准文件名重命名并按项目单位进行分类。附带Markdown格式的摘要报告。支持D365 Expense类别映射与收据附件联动。使用场景:(1) 领収书整理, (2) 收据分类, (3) 收据分拣, (4) 将费用收据整理到文件夹中, (…
分析传入的用户请求以检测意图、请求类型(设计/验证/调试/文档)、复杂程度,并识别需要澄清的模糊需求或流行语。在cto-orchestrator接收到需要在路由给专业代理前进行分类的新请求时使用。
OpenAI Whisper API:音频转录、翻译、结构化输出、大文件处理