htmlq 命令行 HTML 内容提取器,支持 CSS 选择器
htmlq 是一个命令行工具,使用 CSS 选择器从 HTML 中提取内容,相当于 jq 的 HTML 版本。该工具使用 Rust 编写,允许你通过 CSS 选择器将 HTML 管道化,直接从终端提取文本、属性和结构化内容。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
htmlq 是一个命令行工具,使用 CSS 选择器从 HTML 中提取内容,相当于 jq 的 HTML 版本。该工具使用 Rust 编写,允许你通过 CSS 选择器将 HTML 管道化,直接从终端提取文本、属性和结构化内容。
使用Scrapy和scrapy-redis进行大规模网络爬取,实现分布式任务队列。集成Splash进行JavaScript渲染,通过scrapy-mongodb管道将结果存储到MongoDB,并使用AutoThrottle遵守robots.txt规则。
Count game inventory icons by rarity tier (SSR/UR/SR etc.) from screenshot images. This skill should be used when the user asks to count, tally, or summarize quantities of game item icons displayed in…
优先使用可用的浏览器自动化打开 GeneCards 搜索结果页并下载 CSV 结果,再本地解析产出标准化基因列表。若浏览器自动化不可用,则提示用户手动保存文件到 np-output/disease 目录并等待继续处理。
当代理需要解释两个结构化导出之间发生了什么变化,而不仅仅是文件不同之处时,请使用 csv-diff。该代理通过一个稳定的键对记录进行匹配,报告新增、删除和修改的行,并可将结果以可读文本或机器友好的 JSON 格式交给人类或下游自动化处理。
输入业务流程、关键指标和现有代码,产出事件字典、埋点方案与数据验证清单,适合产品、数据和研发团队。 当任务涉及业务监控埋点并要求可追踪交付时使用。
输入股票市场热点题材或主题,自动追踪并整理其核心定义、关键驱动事件、关联个股、资金流向与近期动态,输出结构化追踪卡片。适用于A股短线题材挖掘、热点轮动预判、概念板块快速摸底等场景,覆盖政策催化、产业风口、突发事件等多维度信息,所有关键事实标注来源类型,不臆造数据。
当代理从收件箱、支持系统或抓取页面接收原始HTML并需要在分类、摘要或索引之前获得可读的纯文本时,请使用html-to-text。该技能被有意限制在确定性的HTML到文本转换,而不是爬取或摘要。
Metabase 是一个开源商业智能平台,用于查询数据、构建仪表板和嵌入分析功能。它为代理提供了一个真实的分析界面,用于回答运营问题、创建仪表板,并将自助服务报告连接到数据库或数据仓库后端。
将“资料拆分/精准解析→知识结构化→数据集方案设计与优化→初稿生成→多专家评审→逐条修订验证→复盘报告与版本交付”的完整数据集建设链路标准化。适用于把一次数据集建设、微调数据集治理、RAG/Agent 评测集构建、专家评审修订项目沉淀为可复用复盘、SOP、交付清单和质量门禁。遇到用户要求“复盘数据集建设流程”“把复盘沉淀成规范/skill/SOP”“专家评审后修订闭环”“生成 vX draft 复…
自动化分析最新注册的.ai域名,发现AI领域的商业机会和投资趋势
prompt-master
dynamic-personal-profile-skill
使用 Courlan 在爬虫、抓取器或分析器队列处理原始URL库存之前,对其进行清理、标准化、去跟踪和语言过滤。当代理已经拥有过多的候选链接并需要更小、更干净的边界时效果最佳,而不是完整的爬取堆栈。
Clarifies a vague clinical or biomedical research idea into a structured, bounded, searchable, researchable, and testable question. Always use this skill whenever a user has an early-stage clinical or…
从微信朋友圈导出的 Markdown 长文本中,生成基于证据的多年生命叙事、身份跃迁、价值观、写作风格、个人品牌与商业/IP线索深度分析报告。用于朋友圈复盘、个人成长分析、生命长河、个人品牌诊断、IP故事素材提炼与信任资产分析;默认输出报告风格的 PDF。
阿拉丁·AI短剧竞品对标工坊把「立项前不知道同题材已经多卷、盲目跟风扎堆题材被淹没、看不出竞品爆款靠什么套路火、付费墙该卡第几集心里没底、想做差异化却找不到空白切口」升级成一条纯本地零依赖的投前竞品情报工具链:多源导入(手填竞品剧 JSON 数组/平台榜单导出 CSV 或 TSV,中文表头别名自动匹配,1.2亿·9800万·3,500·42% 等人类数值自动清洗)→题材归一到 15 标准题材词典+…
文本统计技能,用于统计字数、行数、段落数、句子数、字符数等。触发场景包括:用户要求统计文本的的字数/行数/段落数、统计一段文字的详细信息、统计文件或剪贴板中文字数、生成文本报告。
为公众号文章创作打造的专业数据洞察工具。全网持续收录每日爆款文章,收录依据:低粉高阅读、阅读靠前、数据增长中、原创靠前,助力号主获取数据参考。
基于15部曾国藩原著、权威评传与深度研究的 CodeBuddy Skill,提炼6个核心心智模型、10条决策启发式和完整的表达DNA。
为受治理的语义数据提供上下文,使数据问题映射到可信的指标和模式。
输入打卡记录、排班表和考勤规则,产出异常明细、原因分类与复核建议,适合门店管理、人事和区域负责人。 当任务涉及门店考勤异常分析并要求可追踪交付时使用。
使用DataHub元数据、所有权、模式和血缘上下文来支撑代理辅助的数据发现和治理工作流。
在摘要、索引或归档网页之前,当代理需要从嘈杂的网页中提取干净的、富含元数据的文章文本或Markdown时,请使用Defuddle。