Hacker News 深度线程分析器
使用官方HN Firebase API和BeautifulSoup抓取并分析Hacker News线程。提取情感趋势、专业信号,并生成结构化摘要,映射关键论点。
Browse curated skills with source links, package snapshots, README assets and install signals in one calm, searchable catalog.
使用官方HN Firebase API和BeautifulSoup抓取并分析Hacker News线程。提取情感趋势、专业信号,并生成结构化摘要,映射关键论点。
通过 Apify Client SDK 协调 Apify actors 进行大规模网络爬取。通过 Apify API v2 管理 actor 运行、数据集导出和代理配置。
做政策评估与因果识别:双重差分 DID、倾向得分匹配 PSM、工具变量法 2SLS、GMM 广义矩估计、断点回归 RDD。导入 Excel/CSV 数据 + 指定处理变量/工具变量,自动出处理效应、平行趋势、显著性检验与解读。适用于政策效果、项目评估、内生性问题处理。提及双重差分、DID、倾向得分、PSM、工具变量法、工具变量、2SLS、GMM、断点回归、RDD、因果识别、政策评估、处理效应、反事…
使用 Crawl4AI 运行网页爬取和数据抓取工作流,Crawl4AI 是一个开源爬虫,旨在生成 LLM 就绪的 markdown 和结构化提取输出。它支持异步爬取、浏览器自动化钩子、深度爬取、CLI 使用以及基于 Python 的数据管道。
企业HR风险预警仪表盘:用工风险指标实时监测+预警阈值+预警通知+处置建议。支持自然语言或直接上传文件;缺少动态口径时提示核验,不编造结果。
Create clear, effective charts and dashboards from structured data using matplotlib, seaborn, and plotly. 当用户需要处理相关业务场景时使用。
查询 WorkBuddy 本地 token/积分用量统计。当用户询问"消耗了多少token、本次会话token、今天/今日累计token、指定日期/时间段token、总累计token、积分用量、会话用量排行、按模型统计token"时使用。数据来自 ~/.workbuddy/traces/。所有输出必须使用中文。
人效指标看板:人均营收/人均利润/元均薪酬产出/人均客户数等指标看板。支持自然语言或直接上传文件;缺少动态口径时提示核验,不编造结果。
Crawlee 是 Apify 面向 Node.js 的开源爬取和抓取框架。它统一了 HTTP 抓取和浏览器自动化,增加了队列、存储、重试、代理等功能,并让开发者可以在 Playwright、Puppeteer、Cheerio 和 JSDOM 之间切换而无需重建整个管道。
查询 Common Crawl Index API 和 CC-MAIN 数据集,以大规模获取历史 URL 覆盖范围、MIME 类型和抓取快照。适用于需要广泛网页召回率的研究工作流程,而无需从头构建完整的爬虫。
输入长读长测序读段,统计 N50、长度分布区间和模糊碱基比例,返回长读长质量摘要和警告。 / Summarize long-read N50, length bins, and ambiguous-base ratio from reads or FASTQ content, returning quality warnings.
分析大规模用户反馈数据以识别市场细分、衡量满意度、发现产品改进机会,按用户群体和情感分类组织洞察。
当用户要做 门店热力图、城市分布热力、网点密度、开店选址可视化时启用。输入门店坐标(lng/lat 或 地址→地理编码),用高德地图热力图层生成自包含 HTML,颜色越红越密集。需联网 + 高德 Key,跨平台。
批量检测 Excel/CSV 中"标题"列的错别字、人名错误、术语错误、语病、帝王内容、前后不一致与事实性错误。当用户上传 .csv/.xls/.xlsx 文件并希望对其中某一列(默认"标题"列)逐行做内容审核/错别字排查时使用本技能。输出为在原文件右侧新增"标题检测结果"列的已审核文件。
「全球GDP」单指标数据速查 Skill,隶属国家数据速查系列(母版 z-cn-data-radar)。专注该指标的最新值查询、往年历史罗列、同比/环比对比、口径百科、异常预警、跨指标联动与结果导出;复用母版方法论,联网优先+快照兜底,绝不编造数据。
数据太多反而不会看。这套框架帮你把独立站压缩到五个核心指标和一张周报看板,让你每周十分钟就知道生意好坏和该动哪里。
为Snowflake、BigQuery和Redshift生成和验证dbt(数据构建工具)模型、测试和文档。解析dbt manifest.json以分析DAG血缘关系并检测循环依赖。
添加抖音号建立追踪名单,每次检查自动拉取最新作品并与上次对比,报告新增视频(标题、发布时间、点赞/评论/分享/收藏、链接)。触发词:追踪抖音号、抖音监控、竞品雷达、抖音有什么新视频、抖音新作品。
输入 CLIP 峰文件,统计 RNA 结合蛋白峰数量、宽度分布以及窄峰/宽峰数量,返回可复核的结合位点摘要。 / Summarize RNA-binding-protein CLIP peaks with peak counts, width distribution, narrow/broad counts, and auditable issue notes.
Analytics de produto — PostHog, Mixpanel, eventos, funnels, cohorts, retencao, north star metric, OKRs e dashboards de produto. 当用户需要处理相关业务场景时使用。
使用 Tabula Java 库通过 tabula-py 绑定来检测和提取 PDF 文档中的表格。支持网格和流提取模式,可配置区域坐标,并输出为 pandas 数据框或 CSV 格式。
招聘成本分析:单人次招聘成本+渠道成本+周期成本+部门对比。支持自然语言或直接上传文件;缺少动态口径时提示核验,不编造结果。
数据分析专家技能。当用户提供数据表格(CSV/Excel 文件或直接粘贴的表格)并希望得到一份结构化分析、结论与行动建议时使用——尤其针对电商数据(订单/GMV/转化/复购)、用户数据(RFM 分层/同期群留存/流失)与销售数据(趋势...
在Apify平台上使用Apify SDK和RequestQueue及Dataset API部署智能网络爬虫代理。通过Apify CheerioCrawler和PlaywrightCrawler处理动态内容,并具备自动扩展功能。