csvkit Python CSV Utility Suite
csvkit 是一组用于转换、处理和分析 CSV 文件的 Python 命令行工具套件。它包含用于格式转换、使用 SQL 查询 CSV、数据清理、过滤、排序和统计分析的工具。
Browse curated skills with source links, package snapshots, README assets and install signals in one calm, searchable catalog.
csvkit 是一组用于转换、处理和分析 CSV 文件的 Python 命令行工具套件。它包含用于格式转换、使用 SQL 查询 CSV、数据清理、过滤、排序和统计分析的工具。
Polars 是一个用 Rust 编写的超快速 DataFrame 库,支持 Python、Node.js 和 R 绑定。此技能使代理能够利用 Polars 进行高性能的数据操作、转换和结构化数据集的分析查询。
用简单线性回归估算成交额趋势。当用户要线性回归预测、成交额趋势、ml-regression-simple-linear 时使用。轻量接入:点数拟合 → predict;不做完整机器学习平台。
在 Google Analytics 4 和 GSC 中追踪 AI 驱动的搜索流量变化,指导如何识别和衡量来自 AI 搜索的访问。
This skill should be used when a school or institution needs to analyze data for Cognia accreditation self-assessment, continuous-improvement planning, or any structured school data analysis. It opera…
Create pivot table creator operations. Auto-activating skill for Data 当用户需要处理相关业务场景时使用。
Meltano 是一个基于 Singer 规范构建的开源、以 CLI 优先的 ELT 平台。它通过 Singer taps 和 targets 提供声明式、代码优先的数据集成,包含 600 多个连接器,编排从 API、数据库和文件到数据仓库和数据湖的数据移动。
使用MediaInfo库和pymediainfo Python绑定提取全面的媒体元数据。分析视频/音频编解码器参数、容器格式和HDR元数据以进行媒体资产管理。
一个开源的Python库,使从API、数据库和文件中加载数据到结构化数据集变得简单且符合Python风格。dlt自动化模式推断、增量加载和数据规范化,支持DuckDB、BigQuery、Snowflake和Postgres等目标端。
使用 Microsoft Playwright 的 Node.js API 来导航动态网页应用程序,拦截网络请求,并从 React/Vue/Angular 单页应用程序中提取结构化数据,具有自动等待策略。
在企业微信私聊获客场景中,定位从触达到成交之间的流失节点,交付阶段数据看板并以有效回复率复查。当用户提供相关业务资料、要求处理“企业微信私聊获客转化漏斗与阶段数据看板”或需要对应交付物时使用。
空气质量 WORD 研判报告生成流水线。当用户提供城市国控监测站点的逐小时空气质量 Excel(含 PM2.5/PM10/SO2/NO2/CO/O3/AQI)以及逐小时气象 Excel(温度/湿度/风速/降水等),并希望生成结构化的中文 WORD 分析报告(含图表、等级统计、月度/周度特征、气象相关性、站点差异、国标对比、来源分析与管控建议)时,使用本技能。通常与 atmospheric-anal…
在小程序首页流量场景中,找出用户在哪一步退出以及为什么,交付断点整改清单并以首页到目标页点击率复查。当用户提供相关业务资料、要求处理“小程序首页流量流失断点诊断与整改清单”或需要对应交付物时使用。
面向中国互联网与数字产品团队,在产品机会、需求验证、版本规划、用户运营或电商选品中完成用户旅程触点、情绪与机会地图,输出可执行方案、检查点和风险边界。 当用户需要处理相关业务场景时使用。
使用pipe()方法组合将pandas DataFrame转换链into可重现的管道。处理缺失数据插补使用fillna()策略,使用astype()进行类型强制转换,通过category数据类型进行内存优化。
使用Crawlee框架实现智能网络爬取,支持CheerioCrawler和PlaywrightCrawler之间的自适应请求路由。管理请求队列,处理反爬虫挑战,并导出结构化数据。
Maxun 是一个开源的无代码网页数据平台,可将任何网站转换为结构化、可靠的数据。它支持通过录制模式和基于大语言模型的自然语言模式进行数据提取,同时还具备爬取、抓取和搜索功能。凭借 15,000+ 的 GitHub 星标以及 SDK 和 CLI 接口,它能够处理从简单的页面抓取到复杂的自动化工作流等各种任务。
使用 ACCOUNT_USAGE 中的 QUERY_HISTORY 和 ACCESS_HISTORY 视图分析和优化 Snowflake SQL 查询。识别昂贵的扫描操作,推荐聚类键,并通过 WAREHOUSE_METERING_HISTORY 监控仓库信用消耗。
系统级用户研究与分析技能包(七层闭环):定量/定性/实验/治理/激活/建模 + 全谱 UXR(可用性测试/信息架构/OST/竞争/伦理)+ 腾讯问卷联动 + 严格防幻觉报告引擎。
财务/经营管理多维报表分析与编写技能。当任务涉及收入、成本、毛利、净利、费用、 预算执行、现金流、应收应付、资产负债、人效、利润率、同比环比、多年财务趋势、 经营分析会报告、月度经营分析、预算差异分析、量价利分析(volume/price/mix)、 ROI/人效等财务与管理会计数据分析,或编写财务经营分析报告时使用本技能。 触发词:财务、经营分析、收入、成本、毛利、净利、利润、费用、预算、预算执…
当用户要做 词云、文本可视化、热词图、评论关键词、文章高频词、舆情词云时启用。输入文本或「词-频次」表,输出自包含词云 HTML(ECharts wordCloud 或 echarts-cloud),字号映射频次、可 hover。纯前端、跨平台。
Generate a daily hot topics analysis report (早盘版/morning session edition). This skill should be used when the user requests daily hot topic reports, morning market analysis, social media trend analysi…
使用Cheerio的类似jQuery API解析静态HTML,实现快速的服务器端DOM遍历和数据提取。生成的提取模式采用CSS选择器优化,能够抵抗布局变化的影响。
Chartbrew 是一个开源 Web 应用程序,用于从 API、SQL 和 NoSQL 数据库构建和共享实时仪表板。它具有可视化图表构建器、AI 助手、计划报告以及可嵌入的图表用于数据可视化。