Maxun无代码网页数据提取平台
Maxun 是一个开源的无代码网页数据平台,可将任何网站转换为结构化、可靠的数据。它支持通过录制模式和基于大语言模型的自然语言模式进行数据提取,同时还具备爬取、抓取和搜索功能。凭借 15,000+ 的 GitHub 星标以及 SDK 和 CLI 接口,它能够处理从简单的页面抓取到复杂的自动化工作流等各种任务。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
Maxun 是一个开源的无代码网页数据平台,可将任何网站转换为结构化、可靠的数据。它支持通过录制模式和基于大语言模型的自然语言模式进行数据提取,同时还具备爬取、抓取和搜索功能。凭借 15,000+ 的 GitHub 星标以及 SDK 和 CLI 接口,它能够处理从简单的页面抓取到复杂的自动化工作流等各种任务。
使用 Microsoft Playwright 的 Node.js API 来导航动态网页应用程序,拦截网络请求,并从 React/Vue/Angular 单页应用程序中提取结构化数据,具有自动等待策略。
用简单线性回归估算成交额趋势与下一期示意值。
系统级用户研究与分析技能包(七层闭环):core 数据接入与生产化、quant 量化分析、 qual 定性研究、exp
逐条读取多个公开的视频号旅游宣传作品的播放和互动数据,输出同口径对比表、差异摘要和缺失数据说明。适合比较一批旅游宣传作品的播放、点赞、评论、收藏和分享表现。
This skill should be used when a school or institution needs to analyze data for Cognia accreditation self-assessment, continuous-improvement planning, or any structured school data analysis. It opera…
Create pivot table creator operations. Auto-activating skill for Data
Meltano 是一个基于 Singer 规范构建的开源、以 CLI 优先的 ELT 平台。它通过 Singer taps 和 targets 提供声明式、代码优先的数据集成,包含 600 多个连接器,编排来自 API、数据库和文件到数据仓库和数据湖的数据移动。
Polars 是一个用 Rust 编写的超快速 DataFrame 库,支持 Python、Node.js 和 R 绑定。此技能使代理能够利用 Polars 进行高性能的数据操作、转换和结构化数据集的分析查询。
使用 ACCOUNT_USAGE 中的 QUERY_HISTORY 和 ACCESS_HISTORY 视图来分析和优化 Snowflake SQL 查询。识别昂贵的扫描操作,推荐聚类键,并通过 WAREHOUSE_METERING_HISTORY 监控仓库信用消耗情况。
在企业微信私聊获客场景中,定位从触达到成交之间的流失节点,交付阶段数据看板并以有效回复率复查。
在 Google Analytics 4 和 GSC 中追踪 AI 驱动的搜索流量变化,指导如何识别和衡量来自 AI 搜索的访问。
财务/经营报表分析
在小程序首页流量场景中,找出用户在哪一步退出以及为什么,交付断点整改清单并以首页到目标页点击率复查。
面向中国互联网与数字产品团队,在产品机会、需求验证、版本规划、用户运营或电商选品中完成用户旅程触点、情绪与机会地图,输出可执行方案、检查点和风险边界。
使用pipe()方法组合将pandas DataFrame转换链into可重现的管道。处理缺失数据插补使用fillna()策略,使用astype()进行类型强制转换,通过category数据类型进行内存优化。
用已发布的零售品牌门店快照,快速分析门店网络、业态分类、区域覆盖、周边画像、品牌对比与坐标选址。适合便利店、超市、药店、化妆品等零售连锁团队做市场与拓展判断。
universal-scraping-architect专用技能,帮助AI Agent高效完成相关任务。
调用Enception API查询指定域名在Google AI Overview和ChatGPT中被AI搜索引用的次数,生成品牌引用报告。
- 平台:WorkBuddy - 上传包:`docs/dist/review-report-1.2.0.zip` - 展示名:亚马逊评论分析报告 · 一键生成VOC - 一句话简介:一条指令走完采集、分析、归档全流程 - 触发名($name):`amazon-review-report` - 归因渠道(UA ch/):`review-report`
通过 Apify API v2 部署自定义 Apify Actors,使用 CrawleeJS 进行大规模网络爬取。利用 Apify 数据集存储、RequestQueue 和代理配置实现大规模分布式抓取。
当用户要做 词云、文本可视化、热词图、评论关键词、文章高频词、舆情词云时启用。输入文本或「词-频次」表,输出自包含词云 HTML(ECharts wordCloud 或 echarts-cloud),字号映射频次、可 hover。纯前端、跨平台。
每日热点信息分析报告
使用Cheerio的类似jQuery API解析静态HTML,实现快速的服务器端DOM遍历和数据提取。生成的提取模式采用CSS选择器优化,能够抵抗布局变化的影响。