CSV 数据清洗工具
零依赖的本地 CSV 清洗工具,支持去重、单元格去空格、删除空行、统一分隔符,输出干净可分析的表格。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
零依赖的本地 CSV 清洗工具,支持去重、单元格去空格、删除空行、统一分隔符,输出干净可分析的表格。
内容采集器脚手架。当用户需要把网页 / 文章 / PDF / 图片 / 音频 / 视频等内容抓取并转为带 frontmatter 的 markdown 落盘时使用;特别是要构建一个「不依赖 LLM、不接 IMA、不做 MCP」的独立采集程序,或要为某软件快速搭建可插拔适配器(今日头条 / 知乎 / 小红书 / 抖音 / 通用网页 / 本地文件)的采集能力时。提供完整 Python 脚手架与新增适配…
用于获取冷西西韭菜50指数成分股,作为“避雷/拥挤度/市场情绪”研究与监控工具。该指数是一条公开、每日调仓的 A 股散户拥挤度反向理论指数。它在每个交易日收盘后,以追涨热度、换手放大、龙虎榜注意力和特大单流量拥挤度四类信号,对合格股票做横截面排名,并记录综合分最高的 50 只股票在下一交易日开盘至再下一交易日开盘的理论等权收益。
对单只A股做深度诊断——回答"为什么涨、市场在price什么故事、处于产业链哪环、与正宗核心同业比如何",覆盖技术面+资金流+基本面+叙事逻辑。内部研究版(点名个股、给关键价位)。所有结论必须基于 tdx/westock/neodata 真实数据,禁凭记忆编造。输出自然语言诊断报告 + ECharts HTML 看板(真实K线/资金流/重估雷达/同业对比/产业链价值/证据审计)。
新概念英语课后陪练(Leo新概念英语私教)。用于批改新概念英语课后练习、巩固墨墨背单词词汇、自然聊天中穿插语法巩固。当用户提到新概念英语、NCE、课后练习批改、英语练习、单词巩固、英语陪练、英语语法练习时使用。也适用于用户做完英语练习需要批改、背完单词需要巩固的场景。
用 akshare 一键获取 A 股历史行情等公开数据并存为 CSV。当用户说「拉一下茅台的股价」「导出国电南瑞的历史数据」「查个概念板块」时使用。基于 akshare(纯 Python + requests,无重依赖;需联网)。中文市场的强需求场景。
SBR(Structure-Behavior-Relation)结构行为关系可视化建模技能。当用户需要把一段系统/业务/概念清晰画成"结构-行为-关系"三维架构图(SVG),或提到"架构图"、"流程图"、"系统可视化"、"SBR 建模"、"结构行为关系图"、"画一张XX的架构图"、"SBR"、"structure-behavior-relation"时使用——自动产出 1600×900 深色主题单…
对 CSV/Excel 数据做描述统计与相关分析,一行命令出结果。当用户说「帮我看这组数据的基本统计」「两列相关性强不强」「做个 t 检验」时使用。基于 pingouin(依赖 numpy/scipy/pandas,均为标准科学计算栈,无 torch 重依赖)。
使用场景:当用户发送账单/转账截图需要解析存档,或需要按月统计账单收支数据时使用。触发词:账单存档、记账、对账、月度统计、账单解析、存档账单、统计账单。
Recommend authoritative machine-readable data sources and how to fetch them. | Trig: Data Source Map, research this
Write stable compliant runnable scraper scripts. | Trig: Scraper Workshop, write code
对制造业/封头生产过程质量问题统计表做系统性归因分析。自动归类缺陷→帕累托锁定关键少数→逐问题施加 IE 七大手法(流程程序/动素/双手作业/人机配合/工作抽样/动作经济/标准工时)+ 鱼骨图 + 5Why,输出根因/影响因素/改进方向,并生成 HTML(内嵌SVG图) + 可编辑 DOCX 报告。适用于 质量异常分析、生产改善、IE诊断、QC报告、毕业论文案例 等场景。
Investigate duplicate keys, null keys, join amplification, grain mismatches, and abnormal row counts in SQL and data pipelines. Use when asked to trace a data quality anomaly to its first bad partitio…
按简单规则校验 CSV/Excel 数据表:列类型、取值范围、是否可空。当用户说「校验这份数据对不对」「检查表里年龄是不是都在合理范围」「入库前验下表结构」时使用。基于 pandera(纯 Python,pandas 后端)。
把公开竞品数据整理成对比矩阵,按权重做 min-max 归一化评分与排名,生成 SWOT 式洞察与可溯源报告。纯本地运行,数据不出本机。支持 CSV/JSON、权重配置、Markdown 与 JSON 输出。
把系统/过程/对象建模成可计算可分析的形式:选输入输出还是内部状态、怎么做模型辨识、怎么判断近似够不够用。
为某类问题推荐权威、可机读的数据源与获取方式。|能力:多源检索与去重|触发:权威数据源导航、帮我调研、研究一下、查一下这个
Quickly map a competitor features pricing reviews and tactics into an actionable benchmark. | Trig: Competitor Spy Pro, research this
围绕一个产品想法做需求、竞品与体验调研,给出功能优先级。|能力:多源检索与去重|触发:新品调研官、帮我调研、研究一下、查一下这个
医药投资尽调中的医生访谈提纲生成技能。当投资人/分析师需要对创新药标的进行医生访谈以评估临床价值、市场竞争格局、处方意愿与商业化前景时触发。核心输出为结构化医生访谈提纲,包含按药物类型/尽调阶段/访谈对象分层的问题清单及追问路径。信息缺失时必须向使用者提问,不得假设或编造。触发词包括:医生访谈提纲、医生访谈、医生尽调、KOL访谈、处方行为调研、临床价值评估、医生调研、physician inter…
抖音博主主页内容批量抓取与知识蒸馏流水线。当用户要求抓取/采集某抖音博主的主页视频口播稿与文案、批量蒸馏博主全部作品为知识卡片、生成博主内容库 Excel 总表时使用。触发词:抖音蒸馏、抓取抖音博主、抖音博主全部作品、抖音内容蒸馏、抓口播稿、博主知识卡片。基于浏览器登录态,优先走 aweme post API 拿全量数据(含发布时间),DOM 滚动法降级,产出主题知识卡片写入 knowledge-…
Review Spark, SQL, and data pipeline changes for correctness, data quality, performance, idempotency, and production risk. Use when asked to review a data job, pipeline PR, Spark change, SQL transform…
Plan safe, bounded backfills and historical partition reruns, including downstream recomputation. Use when asked to backfill data, rerun historical partitions, recompute dependent datasets, or assess …
Write reusable scripts that clean dirty data. | Trig: Clean Script Smith, write code