Data & Analytics
Data agent skills make AI agents useful for data work: writing SQL, cleaning datasets, building pipelines, working with spreadsheets, and producing analyses. Each skill is a reviewed SKILL.md file that teaches the agent one workflow well, ready to install in seconds.
-
findscripter Skill Jq JSON Processing当处理 API/CLI/日志输出的 JSON 时使用;用 jq 过滤、转换、聚合并产出结构化结果或 CSV/TSV/原始文本;不适用于写文件或非 JSON 数据。触发词:jq、JSON 解析、JSON 转换
-
findscripter Skill Airflow Dag Builder当用 Apache Airflow 编排数据管道、调度批处理作业、设计 DAG 依赖、写自定义算子/传感器或本地测试与排障 DAG 时使用;做产出可上生产的幂等 DAG(TaskFlow、分支、传感器、重试告警、DagBag 测试);不适用于实时流处理、毫秒级低延迟调度或非数据工作流;触发词:airflow、DAG、数据管道、工作流编排、ETL 调度、批处理调度、TaskFlow、sensor、operator、cron 调度。
-
findscripter Skill Erd Schema Designer当从需求出发设计关系型数据库 schema、画 ERD、做范式化与表关系/约束/索引规划,或为多租户加隔离与软删除/审计字段时使用;产出实体关系模型(Mermaid ERD)、规范化表结构、关系与约束、索引与 RLS 策略草案;不适用于编写业务查询 SQL、本地 CSV 清洗、ORM/迁移工具具体语法调试;触发词:ERD、实体关系图、数据库设计、表结构设计、范式、normalization、schema design、多租户、软删除、索引策略、RLS
-
findscripter Skill Zarr Chunked Arrays当需要为超大 N 维科学数组(气候/遥感/影像)做分块、压缩与并行读写,或要把数据放到 S3/GCS 做云原生工作流,或与 NumPy/Dask/Xarray 互通时使用;做 Zarr 3 数组/组的创建、分块与分片策略选型、压缩编解码配置、云端 fsspec 存储与元数据合并,产出 .zarr 存储与读写代码;不适用于纯内存中小型数组(直接用 NumPy)或关系/表格数据(用 Parquet/数据库)。触发词:zarr、分块数组、云端 N 维数组、chunks 分片 sharding、Xarray Dask Zarr
-
findscripter Skill Pe Dd Checklist当启动并购尽职调查、组织数据室审阅或跟踪待办尽调事项时使用;按标的行业/交易类型/复杂度生成分领域尽调清单与请求清单,并做状态跟踪、红旗升级与周报输出(默认 Excel 分页工作簿);不适用于具体法律/税务文书起草、详细财务建模或上市合规申报。触发词:尽调清单、尽职调查、due diligence、数据室审阅、还缺什么、diligence tracker
-
findscripter Skill Data Strategy Review当任何计划触及训练数据、数据架构、数据产品化或数据团队招聘时使用;以六个 CDO 拷问对计划做决策导向的压力测试,产出含审查结论(SHIP/SHARPEN/BLOCK)与下一步的结构化审查报告;不适用于纯数据清洗、SQL 取数、ETL 实现等执行层任务;触发词:数据战略审查、CDO 审查、cdo review、data strategy review、训练数据合规、consent provenance、数据架构选型、warehouse lakehouse mesh、数据产品化、data monetization、M&A 数据尽调、数据团队招聘
-
findscripter Skill Kpi Dashboard Design当需要设计 KPI 仪表盘、为高管/部门挑选关键指标、规划布局或编写指标计算时使用;产出指标分层框架、布局模式与可执行的 SQL/Streamlit 代码;不适用于与指标无关的通用 BI 或纯报表导出。触发词:KPI、仪表盘、dashboard、关键指标、北极星指标、指标体系、MRR、留存、cohort、metrics、KPI dashboard、executive dashboard
-
findscripter Skill Nosql Distributed DB当为 Cassandra/ScyllaDB/DynamoDB 等分布式宽列/键值库做查询优先建模、选分区键、单表设计与排查热分区/高延迟时使用;产出访问模式清单、分区/排序键方案、单表与反范式 schema、热分区/打分区与索引(GSI/LSI/TTL)策略;不适用于关系型 SQL 建模、MongoDB 文档建模或单机 KV 缓存选型;触发词:cassandra、scylladb、dynamodb、分区键、热分区、单表设计、GSI、宽列、查询优先建模
-
findscripter Skill Odoo Orm Expert当在 Odoo 中编写 search/browse/create/write/unlink、构造 domain、实现 computed/stored/related 字段或排查慢查询时使用;做出地道、性能安全的 ORM 代码与优化建议;不适用于 cr.execute 原生 SQL 深度调优、TransientModel 向导模式。触发词:Odoo ORM、domain 过滤、computed 字段、N+1、recordset
-
findscripter Skill Pcb Bom Manager当为 KiCad 电子项目做元器件选型、采购、报价、备料或可制造性准备时使用;以原理图符号属性为单一事实源,分析原理图、查询分销商、校验封装规格、回写属性、导出 BOM 跟踪 CSV 并生成下单文件;不适用于非 KiCad 工程、纯软件 BOM 或机械零件清单。触发词:BOM、物料清单、bill of materials、元器件选型、采购下单、分销商搜索、distributor、报价、cost estimate、查库存、check stock、JLCPCB、LCSC、DigiKey、Mouser、立创、嘉立创、PCB 备料、可制造性
-
findscripter Skill Analysis QA Validator当把分析/报表/SQL 结果交给干系人或上会前需要质检时使用;做方法论、计算、可视化与结论的交付前 QA,产出含「可发布/带注意事项发布/需返工」三级置信评级的校验报告;不适用于从零跑数据集画像(用 dataset-quality-auditor)、搭管道质量校验(用 data-quality-validator)或纯写 SQL(用 sql-query-builder)。触发词:分析复核、交付前质检、结论是否站得住、口径检查、上会前 review
-
findscripter Skill Snowflake Development当在 Snowflake 上写 SQL、搭数据管道、用 Cortex AI 或 Snowpark Python 时使用;产出符合最佳实践的 SQL/DDL、Dynamic Tables/Streams/Tasks 管道、Cortex 函数与 Agent、dbt 物化、性能与安全配置;不适用于其他数据库(MySQL/PostgreSQL/BigQuery)或纯通用 SQL 拼装;触发词:snowflake、雪花、dynamic table、动态表、streams、tasks、snowpipe、cortex、snowpark、dbt on snowflake、merge upsert、变体 variant
-
findscripter Skill Sales Prospecting当需要把 ICP 画像转成已验证、已打分的可触达线索清单(覆盖 B2B SaaS/通用 B2B/本地小微商家)时使用;做线索发现、资格审查、打分排序并产出含来源与置信度的线索表(Markdown 或 CSV);不适用于撰写外呼文案(见 cold-email)或单账户深度竞品研究。触发词:prospecting、线索挖掘、build prospect list、找客户、lead gen、找 SaaS 公司、找 B2B 企业、找本地商家、ICP 匹配、target account list、qualified leads、外呼名单。
-
findscripter Skill Ensembl Database当需要通过 Ensembl REST API 在线获取基因/转录本/变异注释、做 ID 映射(HGNC↔Ensembl↔RefSeq↔UniProt)、取序列、VEP 变异效应、调控特征或跨物种同源时使用;做基因注释检索与产出(坐标/序列/xref/CSV 注释表);不适用于本地批量离线注释(用 pyensembl)、通路/代谢注释(用 kegg/reactome);触发词:Ensembl、ENSG、VEP、ortholog
-
findscripter Skill Spark Job Optimization当 Spark 作业慢、出现数据倾斜/shuffle 瓶颈/OOM,或需为大数据量管道做分区、缓存、Join、内存与 AQE 调优时使用;按「诊断→分区→Join→缓存→shuffle→内存→格式→验证」产出可执行 PySpark 代码与生产配置;不适用于非 Spark 引擎(Flink/Trino/单机 pandas/Polars)或与性能无关的纯 ETL 逻辑编写。触发词:Spark 慢、数据倾斜、shuffle 优化、broadcast join、AQE、executor 内存、repartition、Kryo
-
findscripter Skill Lbo Model Builder当为私募股权交易/投委会材料在 Excel 模板中填充并校验 LBO 模型时使用;做:按 Sources&Uses→运营模型→债务计划→回报(IRR/MOIC)→敏感性表分段填公式、套蓝黑紫绿配色与数字格式、跑校验产出可联动的专业模型;不适用于无模板的从零搭建、DCF/三表估值或纯数据分析;触发词:LBO、杠杆收购、leveraged buyout、Sources and Uses、债务计划 debt schedule、IRR、MOIC、敏感性表 sensitivity
-
findscripter Skill Clickhouse Analytics Io当用 ClickHouse 做 OLAP 分析、设计 MergeTree 表、优化分析查询、建物化视图或批量灌数时使用;按「选引擎→定分区/排序键→写高效查询→批量插入→物化视图→监控」产出建表 DDL、优化后 SQL 与灌数代码;不适用于 OLTP/高频点写、事务强一致或非 ClickHouse 库(PostgreSQL/MySQL 等);触发词:ClickHouse、MergeTree、物化视图、列存分析、分区键、批量插入、慢查询日志。
-
aifinlab Skill Semi Structured Data Ingestion用于Excel/表单接入的半结构化数据接入原子 skill,适用于通用行业数据接入场景。
-
cslawyer1985 Bundle Mayihr Employee Relations 383员工手册合规审核工具。逐条审核员工手册是否符合最新劳动法规+识别霸王条款+修改建议。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Employee Relations 397工伤康复与返岗支持方案。工伤康复期管理+返岗评估+岗位调整+辅助器具+心理支持+法律权益保障。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Work Injury Process Guide工伤处理全流程指引。当HR、管理者或员工要事故报告→工伤认定申请→劳动能力鉴定→工伤待遇申领的完整流程+材料模板+各城市时限差异时使用。支持直接中文描述或上传CSV/XLSX/Word/PDF;不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Labor Law Compliance Check劳动法合规自检工具。当HR、管理者或员工要检查企业用工制度15+项常见风险点(合同签订率/社保缴纳/加班合规/年假执行/同工同酬等),输出风险清单+整改建议时使用。支持直接中文描述或上传CSV/XLSX/Word/PDF;不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Work Injury Benefits Guide工伤待遇申领指引。当HR、管理者或员工要工伤医疗费/一次性伤残补助金/伤残津贴/工亡待遇的计算和申领全程指引时使用。支持直接中文描述或上传CSV/XLSX/Word/PDF;不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Enforcement Action Analysis Amir Fadavi分析任何 OFAC 或 OFSI 执法行动——经 URL、粘贴文本或上传文档——并将结构化根本原因分析生成为格式化 Excel(.xlsx)电子表格。当用户指名、链接、粘贴或上传 OFAC 或 OFSI 执法行动,并请求以下任何内容时使用本技能:根本原因分析、合规差距、出了什么问题、经验教训、组织自我评估或补救规划。当用户询问“analyze this enforcement action”“what were the root causes”“turn this into a checklist”或“how do I make sure this doesn't happen to us”时也触发。输出单工作表 .xlsx 表格,六列:根本原因 | 出了什么问题 | 问题如何发生 | 什么本可阻止它 | 我的组织对此免疫吗?(是/否/部分)| 备注。
-
cslawyer1985 Bundle Overtime Pay Calculator专注劳动法领域的加班工资智能计算技能。根据用户提供的案件信息、内置计算公式、各地最低工资标准数据及联网检索,精准计算各类工时制下的加班工资,生成规范计算明细表,并附带法条引用与实务法律建议。当用户询问加班费、加班工资怎么算、标准工时制、综合计算工时制、不定时工时制、计件工资制、日工资/小时工资折算、劳动仲裁加班费等场景时触发。输出格式可根据用户需求灵活调整,不强制输出Excel。
-
brathod1432 Bundle Product AnalyticsUse when defining product KPIs, building metric dashboards, running cohort or retention analysis, or interpreting feature adoption trends across product stages.
-
brathod1432 Bundle Customer Success ManagerMonitors customer health, predicts churn risk, and identifies expansion opportunities using weighted scoring models for SaaS customer success. Use when analyzing customer accounts, reviewing retention metrics, scoring at-risk customers, or when the user mentions churn, customer health scores, upsell opportunities, expansion revenue, retention analysis, or customer analytics. Runs three Python CLI tools to produce deterministic health scores, churn risk tiers, and prioritized expansion recommendations across Enterprise, Mid-Market, and SMB segments.
-
brathod1432 Bundle Senior Data ScientistWorld-class senior data scientist skill specialising in statistical modeling, experiment design, causal inference, and predictive analytics. Covers A/B testing (sample sizing, two-proportion z-tests, Bonferroni correction), difference-in-differences, feature engineering pipelines (Scikit-learn, XGBoost), cross-validated model evaluation (AUC-ROC, AUC-PR, SHAP), and MLflow experiment tracking — using Python (NumPy, Pandas, Scikit-learn), R, and SQL. Use when designing or analysing controlled experiments, building and evaluating classification or regression models, performing causal analysis on observational data, engineering features for structured tabular datasets, or translating statistical findings into data-driven business decisions.
-
brathod1432 Bundle Snowflake DevelopmentUse when writing Snowflake SQL, building data pipelines with Dynamic Tables or Streams/Tasks, using Cortex AI functions, creating Cortex Agents, writing Snowpark Python, configuring dbt for Snowflake, or troubleshooting Snowflake errors.
-
brathod1432 Bundle SQL Database AssistantUse when the user asks to write SQL queries, optimize database performance, generate migrations, explore database schemas, or work with ORMs like Prisma, Drizzle, TypeORM, or SQLAlchemy.
-
brathod1432 Bundle Gong AutomationAutomate Gong conversation intelligence -- retrieve call recordings, transcripts, detailed analytics, speaker stats, and workspace data -- using natural language through the Composio MCP integration.
-
brathod1432 Bundle Excel AutomationExcel Automation: create workbooks, manage worksheets, read/write cell data, and format spreadsheets via Microsoft Excel and Google Sheets integration
-
findscripter Skill Datamol Cheminformatics当需要用 datamol(RDKit 的 Pythonic 封装、合理默认+内置并行)跑标准药物发现化学信息学流程时使用;做 SMILES/SDF/CSV/Excel 解析与标准化、描述符与指纹、相似度/聚类/多样性选择、Murcko 骨架与 BRICS/RECAP 切片、3D 构象、分子网格绘图,产出原生 rdkit.Chem.Mol、属性表与图片;不适用于自定义指纹/底层原子键操作/子结构查询优化(用 rdkit)、蛋白对接与分子动力学、深度学习建模(用 deepchem);触发词:datamol、dm.to_mol、分子标准化、ECFP 指纹、Butina 聚类、pick_diverse、Murcko 骨架、构象生成、scaffold split
-
findscripter Skill Lamindb Data Management当为生物数据集(scRNA/AnnData/DataFrame/Zarr)做版本管理、谱系追踪、本体校验与可查询数据湖时使用;用 lamindb(含 bionty)以 track()/finish() 包裹分析,注册 Artifact、按 key/feature/本体过滤查询、用 Bionty 标准化细胞/基因术语并产出 FAIR 的可溯源 artifact;不适用于单细胞分析流程(聚类/差异表达用 single-cell-rnaseq-analysis)与纯本体查表(用 bionty 即可);触发词:lamindb、lamin、artifact、谱系/lineage、ln.track、bionty、数据治理、FAIR、数据湖、本体校验
-
findscripter Skill Market Breadth Analyzer当需要量化市场宽度健康度、判断涨势是否广泛、给出基于宽度的仓位建议时使用;用 TraderMonty 公开 CSV(免 API Key)跑 Python 脚本,按 6 维加权算 0-100 综合分并产出含健康区间、最强/最弱分项、关注价位、趋势的 JSON+Markdown 报告;不适用于个股选股/择时信号、回测撮合、自定义数据源接入与图形宽度图解读;触发词:市场宽度、涨跌广度、参与率、breadth、宽度健康度、advance-decline、涨势是否广泛、仓位建议
-
findscripter Skill Medchem Compound Triage当需要对化合物库做药物化学过滤、初筛或优先级排序时使用;用 medchem(datamol/RDKit)施加成药性规则、结构警示、复杂度阈值与查询语言,产出可审计的通过/淘汰结果(DataFrame 或布尔掩码);不适用于纯属性范围卡阈值(用 RuleFilters/描述符)、活性预测、对接打分、合成路线规划。触发词:药物化学过滤、成药性、Lipinski、PAINS、NIBR、复杂度、化合物筛选。
Frequently asked questions
What are Data & Analytics agent skills?
Data agent skills make AI agents useful for data work: writing SQL, cleaning datasets, building pipelines, working with spreadsheets, and producing analyses. Each skill is a reviewed SKILL.md file that teaches the agent one workflow well, ready to install in seconds.
Which Data & Analytics skills are most installed?
Popular Data & Analytics skills on SkillMD right now include jq-json-processing, airflow-dag-builder, erd-schema-designer. Rankings shift as installs change; sort this page by "Most installs" for the live list.
Do Data & Analytics skills work with Claude Code and Cursor?
Yes. Every skill here ships as a SKILL.md file, an open format that works in Claude Code, Claude.ai, Cursor, Codex, Windsurf, and 60+ other agents. Install one with npx skillmds@latest add <owner>/<name>, or copy the file into your agent's skills directory.