Data & Analytics
Data agent skills make AI agents useful for data work: writing SQL, cleaning datasets, building pipelines, working with spreadsheets, and producing analyses. Each skill is a reviewed SKILL.md file that teaches the agent one workflow well, ready to install in seconds.
-
findscripter Skill XLSX Spreadsheet Authoring当需要创建、编辑或分析 .xlsx 表格(数据、公式、格式化、财务模型)时使用;做用 pandas 读析、openpyxl 写公式与样式、recalc.py 强制重算并产出零公式错误的工作簿;不适用于 .docx/.pptx、纯文本无表格需求或一次性问答;触发词:做Excel、生成xlsx、写公式、套格式、建财务模型、改表格
-
findscripter Skill API Security Best Practices当设计/加固 REST、GraphQL、WebSocket API 或做安全评审与审计时使用;产出认证授权、输入校验、限流防滥用、数据保护与安全头的可落地方案与代码;不适用于纯前端 XSS、网络层 DDoS 清洗或合规法律意见;触发词:API 安全、JWT 鉴权、限流、SQL 注入、OWASP API Top 10
-
findscripter Skill Gnomad Population Database当需要查 gnomAD v4 人群等位基因频率、按祖先群体(AFR/AMR/EAS/NFE/SAS/FIN/ASJ/MID)分层、基因约束(pLI/LOEUF/missense z)或区域覆盖度,以判断变异稀有/基因 LoF 不耐受时使用;做 GraphQL 取数并产出 AF/FAF95/约束分数表或 CSV/图;不适用于致病性判定(用 ClinVar)、GWAS 关联(用 GWAS Catalog)或本地 VCF 解析;触发词:gnomAD、人群频率、等位基因频率、AF、FAF95、pLI、LOEUF、约束分数、LoF、祖先分层、罕见变异、variant frequency
-
findscripter Skill Imaging Data Commons Query当需要免认证检索/下载 NCI 影像数据公地(IDC)公开癌症影像(CT、MR、PET、病理切片)用于 AI 训练或科研时使用;用 idc-index 按元数据 SQL 查询、批量下载 DICOM、浏览器可视化、核对许可与生成引用;不适用于读写本地 DICOM 像素(用 dicom-medical-imaging)或私有/院内 PACS 数据。触发词:IDC、Imaging Data Commons、idc-index、癌症影像、公开 DICOM、影像数据集、TCGA 影像
-
findscripter Skill Pyopenms Mass Spectrometry当需要用 PyOpenMS(OpenMS 的 Python 绑定)处理 LC-MS/MS 蛋白质组学或代谢组学原始质谱数据时使用;做 mzML/mzXML 等格式读写、信号处理(平滑/峰检测/质心化)、特征检测与跨样本连接、肽段/蛋白鉴定及 FDR 控制、非靶向代谢组学流程,产出特征表/鉴定表(pandas/CSV);不适用于简单谱库匹配与代谢物注释(用 matchms)、纯蛋白序列分析(用 biopython)、不读质谱数据的任务;触发词:PyOpenMS、OpenMS、质谱、mass spectrometry、mzML、LC-MS/MS、蛋白质组学、proteomics、代谢组学、metabolomics、峰检测、peak picking、特征检测、FDR。
-
findscripter Skill Claim Element Chart Builder当需要构建或审查「要件对照表」——专利权利要求图表(侵权/无效/审查)或民事诉因/抗辩的要件证据对照表,逐格带精确引证并以缺口检测为首要产物时使用;做按要件逐项映射证据/被控产品/现有技术、标注映射类型与状态、产出缺口清单及 md/CSV/表格;不适用于无源臆造映射、替律师下侵权/责任结论、裁断权利要求解释或满足无效的清晰可信证明标准;触发词:claim chart、要件对照表、权利要求图表、侵权对照、无效对照、要件逐项映射、证明缺口、还缺什么
-
findscripter Skill Single Cell Rnaseq Analysis当处理单细胞 RNA-seq 数据(.h5ad/10X/CSV)需做质控、归一化、降维聚类、找 marker 基因与可视化时使用;用 Scanpy/AnnData 跑标准探索流程并产出 UMAP/聚类/细胞类型注释与处理后 .h5ad;不适用于深度学习概率模型(用 scvi-tools)、跨条件严谨差异表达(先 pseudobulk 再用 pydeseq2);触发词:单细胞、scRNA-seq、scanpy、anndata、UMAP、聚类、marker 基因、细胞类型注释
-
findscripter Skill Claimable Postgres Provision当需要无注册、零信用卡的临时 Postgres(原型/演示/测试/Agent 自动建库)并写入 DATABASE_URL 时使用;做 pg.new(Neon Claimable Postgres)一键开库、解析连接串与 claim_url、写 .env、可选播种 SQL;不适用于生产负载、长期持久化、需指定区域/分支或强配额。触发词:临时数据库、pg.new、claimable postgres、get-db、DATABASE_URL
-
findscripter Skill Neuropixels Neural Recording当分析 Neuropixels 高密度细胞外电生理记录(.ap.bin/.lf.bin/.meta、SpikeGLX/OpenEphys/NWB)需做预处理、漂移校正、spike sorting、质量指标与 unit 筛选时使用;用 SpikeInterface + Kilosort4 跑「原始数据→可发表 curated units」全流程并产出 sorting/质量指标 CSV/Phy/NWB;不适用于钙成像或 LFP/EEG/胞内记录、单细胞 RNA-seq(用 single-cell-rnaseq-analysis);触发词:Neuropixels、spike sorting、Kilosort4、SpikeGLX、Open Ephys、质量指标、unit curation、细胞外电生理
-
findscripter Skill Polars Bio Genomic Intervals当在 Polars DataFrame 上做基因组区间运算(overlap/nearest/merge/coverage/complement/subtract)或读写 BED/VCF/BAM/GFF 等生信格式、且数据量大需流式/云端处理时使用;做区间算术、生信文件 I/O、DataFusion SQL 查询、BAM 测序深度计算,产出 LazyFrame/DataFrame 结果。不适用于纯序列比对、变异注释或非区间型分析。触发词:基因组区间、overlap、bioframe 替代、BED/VCF/BAM、测序深度 depth
-
findscripter Skill Contract Tabular Batch Review当需对一批合同/文件按统一字段做表格化审查(一行一文档、一列一数据点、每格附逐字引用,典型如并购尽调批量看控制权变更/转让/MAC 条款)并产出可核验的电子表格时使用;做的是:建带类型的列 schema、抽样校准、按文档并行扇出抽取(值+状态+逐字引文+定位)、归一化抓离群、输出 xlsx/Sheets+csv+markdown 与核验工作量摘要;不适用于问题点发掘(用 diligence-issue-extractor)、产出置信度分数、或替代人工通读(每格是线索非定论)。触发词:表格化审查、批量审查、tabular review、review grid、建表抽取、从这些合同提取字段、给我一张表格、batch review、对比一批文档
-
cslawyer1985 Bundle Patent SearchPatent search and analytics via 9235 API (search, detail, claims, company portrait, Excel export).
-
cslawyer1985 Bundle Law Firm Worklog律所工时月报生成(通用版,多数据源)。从用户已配置的任务管理工具(滴答清单 / Notion / Microsoft To Do / 飞书任务模块,任选其一)拉取指定日期范围内已完成的"业务工作"任务,按用户首次配置的工时模板(列名、固定值、姓名)和项目案号注册表(项目名、案号、关键词)自动归类并生成律所工时系统可导入的 Excel(默认 .xlsx)或 CSV。首次运行会引导用户完成一次性配置(数据源选择 + 工作单元白名单、姓名/律所、列模板、项目案号清单),后续可随时增删项目。当用户提到"工时""工作日志""月度工时""填工时""导出工时""律所工时""X月工时"等时触发,不论是否提及具体律所或工具。
-
cslawyer1985 Bundle Mayihr Hr Plus 0802最新劳动法政策周报生成。每周自动抓取全国及地方最新劳动法规政策→生成结构化周报+核心条款解读+企业影响。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Hr Plus 0807劳动争议调解仲裁法解读。劳动争议受案范围/仲裁时效/举证责任/调解程序/一裁两审流程。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Hr Plus 0816民法典合同编HR应用指引。劳动合同/劳务合同/派遣协议/外包协议的民法典合同编要点。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Hr Plus 0817最高人民法院关于劳动争议司法解释速查。劳动争议司法解释一至五的核心条款+实务影响+裁判规则。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Hr Plus 0840股权激励计划税务筹划。期权/限制性股票/股票增值权的税务处理+个人所得税优化+企业所得税扣除。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Hr Plus 0852股权激励个税处理。期权行权/限制性股票解禁/股票增值权收益的个税计算+纳税申报。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Hr Plus 0980股权激励会计处理。股份支付的会计准则适用+费用确认+摊销计算+披露要求。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
cslawyer1985 Bundle Mayihr Hr Plus 0985企业合规培训年度计划。按岗位/层级设计劳动法/数据合规/反腐倡廉等年度培训计划。当HR、管理者或员工需要完成该项工作时使用;支持自然语言和直接上传CSV/XLSX/Word/PDF,不依赖蚂蚁HR后台数据。
-
findscripter Skill Clinicaltrials Database Search当需要按疾病、药物/干预、地点、申办方或试验阶段检索全球临床试验,或按 NCT 编号取详情、按状态过滤、翻页、导出 CSV 时使用;用纯 requests 调 ClinicalTrials.gov API v2(公开免鉴权)检索研究并产出结构化结果/CSV。不适用于化合物生物活性(用 chembl-bioactivity-database)或综合科研多库查询(用 scientific-database-lookup)。触发词:临床试验、ClinicalTrials.gov、NCT、招募状态、试验阶段、患者匹配、试验申办方
-
findscripter Skill Neurokit2 Biosignal Processing当需要用 Python 处理与分析生理/生物信号(ECG、PPG、EEG、EDA/GSR、RSP、EMG、EOG)做清洗、峰检测、HRV、SCR、频带功率、复杂度/熵、事件相关分析或多模态联合处理时使用;用 NeuroKit2 跑标准管线并产出处理后信号 DataFrame、特征指标与图;不适用于原始采集/设备驱动、MNE 级 EEG 源重建精算、深度学习端到端建模;触发词:生理信号、生物信号、neurokit2、ECG、心率变异、HRV、EDA、皮电、EEG、呼吸、EMG、肌电、PPG、脉搏波
-
findscripter Skill Database Migration Strategies当需要在 Sequelize/TypeORM/Prisma 等 ORM 上做 schema 变更、跨库迁移或线上零停机发布时使用;产出可双向执行(up/down)的迁移脚本、回滚预案与零停机分阶段方案;不适用于纯查询调优、备份恢复运维或无 ORM 的手工 SQL 改库;触发词:数据库迁移、回滚、零停机
-
findscripter Skill Scientific Exploratory Data Analysis当拿到科学数据文件(化学/生信/显微/光谱/蛋白代谢/通用)、动手分析前要先识别格式并摸清结构质量时使用;做扩展名自动识别→载入格式专属库→格式专属 EDA(维度/统计/质量/元数据),产出含发现与下游分析建议的 Markdown 报告;不适用于通用表/CSV 的纯画像(用 dataset-profiler)、深度质量修复(用 dataset-quality-auditor)、统计建模或可视化本身。触发词:FASTQ、PDB、mzML、显微图像、HDF5、科学数据格式、EDA 报告
-
findscripter Skill Merger Accretion Dilution Model当为 M&A 交易评估对收购方每股收益(EPS)影响时使用;按七步构建并购模型并产出含假设/来源与运用/备考利润表/增厚摊薄汇总/敏感性/盈亏平衡的 Excel 工作簿与一页式交易后果摘要;不适用于 LBO/DCF 估值、单公司财务建模或法律尽调。触发词:并购增厚摊薄、accretion dilution、merger model、并购模型、备考 EPS、pro forma EPS、交易影响分析、merger consequences、协同效应敏感性。
-
findscripter Skill Metabolomics Workbench Database当需要从 Metabolomics Workbench(NIH 4200+ 代谢组学研究)按 ID 查代谢物、按物种/疾病发现研究、做 RefMet 名称归一、用 m/z 前体匹配候选化合物时使用;做 REST API 查询并产出化合物记录/研究列表/m/z 候选表(DataFrame/CSV);不适用于本地 HMDB XML 解析(用 hmdb-database)或通用化合物属性查询(用 pubchem-compound-search)。触发词:Metabolomics Workbench、RefMet、moverz、代谢组学研究、m/z 匹配、mwTab
-
aifinlab Bundle A Share DcfA股DCF估值模型/现金流折现。当用户说“DCF”、“现金流折现”、“DCF估值”、“内在价值”、“intrinsic value”、“帮我算一下XX值多少钱”、“合理估值”、“目标价推导”时触发。基于 cn-stock-data 获取历史财务数据,构建自由现金流折现模型(FCFF),计算 WACC,输出含敏感性分析的估值 Excel。支持机构 DCF 报告风格(formal)和个人估值笔记风格(brief)。不适用于可比公司估值法(用 a-share-comps)或财报分析(用 a-share-earnings-analysis)。
-
aifinlab Bundle Ashare DataAshare 最轻量 A 股行情获取工具(3.2k Stars),基于新浪+腾讯双核心数据源,零依赖(仅需 requests+pandas),无需注册,支持日/周/月线及 1m/5m/15m/30m/60m 分钟级K线。当用户需要快速获取 A 股/指数行情而其他数据源不可用时,Ashare 是最可靠的回退方案——它使用新浪为主、腾讯为备的双核心架构,自动切换,极少出错。
-
aifinlab Bundle A Share CompsA股可比公司分析/行业估值对标。当用户说"可比公司"、"估值对标"、"行业估值"、"comps"、"comparable company"、"同行对比"、"XX跟同行比怎么样"、"XX板块估值"、"可比公司分析"、"comps analysis"时触发。MUST USE when user asks about comparable company analysis, peer valuation comparison, or industry valuation benchmarking (comps). 通过 cn-stock-data 获取标的及可比公司的财务指标和实时行情,构建多维度估值对标表。输出 Excel(公式驱动)或 Markdown 对比表。支持投行估值表风格(formal)和快速对标表风格(brief)。
-
aifinlab Bundle Deep Research深度研究能力,支持多源搜索、信息聚合、引用回溯、文档上传分析。适用于市场调研、竞品分析、学术研究、技术选型、金融投研等场景。支持上传 PDF/Excel/Word 等文档,自动转换并提取关键信息。
-
aifinlab Skill Excel Parsing用于Excel表解析的Excel解析原子 skill,适用于通用行业文档解析场景。
-
findscripter Skill Polars Dataframe当处理内存可容纳(约 1-100GB)但 pandas 太慢的表格数据、构建 ETL/分析管道或从 pandas 迁移时使用;做表达式式列变换、惰性查询优化与并行聚合,产出 DataFrame/LazyFrame 及 CSV/Parquet 结果;不适用于超出内存的数据(改用 dask/vaex)。触发词:polars、惰性求求值、pandas 替代
-
findscripter Skill SQL Query Builder当需要把自然语言需求转成正确高效的 SQL、做联表/聚合/窗口查询或排错时使用;触发词:写 SQL、查询、联表、聚合、窗口函数、慢查询。
-
findscripter Skill Ma Buyer List当承接卖方并购(sell-side)委托、需要为标的搭建潜在买家全集并排序触达时使用;做战略买家与财务买家识别、契合度评估、分层(Tier1-3)与 Tier1 联系人映射,产出含战略买家页、财务买家页、联系人映射与统计的 Excel 工作簿及一页买家全景摘要;不适用于买方视角的尽调/估值/整合(见 ma-playbook)或撰写外联文案(见 cold-email-writer)。触发词:buyer list、买家清单、buyer universe、潜在买家、谁会买、战略买家、财务买家、PE sponsor、卖方并购
-
findscripter Skill Geo Database当需按物种/平台检索 GEO 表达数据集、下载解析 GSE 系列矩阵、抽样本元数据或加载表达矩阵到 pandas 时使用;用 GEOparse+E-utilities 产出 GSE/GPL/GSM 记录与基因注释表达矩阵;不适用于大规模单细胞(用 cellxgene-census)、原始 reads(去 ENA/SRA)。触发词:GEO、GSE、GEOparse、表达矩阵、series matrix
Frequently asked questions
What are Data & Analytics agent skills?
Data agent skills make AI agents useful for data work: writing SQL, cleaning datasets, building pipelines, working with spreadsheets, and producing analyses. Each skill is a reviewed SKILL.md file that teaches the agent one workflow well, ready to install in seconds.
Which Data & Analytics skills are most installed?
Popular Data & Analytics skills on SkillMD right now include xlsx-spreadsheet-authoring, api-security-best-practices, gnomad-population-database. Rankings shift as installs change; sort this page by "Most installs" for the live list.
Do Data & Analytics skills work with Claude Code and Cursor?
Yes. Every skill here ships as a SKILL.md file, an open format that works in Claude Code, Claude.ai, Cursor, Codex, Windsurf, and 60+ other agents. Install one with npx skillmds@latest add <owner>/<name>, or copy the file into your agent's skills directory.