# Data Pipeline Demo Data Pipeline

> Use when running data pipeline workflows for data-pipeline-demo.

- Skill: `guorunjie/data-pipeline-demo-data-pipeline` (Agent Skill)
- Install (CLI): `npx skillmds@latest add guorunjie/data-pipeline-demo-data-pipeline`
- Raw SKILL.md: https://api.skillmd.com/api/skills/guorunjie/data-pipeline-demo-data-pipeline/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: DevOps & Infra
- Author: guorunjie (https://skillmd.com/u/guorunjie)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/guorunjie/data-pipeline-demo-data-pipeline

---


# data-pipeline-demo-data-pipeline

Generated from `skillpack.yaml` by Skillpack Forge.

## Project
Data pipeline workflows for extraction, validation, transformation, and reporting.

## Workflow
- Locate source data, schema contracts, and expected output destinations
- Run validation first, such as npm run data:validate, before transforming data
- Run extraction or transformation on a small sample or dry run
- Compare row counts, null rates, key fields, and generated report artifacts
- Document assumptions, skipped checks, and any remaining data quality risk

## Commands
- install: `npm install`
- test: `npm test`
- data:validate: `npm run data:validate`
- data:transform: `npm run data:transform`
- data:report: `npm run data:report`

## Principles
- Preserve raw inputs and keep derived outputs separate
- Validate schemas, row counts, checksums, and representative samples
- Run transformations on a narrow sample before full pipeline execution
- Record data assumptions, freshness, and known quality gaps

