Pyspark Etl

Use when designing, implementing, reviewing, or optimizing production PySpark ETL/DataFrame pipelines at GB-TB+ scale, including schemas, joins, partitioning, window functions, writes, UDF avoidance, and Spark performance diagnostics.

ivanshamaev Updated

File contents

ivanshamaev/de-agent-skills/tree/main/skills/pyspark_etl commit d45d95d45a

Frequently asked questions

npx skillmds@latest add ivanshamaev/pyspark-etl