Automatically optimizes data pipelines, SQL queries, and data quality.
When This Skill Activates
Claude invokes this skill when you:
Show SQL queries or database code
Mention slow queries or performance
Discuss data pipelines or ETL
Ask about data quality
Work with database schema
What This Skill Does
1. SQL Query Optimization
Identifies:
N+1 query problems
Missing indexes
Inefficient JOINs
Unnecessary columns in SELECT
Lack of query limits
Example Optimization:
-- Before: Sequential scan (45ms)
SELECT * FROM users WHERE email = 'test@example.com';
-- Add index
CREATE INDEX idx_users_email ON users(email);
-- After: Index scan (2ms) - 95% faster
Converted and distributed by TomeVault — claim your Tome and manage your conversions.
1---2name: mazelb-dev-environment-template-data-engineering3description: Data Engineering Skill4---56# Data Engineering Skill78Automatically optimizes data pipelines, SQL queries, and data quality.910## When This Skill Activates1112Claude invokes this skill when you:131. Show SQL queries or database code142. Mention slow queries or performance153. Discuss data pipelines or ETL164. Ask about data quality175. Work with database schema1819## What This Skill Does2021### 1. SQL Query Optimization2223**Identifies**:24- N+1 query problems25- Missing indexes26- Inefficient JOINs27- Unnecessary columns in SELECT28- Lack of query limits2930**Example Optimization**:31```sql32-- Before: Sequential scan (45ms)33SELECT * FROM users WHERE email = 'test@example.com';3435-- Add index36CREATE INDEX idx_users_email ON users(email);3738-- After: Index scan (2ms) - 95% faster39```4041### 2. Data Pipeline Design4243**Best Practices**:44- Idempotency (safe to rerun)45- Error handling and retries46- Monitoring and alerting47- Data validation48- Incremental processing4950### 3. Data Quality5152**Checks for**:53- Schema validation54- Null handling55- Duplicate detection56- Referential integrity57- Data type consistency5859## Archetype-Specific Optimizations6061**For rag-project**:62- OpenSearch indexing optimization63- Batch document processing64- Embedding caching strategies65- Vector search performance6667**For api-service**:68- Database query optimization69- SQLAlchemy eager loading70- Connection pooling71- Query result caching7273## Output Format7475Provides:761. **Query Analysis**: Performance issues772. **Execution Plan**: EXPLAIN output783. **Optimized Query**: Improved version794. **Index Recommendations**: SQL to create indexes805. **Performance Gains**: Expected improvements8182## Example Usage8384```85User: "This query is slow: SELECT * FROM users JOIN profiles..."86Claude: [Activates data-engineering skill]87- Identifies N+1 problem88- Suggests eager loading89- Recommends indexes90- Provides optimized query9192Result: 2000ms → 150ms (13x faster)93```9495---96> Converted and distributed by [TomeVault](https://tomevault.io/claim/mazelb) — claim your Tome and manage your conversions.97<!-- tomevault:4.0:skill_md:2026-04-13 -->
Run npx skillmds@latest add tomevault-io/mazelb-dev-environment-template-data-engineering in your terminal (requires Node.js), paste this page's agent-chat prompt into Claude, Cursor, or any MCP-connected agent, or download the SKILL.md file and copy it into your agent's skills directory.
Data Engineering Skill It is listed under Coding & Dev Tools on SkillMD.
This skill has not completed SkillMD's automated safety review yet. SkillMD never runs a skill's scripts for you; review the SKILL.md before installing.
This skill is tagged as working with Claude Code, Claude.ai, OpenAI Codex. SKILL.md is an open format, so most agents that read a skills directory can load it too.
Yes. Installing skills from SkillMD is free, and the skill stays under its author's original license.
tomevault-io (@tomevault-io) published this skill. Their other Agent Skills are listed on their SkillMD profile.