DevOps Engineering Mastery
Production-grade infrastructure, deployment, and operations across Docker, Kubernetes, Cloudflare, and Google Cloud Platform.
Platform Selection
| Need |
Choose |
Why |
| Sub-50ms latency globally |
Cloudflare Workers |
Edge computing, 300+ PoPs |
| Large file storage (zero egress) |
Cloudflare R2 |
S3-compatible, no egress fees |
| SQL database (global reads) |
Cloudflare D1 |
SQLite at the edge |
| Static site + API |
Cloudflare Pages |
Git-based, auto-deploy |
| Containerized workloads |
Docker + Cloud Run |
Auto-scaling, pay-per-use |
| Enterprise Kubernetes |
GKE |
Managed K8s, Autopilot |
| Managed relational DB |
Cloud SQL |
PostgreSQL/MySQL managed |
| Infrastructure as Code |
Terraform |
Multi-cloud, declarative |
| CI/CD pipelines |
GitHub Actions |
Native Git integration |
Quick Start
# Docker: build + run
docker build -t myapp . && docker run -p 3000:3000 myapp
# Docker Compose: multi-service
docker compose up -d
# Cloudflare Worker
npx wrangler init my-worker && cd my-worker && npx wrangler deploy
# GCP Cloud Run
gcloud run deploy my-service --image gcr.io/project/image --region us-central1
# Kubernetes
kubectl apply -f manifests/ && kubectl get pods
# Terraform
terraform init && terraform plan && terraform apply
Reference Navigation
Containerization
- Docker Fundamentals — Dockerfile best practices, multi-stage builds, layer caching, security
- Docker Compose — Multi-service apps, networks, volumes, health checks, profiles
- Container Optimization — Image size reduction, build caching, security scanning, distroless
Orchestration
- Kubernetes Core — Pods, Deployments, Services, ConfigMaps, Secrets, Namespaces
- Kubernetes Operations — kubectl mastery, debugging, resource management, scaling
- Helm Charts — Chart structure, templates, values, hooks, repositories
- Kubernetes Security — RBAC, NetworkPolicies, PodSecurityStandards, secrets management
- GitOps & CI/CD — ArgoCD, Flux, GitHub Actions, progressive delivery
Cloud Platforms
- Cloudflare Platform — Workers, R2, D1, KV, Pages, Queues, Durable Objects
- GCP Services — Cloud Run, GKE, Cloud SQL, Cloud Storage, IAM
Infrastructure as Code
- Terraform Patterns — Modules, state management, workspaces, best practices
Monitoring & Observability
- Monitoring Stack — Prometheus, Grafana, alerting, SLIs/SLOs, log aggregation
Architecture Patterns
Development → Staging → Production
Local Dev: Docker Compose (all services locally)
CI/CD: GitHub Actions → build → test → push image
Staging: Cloud Run (auto-deploy on PR merge to staging)
Production: Cloud Run / GKE (deploy on release tag)
Cost Optimization
| Strategy |
Savings |
| Multi-stage Docker builds |
50-80% image size reduction |
| Cloudflare R2 over S3 |
Zero egress fees |
| Spot/preemptible instances |
60-80% compute savings |
| Cloud Run vs always-on |
Pay only for requests |
| Resource limits on K8s |
Prevent over-provisioning |
Best Practices
Containers: Non-root user, multi-stage builds, .dockerignore, health checks, security scanning
Kubernetes: Resource limits, PDB, HPA, NetworkPolicies, secrets encryption, namespace isolation
CI/CD: Fast feedback (lint → unit → build → integration → deploy), cache dependencies, parallel jobs
Security: Image scanning, RBAC, secrets in vault, TLS everywhere, audit logging
Monitoring: RED metrics (Rate, Errors, Duration), SLIs/SLOs, alerting on symptoms not causes
Related Skills
Converted and distributed by TomeVault — claim your Tome and manage your conversions.
1---2name: devops-43description: Production-grade DevOps — Docker (multi-stage builds, Compose, optimization), Kubernetes (kubectl, Helm, security, GitOps), Cloudflare (Workers, R2, D1, Pages), GCP (Cloud Run, GKE, Cloud SQL), CI/CD pipelines, Terraform/IaC, monitoring, multi-region deployment. Use for containerization, orchestration, serverless, infrastructure as code, and deployment automation. Use when this capability is needed.4---56# DevOps Engineering Mastery78Production-grade infrastructure, deployment, and operations across Docker, Kubernetes, Cloudflare, and Google Cloud Platform.910## Platform Selection1112| Need | Choose | Why |13|------|--------|-----|14| Sub-50ms latency globally | Cloudflare Workers | Edge computing, 300+ PoPs |15| Large file storage (zero egress) | Cloudflare R2 | S3-compatible, no egress fees |16| SQL database (global reads) | Cloudflare D1 | SQLite at the edge |17| Static site + API | Cloudflare Pages | Git-based, auto-deploy |18| Containerized workloads | Docker + Cloud Run | Auto-scaling, pay-per-use |19| Enterprise Kubernetes | GKE | Managed K8s, Autopilot |20| Managed relational DB | Cloud SQL | PostgreSQL/MySQL managed |21| Infrastructure as Code | Terraform | Multi-cloud, declarative |22| CI/CD pipelines | GitHub Actions | Native Git integration |2324## Quick Start2526```bash27# Docker: build + run28docker build -t myapp . && docker run -p 3000:3000 myapp2930# Docker Compose: multi-service31docker compose up -d3233# Cloudflare Worker34npx wrangler init my-worker && cd my-worker && npx wrangler deploy3536# GCP Cloud Run37gcloud run deploy my-service --image gcr.io/project/image --region us-central13839# Kubernetes40kubectl apply -f manifests/ && kubectl get pods4142# Terraform43terraform init && terraform plan && terraform apply44```4546## Reference Navigation4748### Containerization49- **[Docker Fundamentals](references/docker-fundamentals.md)** — Dockerfile best practices, multi-stage builds, layer caching, security50- **[Docker Compose](references/docker-compose.md)** — Multi-service apps, networks, volumes, health checks, profiles51- **[Container Optimization](references/container-optimization.md)** — Image size reduction, build caching, security scanning, distroless5253### Orchestration54- **[Kubernetes Core](references/kubernetes-core.md)** — Pods, Deployments, Services, ConfigMaps, Secrets, Namespaces55- **[Kubernetes Operations](references/kubernetes-ops.md)** — kubectl mastery, debugging, resource management, scaling56- **[Helm Charts](references/helm-charts.md)** — Chart structure, templates, values, hooks, repositories57- **[Kubernetes Security](references/kubernetes-security.md)** — RBAC, NetworkPolicies, PodSecurityStandards, secrets management58- **[GitOps & CI/CD](references/gitops-cicd.md)** — ArgoCD, Flux, GitHub Actions, progressive delivery5960### Cloud Platforms61- **[Cloudflare Platform](references/cloudflare-platform.md)** — Workers, R2, D1, KV, Pages, Queues, Durable Objects62- **[GCP Services](references/gcp-services.md)** — Cloud Run, GKE, Cloud SQL, Cloud Storage, IAM6364### Infrastructure as Code65- **[Terraform Patterns](references/terraform-patterns.md)** — Modules, state management, workspaces, best practices6667### Monitoring & Observability68- **[Monitoring Stack](references/monitoring-stack.md)** — Prometheus, Grafana, alerting, SLIs/SLOs, log aggregation6970## Architecture Patterns7172### Development → Staging → Production73```74Local Dev: Docker Compose (all services locally)75CI/CD: GitHub Actions → build → test → push image76Staging: Cloud Run (auto-deploy on PR merge to staging)77Production: Cloud Run / GKE (deploy on release tag)78```7980### Cost Optimization81| Strategy | Savings |82|----------|---------|83| Multi-stage Docker builds | 50-80% image size reduction |84| Cloudflare R2 over S3 | Zero egress fees |85| Spot/preemptible instances | 60-80% compute savings |86| Cloud Run vs always-on | Pay only for requests |87| Resource limits on K8s | Prevent over-provisioning |8889## Best Practices9091**Containers:** Non-root user, multi-stage builds, .dockerignore, health checks, security scanning92**Kubernetes:** Resource limits, PDB, HPA, NetworkPolicies, secrets encryption, namespace isolation93**CI/CD:** Fast feedback (lint → unit → build → integration → deploy), cache dependencies, parallel jobs94**Security:** Image scanning, RBAC, secrets in vault, TLS everywhere, audit logging95**Monitoring:** RED metrics (Rate, Errors, Duration), SLIs/SLOs, alerting on symptoms not causes9697## Related Skills9899| Skill | When to Use |100|-------|-------------|101| [rust-backend-advance](../rust-backend-advance/SKILL.md) | Containerizing Rust apps, deployment configs |102| [databases](../databases/SKILL.md) | Database hosting, replication, backups |103| [testing](../testing/SKILL.md) | CI/CD test pipeline integration |104| [debugging](../debugging/SKILL.md) | Production incident investigation |105106---107> Converted and distributed by [TomeVault](https://tomevault.io/claim/thienty1207) — claim your Tome and manage your conversions.108<!-- tomevault:4.0:skill_md:2026-04-14 -->