# Coreweave Deploy Integration

> Deploy inference services on CoreWeave with Helm charts and Kustomize. Use when deploying multi-model inference, managing GPU deployments at scale, or templating CoreWeave manifests. Trigger with phrases like "deploy coreweave", "coreweave helm", "coreweave kustomize", "coreweave deployment patterns".

- Skill: `jeremylongshore/coreweave-deploy-integration` (Agent Skill)
- Install (CLI): `npx skillmds@latest add jeremylongshore/coreweave-deploy-integration`
- Raw SKILL.md: https://api.skillmd.com/api/skills/jeremylongshore/coreweave-deploy-integration/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: DevOps & Infra
- License: MIT
- Author: jeremylongshore (https://skillmd.com/u/jeremylongshore)
- Updated: 2026-09-08
- Page: https://skillmd.com/skills/jeremylongshore/coreweave-deploy-integration

---


# CoreWeave Deploy Integration

## Helm Chart for Inference Service

```yaml
# helm/values.yaml
replicaCount: 2
image:
  repository: vllm/vllm-openai
  tag: latest
gpu:
  type: A100_PCIE_80GB
  count: 1
  memory: 48Gi
model:
  name: meta-llama/Llama-3.1-8B-Instruct
autoscaling:
  enabled: true
  minReplicas: 1
  maxReplicas: 5
  targetConcurrency: 2
```

```bash
helm install my-inference ./helm -f values-prod.yaml
helm upgrade my-inference ./helm -f values-prod.yaml
```

## Kustomize Overlays

```
k8s/
├── base/
│   ├── deployment.yaml
│   ├── service.yaml
│   └── kustomization.yaml
├── overlays/
│   ├── dev/
│   │   ├── gpu-patch.yaml       # L40 GPU for dev
│   │   └── kustomization.yaml
│   └── prod/
│       ├── gpu-patch.yaml       # A100/H100 for prod
│       ├── replicas-patch.yaml
│       └── kustomization.yaml
```

```bash
kubectl apply -k k8s/overlays/prod/
```

## Resources

- [CoreWeave CKS](https://docs.coreweave.com/docs/products/cks)
- [Helm Documentation](https://helm.sh/docs/)

## Next Steps

For event monitoring, see `coreweave-webhooks-events`.


