description: "Perfilamento de dados: schema, tipos, missing, cardinalidade, outliers, distribuição e achados iniciais." license: "MIT" keywords: ["data","profiling","schema","missing","outliers","eda"]
Data Profiler
Objetivo
Gerar um perfil confiável do dataset antes de qualquer decisão.
Procedimento
- Identificar fonte(s), período, granularidade e chaves candidatas.
- Levantar schema: colunas, tipos, valores especiais, padrões.
- Calcular:
- % missing e padrões de ausência
- cardinalidade por coluna
- duplicidades em chaves
- estatísticas (min/max/mean/std/quantis) para numéricas
- top valores para categóricas
- Detectar outliers (IQR/z-score) e inconsistências (domínios inválidos).
- Produzir resumo executivo + lista de riscos.