Scarlet
Início
Artigos
Biblioteca
Sobre
Contato
Analytics Engineering
Fontes heterogêneas: projetando um pipeline de dados confiável
Pipeline de dados para previsão de preços de carros usados
Da ocorrência ao indicador: dados de crimes de São Francisco
Pipeline distribuído para minerar padrões de crimes na Inglaterra
Do CSV ao modelo: preparando dados do ENEM 2016
Modelagem Analítica
Do CSV ao modelo: preparando dados do ENEM 2016
Qualidade de Dados
Idempotência em pipelines: como reprocessar sem duplicar dados
Fontes heterogêneas: projetando um pipeline de dados confiável
Pipeline de dados para previsão de preços de carros usados
Da ocorrência ao indicador: dados de crimes de São Francisco
Pipeline distribuído para minerar padrões de crimes na Inglaterra
Do CSV ao modelo: preparando dados do ENEM 2016
Python
Idempotência em pipelines: como reprocessar sem duplicar dados
Pipeline de dados para previsão de preços de carros usados
Da ocorrência ao indicador: dados de crimes de São Francisco
Do CSV ao modelo: preparando dados do ENEM 2016
Machine Learning
Pipeline de dados para previsão de preços de carros usados
Do CSV ao modelo: preparando dados do ENEM 2016
Transformação de Dados
Pipeline distribuído para minerar padrões de crimes na Inglaterra
Spark
Pipeline distribuído para minerar padrões de crimes na Inglaterra
Mineração de Dados
Pipeline distribuído para minerar padrões de crimes na Inglaterra
Modelagem Dimensional
Da ocorrência ao indicador: dados de crimes de São Francisco
Geodados
Da ocorrência ao indicador: dados de crimes de São Francisco
Camada Analítica
Pipeline de dados para previsão de preços de carros usados
ELT
Fontes heterogêneas: projetando um pipeline de dados confiável
PySpark
Fontes heterogêneas: projetando um pipeline de dados confiável
SQL
Idempotência em pipelines: como reprocessar sem duplicar dados
Fontes heterogêneas: projetando um pipeline de dados confiável
Reliable Data Engineering
Idempotência em pipelines: como reprocessar sem duplicar dados
Data Pipelines
Idempotência em pipelines: como reprocessar sem duplicar dados