Pipeline ETL completo desenvolvido em Python para extração, transformação e carga de dados de vendas em SQL Server, aplicando boas práticas de Engenharia de Dados.
CSV (Raw) → Extract → Transform (Pandas) → Load → SQL Server
- Python 3.13
- Pandas
- SQLAlchemy
- PyODBC
- SQL Server
- Git
pipeline-etl-sqlserver-python/
├── data/
│ ├── raw/ # Dados brutos de entrada
│ └── processed/ # Dados transformados
├── sql/
│ ├── create_tables.sql # DDL das tabelas
│ └── queries_analysis.sql
├── src/
│ ├── extract.py
│ ├── transform.py
│ └── load.py
├── main.py
├── requirements.txt
└── .gitignore \
git clone https://github.com/SEU_USUARIO/pipeline-etl-sqlserver-python.git
venv\Scripts\activate
pip install -r requirements.txt
set DB_SERVER=localhost set DB_NAME=etl_projeto
python main.py
- Conversão e validação de tipos de dados
- Remoção de duplicatas
- Tratamento de valores nulos
- Padronização de campos de texto
- Cálculo de valor bruto, desconto e valor líquido
- Extração de ano e mês para análise temporal
David Odorico LinkedIn