Skip to content
View Caio-Analytics's full-sized avatar
  • Vale Metais Básicos
  • Brasil
  • 12:41 (UTC -03:00)
  • LinkedIn in/caio-le

Block or report Caio-Analytics

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Content in all repositories owned by your account will be closed.
Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
Caio-Analytics/README.md

Caio Leão

Analista de Dados & Analytics Engineer

planilha solta → processo que a equipe consegue usar

Tenho uma implicância bem específica com processo que depende de alguém lembrar a ordem certa das planilhas e dos botões. Trabalho com dados de RH na Vale Base Metals, Planta Salobo, e gosto de encontrar o gargalo antes de automatizar qualquer coisa.

Já peguei um processo manual de três dias e fiz uma versão em Python que gera os dados em aproximadamente um minuto. Além de ficar mais rápido, o processo precisa mostrar de onde o número veio quando alguém perguntar e ajudar a encontrar o erro antes de ele virar dashboard.

Nos projetos públicos, é onde testo ideias com mais calma. Uso Arquitetura Medallion, documento a linhagem e deixo testes no caminho, porque dado sem contexto e sem verificação dá trabalho dobrado depois.

Por onde começar

Se quiser fuçar o código, começaria por aqui:

  • Recon: para olhar uma base antes de confiar nela.
  • Estrato: para acompanhar um dado público até o dashboard.
  • colsemantics: para tentar entender o que uma coluna corporativa meio misteriosa quer dizer.

O restante está nos repositórios fixados e no portfólio, com mais contexto, código e screenshots.

Minha caixa de ferramentas

Dados e transformação

Power BI dbt SQL DuckDB Python

Plataforma e automação

Power Platform Git GitHub Actions AWS

Fora da planilha

Dyson Sphere Program, Satisfactory e Factorio me pegam pelo mesmo motivo que dados: sempre tem um gargalo escondido em algum lugar. Também leio mangá e consumo bastante conteúdo técnico em inglês.

Portfólio · LinkedIn · E-mail

Pinned Loading

  1. Estrato-Panorama-Mineral-Brasileiro Estrato-Panorama-Mineral-Brasileiro Public

    PT-BR/EN: Pipeline de analytics engineering sobre mineração brasileira / Data engineering pipeline for Brazilian mining data — Python, Polars, dbt, DuckDB, SQL e interactive dashboard.

    HTML

  2. Estrato-Data-Platform Estrato-Data-Platform Public

    Pipeline de dados da mineração brasileira com Python, Dagster e DuckDB. Camadas Bronze/Silver/Gold, qualidade bloqueante, histórico de execuções e Docker, com testes e CI.

    Python

  3. Recon Recon Public

    Local Python toolkit for profiling tabular data before analysis: schema and semantic inference, data quality checks, privacy risk detection, table relationships, contracts, and HTML/JSON reports fo…

    Python 1

  4. colsemantics colsemantics Public

    Infere o papel e o domínio de colunas a partir do nome, abreviações corporativas e conteúdo.

    Python

  5. Portfolio-Caio-Leao Portfolio-Caio-Leao Public

    Portfólio pessoal de Caio Leão, Analista de Dados / Analytics Engineer: HTML/CSS/JS puro, publicado via GitHub Pages, com os projetos Recon e Bateia, CV em PDF gerado do mesmo conteúdo, e link pro …

    HTML 1

  6. dev-setup dev-setup Public

    Ambiente de dado reprodutível numa máquina nova: config real do VS Code, aliases pra dbt/DuckDB, e o template de projeto (Ruff + pytest + pre-commit) que uso em Recon e Bateia.

    Shell