Skip to content
View nicolaskra's full-sized avatar

Block or report nicolaskra

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Content in all repositories owned by your account will be closed.
Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
nicolaskra/README.md

Nícolas Klein

Data Engineer · Big Data · GCP/BigQuery

Construo plataformas de dados confiáveis — da ingestão ao painel que a diretoria usa para decidir.

LinkedIn · smartbusiness.ia.br · nicolasklein97@gmail.com


Engenheiro de Dados na EY (Tech FSO) — pipelines PySpark sobre Big Data de um banco Tier-1 (sob NDA) — e DBA/Engenheiro de Dados em GCP/BigQuery. Trabalho com ingestão idempotente, modelagem dimensional, migrations versionadas e observabilidade, usando SQL, PySpark, dbt e Airflow. Também aplico IA ao próprio fluxo de dados (QA e validação de pipelines) — mas a base é engenharia de dados.

No que estou trabalhando

  • DWH de consórcios em GCP/BigQuery (DBA) — 23 migrations versionadas, ingestão idempotente, web scraping resiliente e dashboards em Looker.
  • Evoluindo o finbr-data-platform — plataforma de dados sobre fundos da CVM (abaixo).
  • smart-job-monitor — monitor de vagas em Python stdlib (busca, filtra, pontua, deduplica).

Projetos em destaque

  • finbr-data-platform — pipeline real sobre o Informe Diário de Fundos da CVM: warehouse dimensional em DuckDB via dbt, ingestão em Airflow (pandas + PySpark), API FastAPI e dashboard Streamlit, 34 testes e CI. ~506 mil linhas de dado real por mês. Demo ao vivo.
  • smart-job-monitor — monitor de vagas zero-dependência (Python stdlib): múltiplas fontes, filtro + score 0–100, dedup e notificação. 16 testes e CI no GitHub Actions.

Experiência (destaques)

  • EY · Tech FSO — pipeline multi-tabela (sandbox → produção); migrei 2 painéis Power BI críticos sem perder a referência histórica dos valores, consumidos pela diretoria.
  • DWH de consórcios (GCP/BigQuery) — materialização de tabela cortou ~69% do custo de query no Looker; web scraping resiliente reduziu a coleta de 18h → ~31min.
  • Tutor de Power BI — 40h de treinamento para gestores; administração de Power BI Service e gateways.
  • Chatbot WhatsApp + IA em produção há 13+ meses (n8n, Google Gemini, MongoDB Atlas).

Stack

Dados: Python · SQL · PySpark · BigQuery · GCP · dbt · Airflow · Azure Synapse · Power BI · DAX · Power BI Service · Looker

IA aplicada: AI Agents · MCP · GenAI

Formação

Bacharelado em Ciências Econômicas — Unigran (2026) · Inglês: Full Professional · Campo Grande, BR · aberto a oportunidades remotas.

Popular repositories Loading

  1. nk_page nk_page Public

    Landing page institucional da Smart Business (consultoria em dados, engenharia e IA) - HTML/CSS/JS vanilla, bilingue PT/EN, deploy via GitHub Pages.

    HTML

  2. nicolaskra nicolaskra Public

    GitHub Profile README

  3. garageboxing-site garageboxing-site Public

    Landing page do Garage Boxing Club - site estatico responsivo.

    HTML

  4. finbr-data-platform finbr-data-platform Public

    End-to-end data platform on Brazilian public financial data (CVM, BCB, B3): Airflow + dbt + DuckDB + FastAPI + Streamlit + DeepEval. Hobby project demonstrating senior data engineering practices.

    Python

  5. smart-job-monitor smart-job-monitor Public

    Zero-dependency job-posting monitor: pulls remote roles from multiple boards (+ optional Gmail alerts), filters, scores 0-100, dedups, and notifies via Telegram. Pure Python stdlib, runs free on Gi…

    Python