Engenheiro de Dados
Síntese de Qualificações
Engenheiro de Dados e Software com atuação em Data Platform, arquitetura de soluções e arquitetura de dados. Conduzo o desenho, a implementação e a sustentação de sistemas corporativos de governança, segurança, Data Contracts, controle de acessos, FinOps e UEBA, transformando riscos e requisitos em ADRs, APIs, pipelines e produtos de dados em Azure, Databricks e AWS.
Experiência Profissional
-
Engenheiro de Plataforma de Dados
Atuo de ponta a ponta na arquitetura, implementação e sustentação de soluções de Data Platform e Governança, elaborando ADRs e validando decisões com times de Arquitetura, Plataforma e Governança.
Participei da implementação e sustentação do Microsoft Purview, incluindo ingestão, scans, enriquecimento de metadados, taxonomias, data lineage e integração com Data Mesh.
Projetei e implementei um Policy Engine de UEBA com Python, PySpark, Airflow, Databricks e Delta Lake, processando cerca de 25 milhões de eventos por execução e avaliando aproximadamente 1.600 usuários por mês, com Policy as Code, auditoria, versionamento, exceções e reprocessamento idempotente.
Liderei a refatoração da plataforma de Data Contracts para mais de 60 times, integrando CI/CD, validação de schema, GMUD, Azure Service Bus, Databricks, Unity Catalog e Purview. A solução suporta cerca de 20 mil contratos em 60 mil tabelas e reduziu em 60 o tempo de processamento.
Desenvolvi uma plataforma de acessos nominais e em lote com Python, FastAPI, AKS, Databricks, Purview e ServiceNow, processando cerca de 600 solicitações por dia, com regras de elegibilidade, LGPD/DLP, mascaramento, aprovação, concessão temporária e revogação automática. A arquitetura em camadas, com filas, retries, logs e notificações, reduziu incidentes de até 3-4 por dia para cerca de 1 por semana.
Implementei classificação de dados sensíveis com Azure OpenAI, regex e human-in-the-loop, analisando aproximadamente 2 milhões de colunas com precisão entre 86 e 88.
Também modelei um Hub de Governança, FinOps e Eficiência de Dados, da camada Bronze à Gold, com 15 tabelas analíticas e mais de 7 dashboards usados por 150-200 profissionais, identificando cerca de 15 dos ativos sem uso.
Tecnologias: Python, SQL, PySpark, Databricks, Airflow, FastAPI, Delta Lake, AKS, Docker, Kubernetes, Purview, Unity Catalog, ServiceNow, Azure Service Bus, Key Vault, Azure OpenAI, Power BI/Fabric e CI/CD. -
Analista de dados e Business Intelligence - JBS Friboi (9/2024 a 6/2025)
Conduzi, como PO técnico, projeto end-to-end de SOP e planejamento financeiro-operacional, conectando requisitos de negócio, ERP, Data Lake, modelagem analítica, pipelines ETL/ELT e entrega em Qlik Sense.
Desenvolvi pipelines e modelos Silver/Gold com Python, SQL, AWS Glue, Apache NiFi, Amazon S3 e Redshift, estruturando DRE, forecast e indicadores financeiros e operacionais, com ganhos de performance de até 70.
Criei modelo de otimização logística com Python e solver para recomendar a origem de abastecimento por cliente, contribuindo para uma iniciativa com economia estimada de RS 3 milhões/mês e redução de 23 no custo de confinamento.
Liderei a migração de mais de 10 automações RPA/no-code para microsserviços Python com Selenium/Playwright, EC2, S3, Azure DevOps, CI/CD, logs e testes, economizando até 180 horas/mês e reduzindo 14 dos custos de tecnologia.
Tecnologias: Python, SQL, AWS Glue, Apache NiFi, Amazon S3, Redshift, EC2, Qlik Sense, Selenium, Playwright, Azure DevOps, Git e CI/CD. -
Product Analytics - Avita Grupo Itaú (9/2023 a 9/2024)
Atuei em Product Analytics, automação e integração de dados para operações financeiras com Python, SQL, Databricks, APIs REST, Power BI e Power Automate, conectando regras de negócio, sistemas internos e pipelines operacionais.
Desenvolvi automação end-to-end para inserção de apólices no CRM e uma interface sob demanda, integrando APIs de seguradoras, payloads JSON, jobs Databricks, regex e processamento de documentos de 7 seguradoras com pandas/openpyxl, logs e monitoramento.
Tecnologias: Python, SQL, Databricks, APIs REST, Power BI, Power Automate, pandas, openpyxl, regex, JavaScript, HTML e CSS.
Formação Acadêmica
-
Pós-graduação (8/2026 a Atual)
Arquitetura de Software - FIAP -
Superior (8/2022 a 12/2024)
Análise e Desenvolvimento de Sistemas - Universidade Municipal de São Caetano do Sul
Conhecimentos Gerais
Tenho experiência na construção de arquiteturas de dados e soluções analíticas em ambientes Azure e AWS. Na XP, atuo desde a definição da arquitetura até a implementação e sustentação de soluções de Data Platform e Governança, elaborando ADRs, definindo integrações e validando decisões técnicas com times de arquitetura. Desenvolvi soluções envolvendo Data Contracts, Policy Engine, controle de acessos, Data Mesh e Microsoft Purview, utilizando Databricks, Apache Airflow, FastAPI, Azure Service Bus, AKS e Unity Catalog.
Em Cloud, possuo experiência prática principalmente com Azure e AWS. Na Azure trabalho com Databricks, AKS, Azure Service Bus, Key Vault, Purview, Azure OpenAI e Azure DevOps. Na AWS atuei com Glue, S3, Redshift, EC2 e Apache NiFi no desenvolvimento de pipelines e soluções analíticas para Data Lake.
Tenho experiência sólida com Databricks em projetos de produção, desenvolvendo pipelines em PySpark, processamento distribuído, Delta Lake, Unity Catalog e Airflow. Também possuo experiência com Power BI na construção de dashboards e indicadores para áreas de negócio e governança de dados.
Minha principal stack é Python, PySpark e SQL. Tenho experiência em desenvolvimento de APIs com FastAPI, processamento distribuído com Spark, modelagem em Data Lake, ETL/ELT, bancos relacionais como SQL Server e Redshift, além de integração com diferentes fontes de dados e APIs. Também possuo conhecimento em bancos NoSQL, embora minha experiência prática seja predominantemente em bancos relacionais e arquiteturas baseadas em Data Lake.