Diego Botelho de Souza

Diego Botelho de Souza

Data Engineer @ Ambev Tech

About

Sou Data Engineer com experiência desde 2020 na construção, evolução e sustentação de plataformas de dados em cloud, atuando em ambientes B2B de alta escala e orientados a produto. Tenho forte atuação com Data Platforms, trabalhando com PySpark e Databricks na implementação de pipelines distribuídos, arquiteturas multicamadas e datasets analíticos governados, com foco em qualidade, confiabilidade e performance dos dados. Atuo no desenvolvimento de pipelines ETL/ELT, integração de múltiplas fontes e aplicação de regras de negócio, garantindo dados consistentes e prontos para consumo analítico e operacional. Possuo experiência na criação de Data Products, incluindo a exposição de dados via APIs, viabilizando o consumo de insights por aplicações, times de negócio e operações de campo. Atualmente, também exploro soluções com AI Agents (CrewAI) para automação de fluxos, apoio à análise e ganho de eficiência operacional, sempre com foco em gerar impacto real no negócio por meio de dados.

Country

Brazil

City

Cotia

Industry

Information Technology & Services

Skill

Apache Airflow, IA, Azure Cosmos DB, DevOps, Microsoft Power BI, MySQL, Apache NiFi, Microsoft SQL Server, PySpark, Azure Databricks, Azure Data Factory, Azure Data Lake, Azure Functions, Desenvolvimento de back-end, Azure DevOps, Java, Python, SQL, JavaScript, Inglês

Experience

Ambev Tech

Data Engineer

Ambev Tech

LinkedIn
2024-5 - Present · 2 yrs 5 mos

São Paulo, Brasil

Atuação como Data Engineer em ambiente B2B, focado no desenvolvimento e sustentação de plataformas analíticas estratégicas, com forte orientação a impacto no negócio, qualidade dos dados e escalabilidade. Principais responsabilidades e entregas: - Desenvolvimento e manutenção de pipelines de dados escaláveis em Databricks (PySpark), seguindo arquitetura multicamadas (bronze, silver, gold e platinum). - Implementação de práticas avançadas de data quality e observabilidade, com monitoramento contínuo de tabelas críticas e modelo de maturidade baseado em badges, elevando a confiabilidade dos dados e reduzindo riscos operacionais. - Construção de datasets analíticos governados para consolidação de métricas de experiência do cliente B2B, habilitando análises proativas e melhoria contínua do relacionamento com parceiros. - Criação de soluções analíticas para otimização da alocação de recursos físicos, integrando múltiplas fontes de dados e mensurando uplift real em vendas e performance comercial, apoiando decisões estratégicas de crescimento. - Estruturação de backends e Data Products, incluindo exposição de dados via APIs, para disponibilização de insights acionáveis em tempo real às equipes de campo. - Desenvolvimento e aplicação de AI Agents (CrewAI) para automação de interações com parceiros, promovendo eficiência operacional, agilidade no atendimento e escalabilidade. Tecnologias: Databricks, PySpark, Azure Data Factory, Airflow, FastAPI, Pytest, CrewAI

BlueShift Brasil

Data Engineer

BlueShift Brasil

LinkedIn
2021-4 - 2024-5 · 3 yrs 2 mos

Atuação como Data Engineer em projetos de dados e analytics em ambientes cloud, com foco em migração de dados, construção de pipelines escaláveis e integração de múltiplas fontes para suportar iniciativas analíticas e operacionais. Principais projetos e responsabilidades: - Desenvolvimento e implementação de pipelines de dados em Azure Databricks (PySpark), atuando em processos de ETL/ELT e migração de dados para ambientes analíticos em cloud. - Projeto Asset Performance Management (APM): Migração e processamento de dados provenientes de SAP e sistemas PIMS. Implementação de arquitetura em Data Lake multicamadas (raw, trusted e refined) no Azure. Preparação dos dados para aplicação de modelos estatísticos de previsão de falhas e geração de insights operacionais. - Projeto IoT Hub 4.0: Migração de dados de dispositivos IoT para a Azure Cloud. Desenvolvimento de pipelines de ingestão e transformação para Azure Data Lake e Azure Cosmos DB. Criação de APIs de integração entre backend e frontend. Implementação de pipelines de CI/CD utilizando Azure DevOps. - Projeto Azure Data Factory: Criação de pipelines para ingestão de dados via APIs externas, armazenamento em Data Lake e processamento posterior em notebooks Databricks. Persistência dos dados tratados em bancos de dados relacionais para consumo analítico. - Projeto de Web Scraping em Google Cloud Platform (GCP): Coleta automatizada de dados, armazenamento em Cloud Storage e estruturação de tabelas para geração de dashboards analíticos. - Projeto de migração de dados com Apache NiFi: Orquestração da movimentação de dados entre Azure Data Lake e MySQL. Modelagem de tabelas fato e dimensão para consumo em Power BI. Tecnologias: Azure Databricks, PySpark, Azure Data Factory, Azure Data Lake, Azure Synapse, Azure SQL Server, Azure Cosmos DB, Azure DevOps, Python, Power BI, Apache NiFi Tecnologias utilizadas: Azure Databricks, Azure Data Lake, Azure Synapse, Azure SQL Server, Azure Synapse, Power BI e DevOps,.

BlueShift Brasil

Data Engineer Trainee

BlueShift Brasil

LinkedIn
2020-11 - 2021-3 · 5 mos

São Paulo, Brasil

Atuação inicial em engenharia e migração de dados em ambiente Azure, apoiando projetos de integração e consolidação de dados para fins analíticos. Apoio em migrações de dados para cloud, utilizando ferramentas como Apache NiFi, MySQL e Power BI. Participação na organização e preparação de dados para análises e dashboards, garantindo consistência e disponibilidade das informações. Tecnologias: Apache NiFi, MySQL, Power BI, Azure

União Química Farmacêutica Nacional

Líder de logística

União Química Farmacêutica Nacional

LinkedIn
2018-11 - 2019-11 · 1 yr 1 mo

São Paulo e Região, Brasil

Atividades: - Desenvolvimento e implementação de estratégias para otimizar a cadeia de suprimentos, incluindo transporte, armazenamento e distribuição de produtos; - Análise dos dados de desempenho logístico para identificar áreas de melhoria; - Garantir que os padrões de qualidade sejam mantidos em todas as etapas da cadeia de suprimentos.

Eurofarma

Auxiliar de Expedição

Eurofarma

LinkedIn
2016-7 - 2018-11 · 2 yrs 5 mos

São Paulo e Região, Brasil

Softcaps

Auxiliar de Deposito II

Softcaps

LinkedIn
2013-11 - 2015-7 · 1 yr 9 mos

São Paulo e Região, Brasil

Prodiet Farmaceutica Ltda.

Auxiliar de Expedição

Prodiet Farmaceutica Ltda.

LinkedIn
2010-12 - 2013-3 · 2 yrs 4 mos

São Paulo e Região, Brasil

New Space Processamento E Sistemas Ltda.

Estagiário

New Space Processamento E Sistemas Ltda.

LinkedIn
2007-12 - 2009-11 · 2 yrs

São Paulo e Região, Brasil

Education

Universidade Paulista

Universidade Paulista

LinkedIn

Analise e Desenvolvimento de Sistemas

2024 - 2026 · 2 yrs

Diego Botelho de Souza's Contact Information

Email

******@***.com

Phone

(**) *** ****

Find the Right Leads
Find Verified Contact Data

Try with: Jensen Huang @ nvidia.com Click to autofill
LeadContact awards, five-star ratings, and GDPR compliance badges

What LeadContact does well

Find verified emails, phone numbers, and decision-makers with 98% accuracy.

Find Leads

Find Leads

Find the right people by company, role, industry, location, and more.

925M+ professional profiles

Find Leads
Find Emails

Find Emails

Access verified email addresses for your target contacts.

657M+ emails

Find Emails
Find Phone Numbers

Find Phone Numbers

Get cross-validated phone data from multiple top sources.

239M+ phone numbers

Find Phone Numbers

More Accurate. Lower Cost.

Find contact data in 1 tool with 98% accuracy

LeadContact integrates leading enrichment tools to deliver more accurate contact data—without paying for each one.

LeadContact Logo
Competitor Tools

All these = $289 per month

Great conversations start with the right contact.

It’s time to find yours.