Jefferson Almeida de Souza

Jefferson Almeida de Souza

Engenheiro de dados @ CNP Seguradora

About

Profissional de TI com 12 anos de experiência em empresas de grande porte, atuando no desenvolvimento de soluções para atender as necessidades dos clientes e na criação de processos para otimizar a operação internaNo momento, desempenho a função de engenheiro de dados, com foco na criação de pipelines que conectam diferentes fontes de informação. Estou constantemente procurando por opções viáveis para reduzir impactos, colaborar com minha equipe e explorar novos produtos e oportunidades. Estou pronto para desafios e novas oportunidades que me permitam aplicar meu conhecimento em dados para impulsionar o sucesso dos negócios e fazer uma diferença significativa.

Country

Brazil

City

Barueri

Industry

Information Technology & Services

Skill

Amazon Web Services, python , SQL, AWS Glue, Git, JIRA, looker, Talend Open Studio, Google BigQuery, spark, Ingestão de dados, Relacionamentos interpessoais, Comunicação interpessoal, Snowflake, MySQL, MongoDB, Engenharia de dados, Liderança de equipe, Transact-SQL, SSIS

Experience

CNP Seguradora

Engenheiro de dados

CNP Seguradora

LinkedIn
2025-7 - Present · 1 yr 3 mos

Barueri, São Paulo, Brasil

allu.

Engenheiro de dados

allu.

LinkedIn
2025-2 - 2025-7 · 6 mos

Belo Horizonte, Minas Gerais, Brasil

Atuo no desenvolvimento de pipelines de dados robustas, com foco em extração, transformação e carga (ETL/ELT) para o Google BigQuery. Tenho trabalhado em integrações com diversas fontes, incluindo SAP Hana, Protheus e HubSpot, utilizando AWS Glue (PySpark) e Python puro para orquestrar e automatizar processos de ingestão de dados. Desenvolvi scripts dinâmicos que tratam múltiplas views e tabelas, com controle de execução, logging em bancos MySQL e particionamento por data. Implementei extrações incrementais e mecanismos de controle para garantir integridade dos dados e evitar duplicidades, com uso de variáveis de ambiente e parâmetros dinâmicos. Automatizei a carga de dados do Protheus (XML/API) e do HubSpot (com paginação e controle de erros HTTP), processando e inserindo as informações em datasets otimizados no BigQuery. Modelei camadas bronze, silver e gold, organizando os dados para consumo analítico e garantindo rastreabilidade via tabelas de controle. Desenvolvi pipelines para movimentação de arquivos entre buckets S3, vinculando metadados extraídos do HubSpot a documentos armazenados em nuvem. Também atuei na organização modular de código Python, separando responsabilidades por arquivos e criando estruturas reutilizáveis para integração entre Glue, BigQuery, Secrets Manager, Parameters manager, Lambda, SNS e S3. Todo o processo foi pensado com foco em resiliência, reprocessamento, escalabilidade e governança.

NowVertical BR (Formerly Grupo IN)

Consultor Snowflake

NowVertical BR (Formerly Grupo IN)

LinkedIn
2024-3 - 2025-2 · 1 yr

São Paulo, Brasil

Atuei no desenvolvimento e implementação de soluções de Data Lake, utilizando a plataforma Snowflake. A principal responsabilidade foi a criação e manutenção de um Data Lake estruturado em várias camadas, com destaque para: Camada Raw Data: Implementação de processos para ingestão de dados provenientes de diversas fontes, como APIs e bancos de dados, utilizando AWS Glue e Spark para processamento e geração de arquivos Parquet, que eram posteriormente consumidos pelo Snowflake. Camada Trusted: Execução de processos de normalização e higienização dos dados, garantindo a qualidade e integridade das informações. Camada Refined: Aplicação de regras de negócios e criação de tabelas dinâmicas para análise estratégica e utilização de dados. Em um segundo projeto, utilizei o Talend Studio para consumir dados do Protheus e de APIs, realizando a ingestão e organização desses dados em outro Data Lake no Snowflake. Participei também de sessões de mentoria com clientes, orientando-os sobre as melhores práticas para implementação e uso do Snowflake na construção de Data Lakes. Além disso, desenvolvi monitoramentos, logs e enriquecimento de dados em Python, configurados no AWS Glue, para garantir a execução eficaz e a rastreabilidade dos processos. Por fim, criei uma pipeline CI/CD utilizando AWS CodeCommit e AWS CodeBuild para versionamento de scripts e objetos dentro do Snowflake, garantindo automação, controle e integridade nos processos de deploy.

Funcional Health Tech

Coordenador de Engenharia de Dados

Funcional Health Tech

LinkedIn
2021-10 - 2024-3 · 2 yrs 6 mos

São Paulo, Brasil

Experiência sólida no desenvolvimento de data lakehouse utilizando a plataforma Snowflake. Construção de pipelines de dados eficientes para a coleta, transformação e carga de informações. Expertise em modelagem de arquitetura para bancos de dados e datalake, garantindo a estruturação adequada e o desempenho otimizado dos sistemas. Habilidade em definir o escopo de projetos em colaboração com clientes internos e externos, assegurando a entrega de soluções alinhadas com as necessidades e expectativas. Proficiente no desenvolvimento de scripts utilizando a linguagem Python, automatizando processos e facilitando a manipulação e análise de dados. Lidero a equipe de forma a garantir a excelência no desenvolvimento de software voltado para a área de dados, atendendo às necessidades do negócio e proporcionando as melhores soluções tecnológicas para os clientes nessa área. Realizo reuniões com diversas áreas para discutir novos projetos, produtos ou soluções de problemas relacionados à área de dados. Fornecendo direcionamento técnico e sendo uma referência especializada para a equipe do projeto ou squad no contexto da área de dados. Gerencio a resolução de problemas técnicos específicos relacionados ao escopo do contrato na área de dados

Funcional Health Tech

Especialista em Integração de Dados - Líder Técnico

Funcional Health Tech

LinkedIn
2020-1 - 2021-10 · 1 yr 10 mos

São Paulo e Região, Brasil

- Automação de processos e manutenção evolutiva utilizando T-SQL e SSIS. - Banco de dados SQL-Server (2008/2012/2016) e PostgreSQL: Procedures, Functions, Views, Triggers. - Integração de múltiplas origens para diversos destinos, como flat file, xls, xlsx, mdb e integrações entre bancos de dados, cargas de Date Warehouse, OLTP, OLAP. - Geração de relatórios de utilização de benefícios, manutenção, desenvolvimento e levantamento de requisitos de acordo com as regras indicadas. - Modelagem Relacional visando uma melhor performance da esteira de dados. - Enriquecimento de dados via APIs utilizando Python e Sql Server. - Administração de Banco de Dados , ETL e GLUE na AWS. - Versionamento de código utilizando GIT. - Participação atuante na criação de novas funcionalidades dos sistemas internos gerando maior controle e velocidade no processamento de dados dos clientes.

LTM Fidelidade

Analista DBM Pleno

LTM Fidelidade

LinkedIn
2018-11 - 2020-1 · 1 yr 3 mos

Alphaville

- Automação de processos e manutenção evolutiva com a utilização das ferramentas SSRS E SSIS. - Criação de Dts(Data Transformation Services) de integração e transformação de dados ou soluções de movimentação de dados da plataforma SQL Server ou Mongo DB via Python. - Manipulação de dados, criação de queries para automatização de processos através da plataforma SQL Server 2016. - Geração de relatórios, manutenção, desenvolvimento e levantamento de requisitos de acordo com as regras indicadas. - Desenvolvimento de reports via ferramenta SSRS - SQL Server Reporting Services. - Desenvolvimento de reports para áreas internas via PowerBI.

Aon

Analista de sistema - ETL

Aon

LinkedIn
2017-5 - 2018-10 · 1 yr 6 mos

alameda campinas 1070

- Automação de processos e manutenção evolutiva com as ferramentas de ETL Sunopsis(ODI Oracle) e SSIS. - Banco de dados SQL-Server (2008/2012): Procedures, Functions, Views, Triggers e Modelagem. - Criação de Dts(Data Transformation Services) de integração e transformação de dados ou soluções de movimentação de dados da plataforma SQL Server. - Integração de múltiplas origens para diversos destinos, como flat file, xls, xlsx, mdb e integrações entre bancos de dados, cargas de Date Warehouse, OLTP, OLAP. - Geração de relatórios de utilização de benefícios, manutenção, desenvolvimento e levantamento de requisitos de acordo com as regras indicadas. - Manipulação de dados, criação de queries para automatização de processos através da plataforma SQL Server 2005/2012. - Participação em projetos de migração.

Admix

Analista de sistema

Admix

LinkedIn
2014-6 - 2017-4 · 2 yrs 11 mos

São Paulo

Education

Fatec Carapicuiba

Fatec Carapicuiba

LinkedIn
2015 - 2020 · 5 yrs

Jefferson Almeida de Souza's Contact Information

Email

******@***.com

Phone

(**) *** ****

Find the Right Leads
Find Verified Contact Data

Try with: Jensen Huang @ nvidia.com Click to autofill
LeadContact awards, five-star ratings, and GDPR compliance badges

What LeadContact does well

Find verified emails, phone numbers, and decision-makers with 98% accuracy.

Find Leads

Find Leads

Find the right people by company, role, industry, location, and more.

925M+ professional profiles

Find Leads
Find Emails

Find Emails

Access verified email addresses for your target contacts.

657M+ emails

Find Emails
Find Phone Numbers

Find Phone Numbers

Get cross-validated phone data from multiple top sources.

239M+ phone numbers

Find Phone Numbers

More Accurate. Lower Cost.

Find contact data in 1 tool with 98% accuracy

LeadContact integrates leading enrichment tools to deliver more accurate contact data—without paying for each one.

LeadContact Logo
Competitor Tools

All these = $289 per month

Great conversations start with the right contact.

It’s time to find yours.