Engenheiro de Dados
Brazil, SP, BR
Profissional responsável por projetar, desenvolver e otimizar pipelines de ingestão, transformação e curadoria de dados no ecossistema Azure, garantindo alta qualidade, governança, segurança e performance. Atuará com arquitetura Data Lakehouse e integração entre múltiplas fontes, suportando análises avançadas e iniciativas estratégicas de dados.
Principais responsabilidades:
1. Projetar, desenvolver e manter pipelines complexos de ingestão e transformação de dados no Azure Data Lakehouse.
2. Atuar com Azure Databricks utilizando PySpark e SQL para processamento, modelagem e otimização de dados.
3. Implementar e evoluir processos de integração e orquestração com Azure Data Factory, garantindo escalabilidade.
4. Realizar auditorias, validações e reconciliação de dados com consultas SQL avançadas.
5. Monitorar jobs, logs de ingestão e propor melhorias contínuas (performance, arquitetura, custo).
6. Documentar pipelines, processos e arquitetura de dados com padrões corporativos.
Requisitos Técnicos:
1. Experiência sólida com Azure Data Lakehouse, Azure Databricks (PySpark/SQL) e Azure Synapse Analytics.
2. Domínio avançado de PySpark, SQL (Spark SQL/T-SQL) e Python.
3. Conhecimento aprofundado em arquitetura Data Lakehouse, Delta Lake e Unity Catalog.
4. Experiência com Azure Data Factory para ingestão e orquestração de pipelines complexos.
5. Vivência com Git, Azure DevOps, CI/CD e versionamento de pipelines em ambientes corporativos.
6. Experiência com Delta Sharing, SFTP e auditorias SQL em projetos críticos.
Desejável:
7. Expertise em governança de dados no Azure com Unity Catalog.
8. Experiência em projetos com integração entre múltiplos Data Lakes via Delta
Habilidades Comportamentais:
1. Forte capacidade analítica e visão sistêmica.
2. Perfil consultivo, colaborativo e orientado à resolução de problemas complexos.
3. Proatividade na identificação de oportunidades de melhoria e inovação.
Modalidade: Hibrido - CLT
Localidade: Chácara de Santo Antônio - SP ( 2X)