Empresa: Growdev
Responsabilidades: • Desenvolver, manter e otimizar pipelines de dados, utilizando processos de ETL/ELT em lote e, quando necessário, em tempo real, integrando fontes como ERP, CRM, e-commerce, APIs e bancos transacionais; • Estruturar e evoluir o data lakehouse, seguindo uma arquitetura em camadas, como bronze, silver e gold; • Estruturar bases analíticas para consumo por ferramentas de BI, aplicações e análises; • Garantir a qualidade, confiabilidade e rastreabilidade dos dados, implementando testes, monitoramento, alertas e mecanismos de tratamento de falhas; • Orquestrar e automatizar fluxos de dados, tratando dependências, falhas e reprocessamentos; • Otimizar performance e custos das soluções de dados em ambientes de nuvem; • Apoiar iniciativas de governança de dados, contribuindo para catalogação, documentação, data lineage, controle de acesso e boas práticas de segurança; • Contribuir para a adequação à LGPD, considerando os requisitos relacionados ao tratamento e à utilização dos dados; • Colaborar com as áreas de negócio, entendendo demandas e propondo soluções de dados adequadas aos objetivos identificados; • Atuar com plataformas de dados em nuvem, como Databricks ou similares, utilizando SQL, Python e Spark; • Trabalhar em times multidisciplinares, em conjunto com analistas, cientistas de dados, designers e pessoas desenvolvedoras, acompanhando as iniciativas desde o entendimento da necessidade até a disponibilização e evolução das soluções. Requisitos: • Obrigatórios: • Experiência profissional em Engenharia de Dados; • Experiência com desenvolvimento de pipelines de dados e processos ETL/ELT; • Conhecimento de Python, SQL e Apache Spark; • Experiência com modelagem de dados e construção de bases analíticas; • Conhecimento de arquitetura de Data Lake ou Lakehouse; • Experiência com orquestração e automação de pipelines de dados; • Conhecimento de ambientes de cloud computing; • Experiência ou familiaridade com Databricks ou plataformas de dados similares; • Conhecimento de práticas de qualidade, monitoramento e governança de dados; • Capacidade de trabalhar de forma colaborativa com áreas técnicas e de negócio. • Desejáveis: • Experiência prática com Databricks, incluindo Delta Lake, Jobs e recursos de processamento distribuído; • Experiência com pipelines de dados em tempo real e ferramentas de streaming; • Conhecimento de data lineage, catálogo de dados e governança; • Experiência com otimização de custos e performance em ambientes cloud; • Conhecimento de práticas e ferramentas relacionadas à LGPD e segurança de dados; • Experiência com integração de dados provenientes de ERP, CRM, e-commerce e APIs; • Experiência em ambientes que suportem soluções de Machine Learning e Ciência de Dados. O que oferecemos: • Equipamentos de trabalho de qualidade para você desempenhar suas atividades com excelência; • Day off no mês do seu aniversário, para celebrar como preferir; • Incentivo à educação, com parcerias com instituições de ensino superior e de idiomas; • Plataforma de formação Growdev, com conteúdos práticos e alinhados ao mercado de tecnologia. • Por que fazer parte da Growdev? • Na Growdev, nossa cultura é baseada em aprendizado contínuo, colaboração e respeito mútuo. Valorizamos as conexões autênticas e o compartilhamento de conhecimentos como alicerces para o nosso sucesso coletivo. Aqui, cada desafio é uma oportunidade para evoluirmos, juntos, e para gerarmos um impacto positivo no mercado de tecnologia. • Junte-se a nós e faça parte dessa transformação! Sobre a empresa: Estamos buscando um(a) Engenheiro(a) de Dados Pleno para atuar desenvolvendo e sustentando a infraestrutura que abastece dashboards, análises e modelos de Machine Learning. A posição terá atuação próxima a analistas, cientistas de dados e áreas de negócio, transformando necessidades em soluções de dados robustas, confiáveis e escaláveis. Modelo de trabalho híbrido, com atuação presencial 2x por semana em Blumenau/SC.