O time de Data for Product compõe tribos e squads da área de R&D. O nosso trabalho é de transformar dados em ativos estratégicos, consequentemente, gerando e habilitando novas fontes de receita junto aos produtos Blip.
Buscamos uma pessoa Analytics Engineer Plena, curiosa e dedicada, para contribuir ativamente na evolução de nossos produtos. Você terá um papel fundamental na reforma e otimização do nosso contexto de legado, sendo responsável por sustentar, desenvolver e otimizar pipelines complexos, com um foco especial em refatorações e organização de ambientes legados, garantindo a garantia e governança dos dados da plataforma Blip.
Como Data Analyst Pleno algumas de suas atribuições serão:
- Sustentar, desenvolver e implementar pipelines robustos para ingestão e transformação de dados em larga escala, em batch e streaming, com foco na refatoração e otimização de sistemas legados.
- Identificar e executar refatorações em ambientes de dados legados, visando a melhoria contínua da arquitetura, performance e organização.
- Definir e aplicar padrões de arquitetura de dados, modelagem, particionamento, versionamento, segurança e governança.
- Avaliar e recomendar tecnologias e frameworks, garantindo evolução contínua do stack de dados
- Garantir a confiabilidade, qualidade e rastreabilidade dos dados por meio de boas práticas de observabilidade, testes automatizados e monitoramento.
- Atuar como ponto de contato técnico para stakeholders de produto e negócio, traduzindo necessidades estratégicas em soluções de engenharia escaláveis.
- Colaborar com outras disciplinas (Data Analysts, Software Engineers, etc) para integrar soluções de ponta a ponta.
O que esperamos de você:
- Possuir ensino superior completo em exatas (Computação, Engenharia, Matemática, etc).
- Conhecimento nos serviços e funcionalidades da arquitetura Microsoft Azure.
- Conhecimento em tecnologias de processamento paralelo (Hadoop, Spark, Kafka, etc)
- Domínio em ferramentas de ingestão, integração e orquestração de dados (Data Factory, AirFlow, etc).
- Possuir vivência em ambientes com armazenamento de grandes volumes de arquivos (HDFS, Blob Storages, etc).
- Conhecimento de banco de dados relacional (consultas, programação e modelagem).
- Desenvolver em linguagem de programação (Python, Spark e/ou Scala).
- Desenvolvimento de API Rest e Cloud Functions (Azure).
Será um diferencial se você tiver conhecimento em:
- Certificação Azure (Microsoft Certified: Azure Data Engineer Associate).
- Certificação Databricks de nível médio ou avançado (Data Engineer Associate ou Professional).
- Bons conhecimentos em ambientes de cloud google (GCP, Big Query, Looker etc).
- Bons conhecimentos de bancos de dados NoSQL, tais como: Cassandra, MongoDB, etc.
- Conhecimento prévio em soluções que rastreiam eventos/interações de usuários, tais como: Mixpanel e Segment.
Remote - Brazil Remote (Country) Full-time