Data Engineer
Na Media Hero, o nosso core business são dados: nosso produto se constrói em cima deles. Se você gosta de colocar a mão na massa, garantindo a qualidade, confiabilidade e escalabilidade da infraestrutura de dados que sustenta os produtos e análises da empresa, essa vaga pode ser para você.
Por que essa vaga existe
A Media Hero está crescendo: mais clientes, mais dados, mais gente dependendo da plataforma para tomar decisão todos os dias. O time de dados é a base da operação, e isso significa que precisamos evoluir a arquitetura, criar pipelines novos e sustentar o crescimento que já está acontecendo, contribuindo para a melhoria contínua dos pipelines e processos de ingestão, transformação e disponibilização de dados. Você entra para o time crescer na mesma velocidade que a empresa.
O que você vai fazer
- Projetar e evoluir pipelines de ingestão, transformação e disponibilização de dados que sustentam produtos, análises e modelos de Machine Learning.
- Construir integrações com APIs, arquivos (SFTP, formatos CSV, Parquet, Delta Lake, etc), scraping e conectores gerenciados, entregando dados prontos para uso.
- Manter e evoluir Feature Store de variáveis externas como indicadores macroeconômicos, clima, entre outros.
- Criar e organizar transformações no dbt, com padrões que o resto do time consegue seguir.
- Criar e manter orquestrações de dados confiáveis, com testes e validações que pegam o erro antes de chegar ao cliente.
- Investigar incidentes e gargalos até a causa raiz, e implementar a solução que evita que aconteça de novo.
- Evoluir a arquitetura de dados buscando mais performance, modularidade e rastreabilidade, propondo e questionando escolhas técnicas.
- Apoiar os times de Produto, Analytics, Operações e Machine Learning a usar a plataforma de dados com eficiência.
O que buscamos
Essencial
- Experiência prática construindo e mantendo pipelines de dados em ambientes produtivos.
- Python e SQL avançados.
- dbt (modelagem, testes, macros) e processos de transformação de dados.
- GCP, principalmente BigQuery, Cloud Storage, Cloud Run e Cloud Build.
- Ferramentas de orquestração: Airflow, Prefect, Dagster ou similar.
- Conhecimento de ETL/ELT e integração de diferentes fontes.
- Git, CI/CD, Docker, testes e boas práticas de desenvolvimento.
- Experiência com monitoramento, observabilidade e tratamento de falhas em pipelines.
- Autonomia para conduzir entregas sem perder a colaboração com o time.
Diferenciais (não eliminam candidatura)
- Arquiteturas de dados em ambientes de alta volumetria.
- Ferramentas de ingestão gerenciada (Fivetran ou similar).
- Dados de marketing, mídia ou produtos digitais.
- Analytics ou Machine Learning.
- Governança de dados: catálogo, políticas e contratos de dados.
Como trabalhamos
- Você é responsável pela entrega do início ao fim, sem microgerenciamento, com espaço para decidir prioridades e como resolver.
- Decisão de arquitetura é coletiva: escolha técnica é discutida e questionada pelo time, não vem pronta de cima.
- Squad multidisciplinar com rituais leves, boa parte do trabalho assíncrona e troca técnica constante entre pares.
O que oferecemos
- Política de bônus atual de até 4 salários anuais.
- Plano de saúde.
- VR.
- Wellhub.
- Atuação híbrida ou remota, com escritório em São Paulo (SP).