Logo for Cadmus Soluções em TI

Engenheiro de Dados Sr

Role overview

Qualifications

  • Bachelor's degree in Technology, exact sciences or related areas
  • Solid experience (5+ years) in data engineering, mainly in large-scale environments
  • Advanced Python knowledge with good coding practices, testing and modularization
  • Strong experience with PySpark in production, including tuning and troubleshooting

Responsibilities

  • Design, develop, and maintain end-to-end batch pipelines (ingestion, transformation, modeling, and availability) processing terabyte volumes
  • Build and optimize PySpark jobs, paying attention to partitioning, shuffle, skew, memory usage, and execution costs
  • Develop, maintain, and evolve DAGs in Apache Airflow, ensuring idempotency, error handling, retries, and proper SLAs
  • Investigate and resolve incidents in production pipelines, addressing root causes and proposing structural improvements

About the company

Cadmus Soluções em TI logo

Cadmus Soluções em TI

IT Services & IT Consulting

Transformamos ideias em potência com propósito de impactar a sociedade.Somos incansáveis na busca dos melhores talentos porque só com pessoas extraordinárias entregamos resultados extraordinários. Seja com a busca do melhor profissional de TI, seja com desenvolvimento ágil dando vida à ideias, seja com a nova cultura digital, nós nos apaixonamos pelo negócio dos nossos clientes e é isso que nos move.Somos uma empresa com o selo GPTW - Great Place to Work, acreditamos no ser humano e na sua capacidade de virar a chave para o novo e essa é a nossa inspiração ao longo de 28 anos. Afinal, à frente de toda tecnologia há uma pessoa.O Jeito Cadmus de ser:- People First- Seu negócio é meu negócio- Cumprir o combinado- Clareza- Compartilhar- FelicidadeÁgeis, Digitais, Humanos.

Company details

Company typeLarge
IndustryIT Services & IT Consulting
Company size1001 - 5000

Your match analysis

See how your profile stacks up against this role.

We compared the job requirements to your profile to show where you're strong and where you fall short.

Job description

O que você vai fazer por aqui:
•    Projetar, desenvolver e manter pipelines batch end-to-end (ingestão, transformação, modelagem e disponibilização) processando volumes na casa dos terabytes.
•    Construir e otimizar jobs PySpark, com atenção a particionamento, shuffle, skew, uso de memória e custo de execução.
•    Desenvolver, manter e evoluir DAGs no Apache Airflow, garantindo idempotência, tratamento de falhas, retries e SLAs adequados.
•    Modelar e implementar transformações em dbt, garantindo testes, documentação, lineage e boas práticas de versionamento.
•    Evoluir camadas de dados (raw, curated, analytics) seguindo padrões consistentes de qualidade, contratos e SLAs.
•    Investigar e resolver incidentes em pipelines de produção, atuando na causa raiz e propondo melhorias estruturais.
•    Implementar e manter mecanismos de data quality, observabilidade e monitoramento.
•    Colaborar com times de analytics e negócio para entender requisitos, propor modelagens adequadas e garantir confiabilidade dos dados entregues.
•    Contribuir com decisões de arquitetura, code reviews e disseminação de boas práticas dentro do time.

O que esperamos de você:
•    Residir em São Paulo, capital;
•    Formação em ensino superior completo em Tecnologia, exatas ou área correlatas;
•    Experiência sólida (5+ anos) em engenharia de dados, com pelo menos parte significativa em ambientes de larga escala.
•    Python avançado, com boas práticas de código, testes e modularização.
•    Forte experiência com PySpark em produção, incluindo tuning e troubleshooting de jobs em escala.
•    SQL avançado, com domínio de window functions, CTEs, otimização de queries e modelagem analítica.
•    Experiência prática com dbt em projetos de médio/grande porte (modelos incrementais, testes, macros, exposures).
•    Experiência sólida com Apache Airflow em produção, incluindo desenvolvimento de DAGs complexas, uso de operadores customizados, sensors, gerenciamento de dependências e troubleshooting de execuções.
•    Vivência consolidada em AWS para dados (S3, Glue, EMR/EMR Serverless, Athena, IAM, Lambda, entre outros).
•    Conhecimento de formatos de tabela abertos (Iceberg, Delta ou Hudi) e suas implicações em performance e custo.
•    Capacidade de discutir e justificar trade-offs de arquitetura (custo, latência, complexidade, manutenibilidade).

Apply once. Then go straight to the hiring manager.

After you apply, unlock the direct contact details of the people who actually make the call. A quick follow-up makes you 5x more likely to land an interview.

MR

Marcus Rivera

Chief Revenue Officer

m.rivera@company.com
linkedin.com/in/marcusrivera
Unlocked after you apply
·

Data Engineer Related jobs

Other jobs at Cadmus Soluções em TI

Premium

Reach out to the hiring manager directly.

Gain access to the contact details of the hiring managers who actually decide, and reach out to network with them directly. That, plus more when you upgrade:

  • Full match report with fit score and gaps
  • Career diagnostics on how recruiters read you
  • Curated company matches and warm intros
  • 48h early access to new roles

Cancel anytime.