Logo for Internas

Pessoa Engenheira de Dados Sênior

Role overview

Qualifications

  • Experiência consolidada em processamento e transformação de dados utilizando Apache Spark / PySpark, AWS Glue e EMR.
  • Domínio em consultas e armazenamento avançado, com forte base em SQL e NoSQL (modelagem em S3, Redshift, DynamoDB, RDS, Athena).
  • Atuação comprovada na orquestração de dados com Apache Airflow, Step Functions e EventBridge.
  • Vivência sólida em arquiteturas Lakehouse, Open Table Formats, data contract e schema evolution.

Responsibilities

  • Projetar, desenvolver e manter pipelines de dados robustos e escaláveis, garantindo a qualidade, governança e observabilidade dos dados.
  • Atuar em projetos de processamento massivo de dados utilizando Apache Spark / PySpark, AWS Glue e EMR.
  • Implementar rotinas de orquestração e automação de fluxos de dados com Apache Airflow, Step Functions e EventBridge.
  • Explorar e implementar soluções de IA e GenAI aplicadas a dados (prompt engineering, RAG, embeddings, guardrails e avaliação).

Key facts

Hard skills

Other skills

  • Analytical Thinking
  • Collaboration
  • Curiosity

About the company

Internas logo

Internas

Management Consulting

Company details

IndustryManagement Consulting

Your match analysis

See how your profile stacks up against this role.

We compared the job requirements to your profile to show where you're strong and where you fall short.

Job description

Nosso propósito é criar tecnologias que desafiam as melhores do mundo e mudam o jogo para nossos clientes. Por isso, buscamos profissionais que desejam fazer parte de uma cultura pautada pela excelência e inovação. Se você se identifica com um ambiente de trabalho colaborativo e movido por curiosidade, venha construir o futuro da tecnologia conosco.

Valorizamos o crescimento contínuo dos zuppers, incentivando cada pessoa a trilhar caminhos que impulsionem sua evolução profissional. 

Nesta posição, atuará na transformação da forma como os dados financeiros são processados, analisados e aproveitados para a tomada de decisões estratégicas. O seu papel será fundamental num ambiente desafiador e inovador, utilizando tecnologias de ponta para realizar entregas de alto impacto, aliando forte capacidade técnica, visão analítica e foco em escalabilidade.

O que você fará por aqui

  • Projetar, desenvolver e manter pipelines de dados robustos e escaláveis, garantindo a qualidade, governança e observabilidade dos dados.

  • Atuar em projetos de processamento massivo de dados utilizando Apache Spark / PySpark, AWS Glue e EMR.

  • Implementar rotinas de orquestração e automação de fluxos de dados com Apache Airflow, Step Functions e EventBridge.

  • Modelar e gerir o armazenamento de dados em S3, Open Table Formats e arquitetura Lakehouse, incluindo data contract e schema evolution.

  • Desenvolver e otimizar consultas em Data Warehouses (Redshift, Athena), bases de dados relacionais (RDS) e NoSQL (DynamoDB).

  • Aplicar práticas de governança de dados com Lake Formation, OpenLineage e ferramentas de catalogação e lineage.

  • Monitorizar e garantir a observabilidade dos ambientes de dados com CloudWatch, DataDog e práticas de melhoria contínua.

  • Explorar e implementar soluções de IA e GenAI aplicadas a dados (prompt engineering, RAG, embeddings, guardrails e avaliação).

  • Contribuir para a cultura de automação (toil reduction), DevOps (Dev + Infra + Sec), planeamento de capacidade e otimização da relação custo/performance.

  • Participar na resolução de incidentes, elaboração de runbooks e promoção de práticas de melhoria contínua nos processos.

O que esperamos que você saiba

  • Experiência consolidada em processamento e transformação de dados utilizando Apache Spark / PySpark, AWS Glue e EMR.

  • Domínio em consultas e armazenamento avançado, com forte base em SQL e NoSQL (modelagem em S3, Redshift, DynamoDB, RDS, Athena).

  • Atuação comprovada na orquestração de dados com Apache Airflow, Step Functions e EventBridge.

  • Vivência sólida em arquiteturas Lakehouse, Open Table Formats, data contract e schema evolution.

  • Práticas de governança de dados utilizando Lake Formation e OpenLineage.

  • Conhecimento em configuração de monitorização e observabilidade com CloudWatch, DataDog ou similares.

O que seria muito legal que você soubesse

  • Experiência prática com IA / GenAI aplicada à engenharia de dados (ex: Amazon Bedrock, MCP Server AI Agent, técnicas de RAG e avaliação/eval).

  • Conhecimento e aplicação de desenvolvimento guiado por especificação (Spec Driven Development).

    Para essa posição teremos aplicação de um teste.

O que acontece após minha aplicação na vaga interna?

Confirmada sua candidatura e analisado que seu perfil faz sentido para a posição escolhida, comunicaremos via e-mail a liderança e BP imediatos sobre sua aplicação em seleção interna.

Quer entender mais sobre os detalhes, acesse a página de Vagas Internas na Zupnet.

#LI-DNI #LI-DNP

 

Apply once. Then go straight to the hiring manager.

After you apply, unlock the direct contact details of the people who actually make the call. A quick follow-up makes you 5x more likely to land an interview.

MR

Marcus Rivera

Chief Revenue Officer

m.rivera@company.com
linkedin.com/in/marcusrivera
Unlocked after you apply
·

Related jobs

Other jobs at Internas

Premium

Reach out to the hiring manager directly.

Gain access to the contact details of the hiring managers who actually decide, and reach out to network with them directly. That, plus more when you upgrade:

  • Full match report with fit score and gaps
  • Career diagnostics on how recruiters read you
  • Curated company matches and warm intros
  • 48h early access to new roles

Cancel anytime.