Logo for BigDataCorp

Devops/SRE Tech Lead I Observabilidade

Role overview

Qualifications

  • Deep experience with public cloud providers (preferably AWS)
  • Advanced knowledge of Kubernetes and container ecosystems (Docker/containerd)
  • Proficiency in Infrastructure as Code (Terraform, Pulumi or similar)
  • Advanced technical English (for reading, conversation, and conducting forums)

Responsibilities

  • Design, deploy and maintain the telemetry infrastructure ensuring high availability
  • Configure the observability ecosystem to collect application and infrastructure data
  • Administer production clusters ensuring scalability, security, and cost control
  • Guide the infrastructure/platform team, organizing backlogs and mentoring engineers

Key facts

Hard skills

Other skills

  • Communication
  • Negotiation
  • Emotional Intelligence
  • Mentorship

About the company

BigDataCorp logo

BigDataCorp

Information Services & Data Providers

BigDataCorp is the largest datatech in Latin America. We have been working since 2013 to simplify access to public data sources, increasing possibilities and certainties in a world full of uncertainty. We are pioneers in capturing, structuring and distributing data products in Brazil. Our unique data capture process is fully privacy-compliant, and we store the entire evidence chain to provide data provenance for all attributes. Welcome to a new era of data!

Company details

Company typeSME
IndustryInformation Services & Data Providers
Company size51 - 200

Your match analysis

See how your profile stacks up against this role.

We compared the job requirements to your profile to show where you're strong and where you fall short.

Job description

Sobre a BigDataCorp

A BigDataCorp é a maior datatech da América Latina, e democratiza, desde 2013, o acesso aos dados, aumentando possibilidades e certezas em um mundo repleto de incertezas.

Somos pioneiros na captura, estruturação, armazenamento e distribuição de dados no Brasil. Nosso processo é único. Já nascemos adequados à LGPD e às demais regulamentações, garantindo a origem das informações fornecidas, obtidas sempre de forma ética.

Sobre a área e a vaga

Os times de infraestrutura são responsáveis por organizar, manter e evoluir as diferentes plataformas que constituem a base da operação da empresa, da organização dos serviços de computação na nuvem empregados pelos diferentes times técnicos até a definição e implantação de processos relacionados com a segurança da informação na empresa como um todo.

Requirements

O que vai fazer no dia a dia

  • Arquitetura de Observabilidade: Projetar, implantar e manter a infraestrutura de telemetria (OpenTelemetry Collectors, agentes de métricas/logs/traces, concentradores e ferramentas de visualização), garantindo alta disponibilidade da própria plataforma de observabilidade.
  • Governança de Alertas e Métricas: Configurar o ecossistema de observabilidade para coletar dados de aplicações e infraestrutura, definindo regras de alerta acionáveis (Alertmanager/Incident.io) e reduzindo o ruído operando no modelo Observability-as-a-Service para os times de desenvolvimento.
  • Arquitetura e Nuvem: Projetar, operar e evoluir a infraestrutura em AWS utilizando Infraestrutura como Código (IaC).
  • Gestão de Kubernetes: Administrar clusters em produção, garantindo escalabilidade, segurança e controle de custos.
  • CI/CD e Automação: Construir e otimizar pipelines de entrega contínua rápidas e confiáveis, eliminando trabalho operacional repetitivo (toil).
  • Liderança e Mentoria: Guiar o time de infraestrutura/plataforma, organizar o backlog, distribuir tarefas e atuar como mentor(a) para os demais engenheiros.
  • Ponte com Produto: Negociar prioridades técnicas com os times de desenvolvimento e produto.

Habilidades necessárias

  • Cloud: Experiência profunda com provedores de nuvem pública (preferencialmente AWS).
  • Containers: Domínio avançado de Kubernetes e ecossistema de containers (Docker/containerd).
  • Vivência madura na operação e sustentação de sistemas distribuídos e de alta disponibilidade em produção.
  • Infraestrutura de Observabilidade (Hands-on): Experiência comprovada implantando e configurando a pilha de observabilidade via código (IaC/Helm). É necessário dominar o deploy e gerenciamento de ferramentas como Prometheus Operator, OpenTelemetry Collector, Grafana Stack (Loki, Tempo, Mimir) ou agentes/arquitetura em soluções proprietárias (Datadog, New Relic, Dynatrace), incluindo gestão de retenção e custo de dados de telemetria.
  • Capacidade de desenhar arquiteturas resilientes e escaláveis na nuvem.
  • Visão sistêmica de ciclo de vida de desenvolvimento de software (SDLC) para melhorar a experiência dos desenvolvedores (DevEx).
  • Visão de Engenharia de Telemetria: Entendimento profundo de como os dados de observabilidade são gerados, coletados, processados e armazenados (não apenas criar dashboards, mas entender o caminho que o log, a métrica e o trace percorrem desde a aplicação até o banco de dados de telemetria).
  • Experiência em protocolos de resposta a incidentes.
  • Experiência ou forte aptidão para facilitação de ritos ágeis e gestão de entregas de um pequeno time técnico.
  • IaC: Proficiência em Infraestrutura como Código (Terraform, Pulumi ou similar).
  • Programação/Scripting: Capacidade real de codificar para automação (Python, Go ou Bash avançado).
  • CI/CD: Experiência na construção e manutenção de pipelines (GitLab CI, GitHub Actions, Jenkins, etc.).
  • Comunicação e Negociação: Saber traduzir dívidas técnicas e riscos de infraestrutura para uma linguagem de negócios, conseguindo negociar espaço no backlog com os demais times internos.
  • Inteligência Emocional: Resiliência e frieza para tomar decisões rápidas sob pressão durante incidentes (quedas de produção).
  • Perfil Mentoria (Servant Leadership): Gostar de ensinar, destravar o time e formar novos talentos, não apenas querer brilhar sozinho no código.
  • Pragmatismo: Saber equilibrar a "arquitetura perfeita" com as necessidades reais e o tempo de entrega que o negócio exige.
  • Requisitos diferenciais:
      • GitOps & Service Mesh: Prática com Argo CD, Flux, Istio ou Linkerd.
      • FinOps: Experiência prática na redução e otimização de custos de infraestrutura em nuvem.
      • Observabilidade Avançada e eBPF: Uso de eBPF (Cilium, Pixie) para observabilidade sem instrumentação pesada no código.
      • Otimização de Custos em Observabilidade: Estratégias de amostragem (sampling) de traces, agregação/descarte de logs em nível de coletor para evitar explosão de custos de ingestão na nuvem ou SaaS.
      • Segurança (DevSecOps): Gestão de segredos, políticas como código (ex: OPA/Gatekeeper) e segurança de supply chain.
      • Certificações: CKA (Certified Kubernetes Administrator), AWS Solutions Architect ou equivalentes.
      • Idiomas: Inglês técnico avançado (para leitura, conversação e condução de fóruns com eventuais fornecedores/times globais).

Benefits

O que oferecemos

    • Trabalho 100% remoto (trabalhe de onde quiser);
    • Escritório em RJ e SP com ambiente de trabalho descontraído (para quem quiser utilizar);
    • Oportunidades de crescimento e desenvolvimento;
    • Flexibilidade de horários (sim, mesmo em home office);
    • Férias flexíveis (além do regime CLT);
    • Plano de saúde e dental Bradesco;
    • Seguro de vida em grupo;
    • Benefício Refeição via cartão Caju;
    • Auxílio mensal ao home office (móveis e internet);
    • Vale Home Office;
    • OrienteMe (apoio psicológico);
    • Conexa Saúde (apoio psicológico e nutricional);
    • Wellhub;
    • Day Off para aniversários;
    • Licença Maternidade de 6 meses;
    • Licença Paternidade de 1 mês;
    • Auxílio-creche;
    • Convênio SESC;
    • Game night (presencial no escritório do RJ e online no Discord);
    • BDC Learning e BDC Decola (programa de desenvolvimento e crescimento dos nossos profissionais através do subsídio de treinamentos diversos, como cursos, palestras, livros e outros);
    • Equipe unida e sempre pronta para apoiar.

Apply once. Then go straight to the hiring manager.

After you apply, unlock the direct contact details of the people who actually make the call. A quick follow-up makes you 5x more likely to land an interview.

MR

Marcus Rivera

Chief Revenue Officer

m.rivera@company.com
linkedin.com/in/marcusrivera
Unlocked after you apply
·

Tech Lead Related jobs

Other jobs at BigDataCorp

Premium

Reach out to the hiring manager directly.

Gain access to the contact details of the hiring managers who actually decide, and reach out to network with them directly. That, plus more when you upgrade:

  • Full match report with fit score and gaps
  • Career diagnostics on how recruiters read you
  • Curated company matches and warm intros
  • 48h early access to new roles

Cancel anytime.