For Employers

BigDataCorp

Devops/SRE Tech Lead I Observabilidade

Posted 4 hours ago
Apply Now

Please mention DailyRemote when applying

?
Resume Match Score

See how much of this job your resume covers, and what’s missing.

Want a recruiter to go through it line by line?

Get professional review

Create a cover letter for this job

Upload your resume and we draft a letter for this exact role, tailored to what it asks for.

  • Tailored to this role
  • Based on your resume
  • Fully editable

Sobre a BigDataCorp

A BigDataCorp é a maior datatech da América Latina, e democratiza, desde 2013, o acesso aos dados, aumentando possibilidades e certezas em um mundo repleto de incertezas.

Somos pioneiros na captura, estruturação, armazenamento e distribuição de dados no Brasil. Nosso processo é único. Já nascemos adequados à LGPD e às demais regulamentações, garantindo a origem das informações fornecidas, obtidas sempre de forma ética.

Sobre a área e a vaga

Os times de infraestrutura são responsáveis por organizar, manter e evoluir as diferentes plataformas que constituem a base da operação da empresa, da organização dos serviços de computação na nuvem empregados pelos diferentes times técnicos até a definição e implantação de processos relacionados com a segurança da informação na empresa como um todo.

Requirements

O que vai fazer no dia a dia

  • Arquitetura de Observabilidade: Projetar, implantar e manter a infraestrutura de telemetria (OpenTelemetry Collectors, agentes de métricas/logs/traces, concentradores e ferramentas de visualização), garantindo alta disponibilidade da própria plataforma de observabilidade.
  • Governança de Alertas e Métricas: Configurar o ecossistema de observabilidade para coletar dados de aplicações e infraestrutura, definindo regras de alerta acionáveis (Alertmanager/Incident.io) e reduzindo o ruído operando no modelo Observability-as-a-Service para os times de desenvolvimento.
  • Arquitetura e Nuvem: Projetar, operar e evoluir a infraestrutura em AWS utilizando Infraestrutura como Código (IaC).
  • Gestão de Kubernetes: Administrar clusters em produção, garantindo escalabilidade, segurança e controle de custos.
  • CI/CD e Automação: Construir e otimizar pipelines de entrega contínua rápidas e confiáveis, eliminando trabalho operacional repetitivo (toil).
  • Liderança e Mentoria: Guiar o time de infraestrutura/plataforma, organizar o backlog, distribuir tarefas e atuar como mentor(a) para os demais engenheiros.
  • Ponte com Produto: Negociar prioridades técnicas com os times de desenvolvimento e produto.

Habilidades necessárias

  • Cloud: Experiência profunda com provedores de nuvem pública (preferencialmente AWS).
  • Containers: Domínio avançado de Kubernetes e ecossistema de containers (Docker/containerd).
  • Vivência madura na operação e sustentação de sistemas distribuídos e de alta disponibilidade em produção.
  • Infraestrutura de Observabilidade (Hands-on): Experiência comprovada implantando e configurando a pilha de observabilidade via código (IaC/Helm). É necessário dominar o deploy e gerenciamento de ferramentas como Prometheus Operator, OpenTelemetry Collector, Grafana Stack (Loki, Tempo, Mimir) ou agentes/arquitetura em soluções proprietárias (Datadog, New Relic, Dynatrace), incluindo gestão de retenção e custo de dados de telemetria.
  • Capacidade de desenhar arquiteturas resilientes e escaláveis na nuvem.
  • Visão sistêmica de ciclo de vida de desenvolvimento de software (SDLC) para melhorar a experiência dos desenvolvedores (DevEx).
  • Visão de Engenharia de Telemetria: Entendimento profundo de como os dados de observabilidade são gerados, coletados, processados e armazenados (não apenas criar dashboards, mas entender o caminho que o log, a métrica e o trace percorrem desde a aplicação até o banco de dados de telemetria).
  • Experiência em protocolos de resposta a incidentes.
  • Experiência ou forte aptidão para facilitação de ritos ágeis e gestão de entregas de um pequeno time técnico.
  • IaC: Proficiência em Infraestrutura como Código (Terraform, Pulumi ou similar).
  • Programação/Scripting: Capacidade real de codificar para automação (Python, Go ou Bash avançado).
  • CI/CD: Experiência na construção e manutenção de pipelines (GitLab CI, GitHub Actions, Jenkins, etc.).
  • Comunicação e Negociação: Saber traduzir dívidas técnicas e riscos de infraestrutura para uma linguagem de negócios, conseguindo negociar espaço no backlog com os demais times internos.
  • Inteligência Emocional: Resiliência e frieza para tomar decisões rápidas sob pressão durante incidentes (quedas de produção).
  • Perfil Mentoria (Servant Leadership): Gostar de ensinar, destravar o time e formar novos talentos, não apenas querer brilhar sozinho no código.
  • Pragmatismo: Saber equilibrar a "arquitetura perfeita" com as necessidades reais e o tempo de entrega que o negócio exige.
  • Requisitos diferenciais:
      • GitOps & Service Mesh: Prática com Argo CD, Flux, Istio ou Linkerd.
      • FinOps: Experiência prática na redução e otimização de custos de infraestrutura em nuvem.
      • Observabilidade Avançada e eBPF: Uso de eBPF (Cilium, Pixie) para observabilidade sem instrumentação pesada no código.
      • Otimização de Custos em Observabilidade: Estratégias de amostragem (sampling) de traces, agregação/descarte de logs em nível de coletor para evitar explosão de custos de ingestão na nuvem ou SaaS.
      • Segurança (DevSecOps): Gestão de segredos, políticas como código (ex: OPA/Gatekeeper) e segurança de supply chain.
      • Certificações: CKA (Certified Kubernetes Administrator), AWS Solutions Architect ou equivalentes.
      • Idiomas: Inglês técnico avançado (para leitura, conversação e condução de fóruns com eventuais fornecedores/times globais).

Benefits

O que oferecemos

    • Trabalho 100% remoto (trabalhe de onde quiser);
    • Escritório em RJ e SP com ambiente de trabalho descontraído (para quem quiser utilizar);
    • Oportunidades de crescimento e desenvolvimento;
    • Flexibilidade de horários (sim, mesmo em home office);
    • Férias flexíveis (além do regime CLT);
    • Plano de saúde e dental Bradesco;
    • Seguro de vida em grupo;
    • Benefício Refeição via cartão Caju;
    • Auxílio mensal ao home office (móveis e internet);
    • Vale Home Office;
    • OrienteMe (apoio psicológico);
    • Conexa Saúde (apoio psicológico e nutricional);
    • Wellhub;
    • Day Off para aniversários;
    • Licença Maternidade de 6 meses;
    • Licença Paternidade de 1 mês;
    • Auxílio-creche;
    • Convênio SESC;
    • Game night (presencial no escritório do RJ e online no Discord);
    • BDC Learning e BDC Decola (programa de desenvolvimento e crescimento dos nossos profissionais através do subsídio de treinamentos diversos, como cursos, palestras, livros e outros);
    • Equipe unida e sempre pronta para apoiar.

Automatically Apply to the Best Remote Jobs

Stop the endless job search. Our AI finds and applies to the best jobs for you.

Try it Now
Keep looking

Similar Jobs

See all Remote Others jobs →

AI Response Evaluator

Freelance France, Japan, Mexico +3 more $10K – $20K Others

COORDENADOR DE SUPORTE TÉCNICO

Full Time Brazil Others

CONSEILLER OU CONSEILLÈRE EN SOINS INFIRMIERS-NURSING ADVISOR

Full Time Canada 31.48 - 57.81 per hour Others

Senior GIS Analyst

Full Time United States Others

Junior Blood Bank / Transfusion Medicine Consultant – Remote (DHA ASBP)

Full Time United States Others

Director of Commercial Strategy

Full Time United States $119K - $186K per year Others
Apply Now

Personalize your Remote Job Search in 3 Easy Steps!

Featuring 218,631+ Jobs in DevOps Engineer

Answer easy questions

Answer easy questions

218,631+ jobs across 15+ categories

Get your best job matches

Get your best job matches

Only hand-screened, legit jobs

Find a remote job faster

Find a remote job faster

No ads, scams, or junk

“I was the first applicant for a remote marketing position that got listed on the company website the same day I applied. Had an interview within 48 hours!”

Sarah J. — Sarah J. · Marketing Manager ★★★★★ Verified