Implement and manage monitoring solutions using Dynatrace, Elasticsearch, and Kibana to ensure system performance and availability. Collaborate with development and operations teams to automate infrastructure, define SLOs/SLIs, and resolve critical incidents.
Seu futuro em tecnologia começa aqui.
Na Capgemini, liberamos a energia humana por meio da tecnologia para gerar impacto real nos negócios, nas pessoas e na sociedade. Somos uma empresa global, diversa e inovadora, composta por um time de mais de 420 mil pessoas, em mais de 50 países. Aqui, aprendizado contínuo, colaboração e protagonismo fazem parte do dia a dia e você tem a oportunidade de trabalhar em um ambiente que valoriza quem você é — sempre com propósito.
O que você precisa saber (requisitos técnicos):
Buscamos uma pessoa para atuar como SRE | DEVOPS, pronta para colaborar, aprender e gerar impacto real junto a um time diverso e engajado.
Experiência sólida em SRE, DevOps ou observabilidade.
Conhecimento avançado em Dynatrace e análise de dados.
Certificação em Azure.
Experiência com monitoramento de infraestrutura e aplicações (APM, logs, métricas e tracing).
Conhecimento de arquiteturas em nuvem (Azure, AWS ou GCP) e containers (Docker, Kubernetes).
Experiência em automação e infraestrutura como código (Terraform, Ansible, etc.).
Familiaridade com CI/CD (Jenkins, GitLab CI/CD, preferencialmente).
Conhecimento em banco de dados (SQL Server e MongoDB).
Experiência com Kibana, Elasticsearch e Kafka.
Experiência em gestão de incidentes e otimização de performance.
Entendimento de protocolos de comunicação (HTTP, TCP/IP) e troubleshooting de rede.
O que você vai fazer no seu dia a dia:
Implementar e gerenciar Dynatrace para monitoramento de desempenho de aplicações e infraestrutura.
Configurar dashboards, alertas e métricas para otimizar a observabilidade e resposta a incidentes.
Gerenciar e otimizar clusters Elasticsearch, garantindo performance e disponibilidade dos dados.
Criar dashboards personalizados no Kibana, visualizando logs, métricas e eventos para suporte à operação e análise de incidentes.
Automatizar processos de monitoramento e mitigação de falhas, garantindo alta disponibilidade dos serviços.
Analisar e identificar gargalos de performance, propondo melhorias contínuas na infraestrutura.
Colaborar com equipes de desenvolvimento e operações para aprimorar a resiliência dos sistemas.
Definir e implementar SLIs, SLOs e SLAs, alinhados às necessidades do negócio.
Investigar e responder a incidentes críticos, aplicando soluções permanentes para evitar recorrências.
Apoiar iniciativas de DevOps e observabilidade, promovendo cultura de confiabilidade.
O que oferecemos para o seu desenvolvimento:
Plano de carreira estruturado e trilhas personalizadas de aprendizado
Universidade Corporativa, com acesso a Harvard, Coursera, Udemy e Pluralsight
Certificações oficiais com parceiros como SAP, AWS, Microsoft e Salesforce
Plataforma EF Education First (Inglês, Espanhol, Francês e Alemão)
O que oferecemos para o seu bem-estar completo:
Assistência médica e odontológica
TotalPass
Capgemini Equilibrium (acompanhamento nutricional e psicoterápico)
Previdência privada e seguro de vida
Programa Family Care: licenças maternidade e paternidade estendidas, apoio à fertilidade, orientação personalizada em saúde e bem-estar
Vale-refeição/alimentação
Opção de compra de ações da empresa com desconto
Auxílio home-office
Desconto em farmácias
Clube de benefícios e muito mais!
Diversidade, Equidade e Inclusão: Seja Você na Capgemini
Valorizamos a diversidade em todas as suas formas e promovemos um ambiente inclusivo, reconhecido globalmente por seu compromisso com ética, equidade e pertencimento.
“I was the first applicant for a remote marketing position that got listed on the company website the same day I applied. Had an interview within 48 hours!”