Please mention DailyRemote when applying
Match your resume skills with our AI powered skill match!
Questions interviewers often ask for this role, with sample answers.
Upload your resume and we draft a letter for this exact role, tailored to what it asks for.
Ensure the reliability, availability, and performance of AI platforms and products in production environments. Design observability solutions, manage incidents, and automate operational processes to improve efficiency and scalability.
En Logicalis Spain estamos buscando un perfil de Site Reliability Engineer (SRE) para incorporarse a un proyecto de alto impacto dentro de un entorno de observabilidad sobre la Inteligencia Artificial, con el objetivo de garantizar la fiabilidad, escalabilidad y eficiencia operativa de plataformas y productos de IA.
El equipo de Data & AI de Logicalis trabaja con clientes nacionales e internacionales, llevando a cabo importantes proyectos de ingeniería de datos, inteligencia artificial y analítica avanzada, estrategia del dato, gobierno, integración y arquitectura, abarcando todo el ciclo de vida del dato.
FUNCIONES
Garantizar la fiabilidad, disponibilidad y rendimiento de plataformas y productos de IA en entornos de producción.
Definir y gestionar SLIs, SLOs y Error Budgets, colaborando con los equipos de producto para equilibrar innovación y estabilidad.
Diseñar e impulsar soluciones de observabilidad y monitorización, valorable en entornos de Inteligencia Artificial.
Liderar la gestión de incidencias y coordinar la resolución de problemas en entornos críticos, promoviendo una cultura de mejora continua.
Automatizar procesos operativos y desarrollar mecanismos de auto-remediación para mejorar la eficiencia y reducir tareas manuales.
Trabajar junto a equipos de desarrollo, plataforma e IA para garantizar la escalabilidad, resiliencia y optimización de los servicios.
REQUISITOS
3-6 años de experiencia como Site Reliability Engineer (SRE), DevOps Engineer, Production Engineer o Observability Engineer en entornos de producción.
Experiencia trabajando con AWS y/o Azure, así como con plataformas basadas en Kubernetes.
Experiencia con herramientas de observabilidad como Prometheus, Grafana y OpenTelemetry.
Conocimientos de Infraestructura como Código mediante Terraform y/o Bicep y experiencia en entornos CI/CD.
Conocimientos de Python orientados a automatización y mejora de procesos operativos.
Valorable experiencia en entornos de Machine Learning, LLMs, GPUs o plataformas de IA.
Nivel de inglés B2/C1.
BENEFICIOS
> Incorporación inmediata a compañía líder del sector IT con un alto grado de expertise en el área de Data & Analytics dónde nos encontramos en pleno proceso de expansión.
> Estabilidad laboral a través de contrato indefinido con amplias oportunidades de desarrollo profesional y crecimiento en la compañía.
> Modelo de trabajo 100% remoto, desde cualquier punto de España.
> Paquete retributivo muy competitivo acorde a la valía del candidato.
> Posibilidad de acogerse a planes de retribución flexible (tarjeta restaurante, tarjeta transporte y tarjeta guardería).
> Seguro médico y GYMPASS.
> Planes de formación adaptados a cada perfil (cursos técnicos, certificaciones oficiales, formación de idiomas...).
> Portal de descuentos especiales para empleados.
> Buen ambiente de trabajo y entorno muy colaborativo.
Descubre de esta oferta y muchas más en nuestra Página de Empleo. 🚀
Stop the endless job search. Our AI finds and applies to the best jobs for you.
Featuring 216,786+ Jobs in Site Reliability Engineer
Answer easy questions
216,786+ jobs across 15+ categories
Get your best job matches
Only hand-screened, legit jobs
Find a remote job faster
No ads, scams, or junk
“I was the first applicant for a remote marketing position that got listed on the company website the same day I applied. Had an interview within 48 hours!”