Site Reliability Engineer (Observabilidad IA)
Sign up free to see how well your resume matches this role.
What you'll do
- Garantizar la fiabilidad, disponibilidad y rendimiento de plataformas y productos de IA en entornos de producción.
- Definir y gestionar SLIs, SLOs y Error Budgets, colaborando con los equipos de producto para equilibrar innovación y estabilidad.
- Diseñar e impulsar soluciones de observabilidad y monitorización, valorable en entornos de Inteligencia Artificial.
- Liderar la gestión de incidencias y coordinar la resolución de problemas en entornos críticos, promoviendo una cultura de mejora continua.
- Automatizar procesos operativos y desarrollar mecanismos de auto-remediación para mejorar la eficiencia y reducir tareas manuales.
- Trabajar junto a equipos de desarrollo, plataforma e IA para garantizar la escalabilidad, resiliencia y optimización de los servicios.
What they're looking for
- 3-6 años de experiencia como Site Reliability Engineer (SRE), DevOps Engineer, Production Engineer o Observability Engineer en entornos de producción.
- Experiencia trabajando con AWS y/o Azure, así como con plataformas basadas en Kubernetes.
- Experiencia con herramientas de observabilidad como Prometheus, Grafana y OpenTelemetry.
- Conocimientos de Infraestructura como Código mediante Terraform y/o Bicep y experiencia en entornos CI/CD.
- Conocimientos de Python orientados a automatización y mejora de procesos operativos.
- Nivel de inglés B2/C1.
Nice to have
- Valorable experiencia en entornos de Machine Learning, LLMs, GPUs o plataformas de IA.
Summarised by NextRaise from the employer’s description, which follows in full below.
Full description from employer
En Logicalis Spain estamos buscando un perfil de Site Reliability Engineer (SRE) para incorporarse a un proyecto de alto impacto dentro de un entorno de observabilidad sobre la Inteligencia Artificial, con el objetivo de garantizar la fiabilidad, escalabilidad y eficiencia operativa de plataformas y productos de IA.
El equipo de Data & AI de Logicalis trabaja con clientes nacionales e internacionales, llevando a cabo importantes proyectos de ingeniería de datos, inteligencia artificial y analítica avanzada, estrategia del dato, gobierno, integración y arquitectura, abarcando todo el ciclo de vida del dato.
FUNCIONES
Garantizar la fiabilidad, disponibilidad y rendimiento de plataformas y productos de IA en entornos de producción.
Definir y gestionar SLIs, SLOs y Error Budgets, colaborando con los equipos de producto para equilibrar innovación y estabilidad.
Diseñar e impulsar soluciones de observabilidad y monitorización, valorable en entornos de Inteligencia Artificial.
Liderar la gestión de incidencias y coordinar la resolución de problemas en entornos críticos, promoviendo una cultura de mejora continua.
Automatizar procesos operativos y desarrollar mecanismos de auto-remediación para mejorar la eficiencia y reducir tareas manuales.
Trabajar junto a equipos de desarrollo, plataforma e IA para garantizar la escalabilidad, resiliencia y optimización de los servicios.
REQUISITOS
3-6 años de experiencia como Site Reliability Engineer (SRE), DevOps Engineer, Production Engineer o Observability Engineer en entornos de producción.
Experiencia trabajando con AWS y/o Azure, así como con plataformas basadas en Kubernetes.
Experiencia con herramientas de observabilidad como Prometheus, Grafana y OpenTelemetry.
Conocimientos de Infraestructura como Código mediante Terraform y/o Bicep y experiencia en entornos CI/CD.
Conocimientos de Python orientados a automatización y mejora de procesos operativos.
Valorable experiencia en entornos de Machine Learning, LLMs, GPUs o plataformas de IA.
Nivel de inglés B2/C1.
BENEFICIOS
> Incorporación inmediata a compañía líder del sector IT con un alto grado de expertise en el área de Data & Analytics dónde nos encontramos en pleno proceso de expansión.
> Estabilidad laboral a través de contrato indefinido con amplias oportunidades de desarrollo profesional y crecimiento en la compañía.
> Modelo de trabajo 100% remoto, desde cualquier punto de España.
> Paquete retributivo muy competitivo acorde a la valía del candidato.
> Posibilidad de acogerse a planes de retribución flexible (tarjeta restaurante, tarjeta transporte y tarjeta guardería).
> Seguro médico y GYMPASS.
> Planes de formación adaptados a cada perfil (cursos técnicos, certificaciones oficiales, formación de idiomas...).
> Portal de descuentos especiales para empleados.
> Buen ambiente de trabajo y entorno muy colaborativo.
Descubre de esta oferta y muchas más en nuestra Página de Empleo. 🚀
Company
Company facts come from this company's own listings. We only show what the postings themselves carry.