Site Reliability Engineer
Straight from Logicalis’s careers page. Apply on the company site — no recruiter, no middleman.
En Logicalis Spain estamos buscando un perfil de Site Reliability Engineer (SRE) para incorporarse a un proyecto de alto impacto dentro de un entorno de observabilidad sobre la Inteligencia Artificial, con el objetivo de garantizar la fiabilidad, escalabilidad y eficiencia operativa de plataformas y productos de IA.
El equipo de Data & AI de Logicalis trabaja con clientes nacionales e internacionales, llevando a cabo importantes proyectos de ingeniería de datos, inteligencia artificial y analítica avanzada, estrategia del dato, gobierno, integración y arquitectura, abarcando todo el ciclo de vida del dato.
FUNCIONES
Garantizar la fiabilidad, disponibilidad y rendimiento de plataformas y productos de IA en entornos de producción.
Definir y gestionar SLIs, SLOs y Error Budgets, colaborando con los equipos de producto para equilibrar innovación y estabilidad.
Diseñar e impulsar soluciones de observabilidad y monitorización, valorable en entornos de Inteligencia Artificial.
Liderar la gestión de incidencias y coordinar la resolución de problemas en entornos críticos, promoviendo una cultura de mejora continua.
Automatizar procesos operativos y desarrollar mecanismos de auto-remediación para mejorar la eficiencia y reducir tareas manuales.
Trabajar junto a equipos de desarrollo, plataforma e IA para garantizar la escalabilidad, resiliencia y optimización de los servicios.
REQUISITOS
3-6 años de experiencia como Site Reliability Engineer (SRE), DevOps Engineer, Production Engineer o Observability Engineer en entornos de producción.
Experiencia trabajando con AWS y/o Azure, así como con plataformas basadas en Kubernetes.
Experiencia con herramientas de observabilidad como Prometheus, Grafana y OpenTelemetry.
Conocimientos de Infraestructura como Código mediante Terraform y/o Bicep y experiencia en entornos CI/CD.
Conocimientos de Python orientados a automatización y mejora de procesos operativos.
Valorable experiencia en entornos de Machine Learning, LLMs, GPUs o plataformas de IA.
Nivel de inglés B2/C1.
BENEFICIOS
> Incorporación inmediata a compañía líder del sector IT con un alto grado de expertise en el área de Data & Analytics dónde nos encontramos en pleno proceso de expansión.
> Estabilidad laboral a través de contrato indefinido con amplias oportunidades de desarrollo profesional y crecimiento en la compañía.
> Modelo de trabajo 100% remoto, desde cualquier punto de España.
> Paquete retributivo muy competitivo acorde a la valía del candidato.
> Posibilidad de acogerse a planes de retribución flexible (tarjeta restaurante, tarjeta transporte y tarjeta guardería).
> Seguro médico y GYMPASS.
> Planes de formación adaptados a cada perfil (cursos técnicos, certificaciones oficiales, formación de idiomas...).
> Portal de descuentos especiales para empleados.
> Buen ambiente de trabajo y entorno muy colaborativo.
Descubre de esta oferta y muchas más en nuestra Página de Empleo. 🚀
Similar remote jobs
All Site Reliability Engineer jobs →
Thomson Reuters
Lead Cyber Threat Management Analyst

Thomson Reuters
Staff Platform Engineer

Thomson Reuters
Principal Software Engineer, AI

Blue River Technology
Senior Platform Engineer, ML Infrastructure (Remote)
Discover More than 100,000 Hidden Remote Jobs Before Everyone Else
Unlock All Remote Jobs Today
Simple pricing. Big savings on Quarterly and Yearly.
Monthly Access
- Instant access to fresh remote jobs from 500+ companies
- New opportunities added hourly, often 3-7 days before anywhere else
- Advanced filtering by role type, stack, pay, and location
- Priority customer support
Yearly Access
- Everything in Monthly
- Save $169 (~74%) vs paying monthly
- Average job search takes ~6 months - get covered for the whole journey
- Less than the cost of one lunch per month for competitive advantage
- Equivalent to just ~$4.92/month