Site Reliability Engineer

Hace 4 horas

Huelva, Andalucia, España agap2 España Jornada completa

Desde agap2 buscamos incorporar un/a Site Reliability Engineer para unirse a un equipo de Platform Engineering y participar en un entorno tecnológico de alta escala.

Trabajarás en un equipo de ingeniería enfocado en facilitar el trabajo de los equipos de desarrollo, garantizando la fiabilidad, disponibilidad, escalabilidad y observabilidad de las plataformas y servicios en producción.

¿Qué harás?

  • Gestionar y evolucionar las herramientas, procesos y estándares relacionados con el deployment y las operaciones de plataforma.
  • Trabajar sobre una infraestructura de alta escala con múltiples microservicios en producción sobre AWS.
  • Analizar y resolver problemas de rendimiento, disponibilidad y escalabilidad, desde su detección inicial hasta el análisis de causa raíz (RCA).
  • Liderar y documentar procesos de Root Cause Analysis (RCA) y post-mortems.
  • Contribuir a una cultura sostenible de on-call, mejorando continuamente runbooks, alertas y procesos operativos.
  • Colaborar con equipos de desarrollo y datos para incorporar prácticas de DevOps y SRE desde el diseño y desarrollo de los servicios.
  • Impulsar buenas prácticas de observabilidad, fiabilidad y DevOps dentro de los equipos de ingeniería.
  • Participar en la definición y evolución de estándares de operación y despliegue.
  • Trabajar con arquitecturas basadas en microservicios y APIs a gran escala.
  • Contribuir a la mejora continua de la plataforma y de los procesos de ingeniería.

¿Qué buscamos?

  • Más de 3 años de experiencia en SRE, DevOps o Infrastructure Engineering.
  • Sólidos conocimientos de Linux, networking Cloud y buenas prácticas de operación.
  • Experiencia sólida trabajando con AWS.
  • Experiencia con Kubernetes, Docker, Helm y nginx.
  • Experiencia con Redis.
  • Experiencia con GitLab para control de código fuente y CI/CD.
  • Conocimientos de PostgreSQL y experiencia con MySQL.
  • Conocimientos de Kafka y arquitecturas de event streaming.
  • Experiencia con Terraform como herramienta de Infrastructure as Code.
  • Experiencia desarrollando y manteniendo pipelines de CI/CD con GitLab CI.
  • Experiencia en monitorización y observabilidad, especialmente con Datadog (APM, logs y dashboards).
  • Conocimientos de prácticas SLO/SLA.
  • Experiencia trabajando con APIs y arquitecturas de microservicios a escala.
  • Nivel alto de inglés.
  • Capacidad de comunicación, colaboración y trabajo en equipo.
  • Mentalidad pragmática, orientada a la responsabilidad y a la resolución de problemas.

Será valorable

  • Experiencia con Istio y Envoy.
  • Conocimientos de Python, Go u otros lenguajes de programación.
  • Experiencia utilizando asistentes de programación basados en IA, como Claude Code, GitHub Copilot o Cursor.

¿Qué ofrecemos?

  • Proyecto estable y de alto impacto tecnológico.
  • 100% remoto.
  • Incorporación a un equipo internacional de Platform Engineering.
  • Trabajo con tecnologías Cloud y arquitecturas de microservicios a gran escala.
  • Entorno orientado a la innovación, la mejora continua y las buenas prácticas de ingeniería.
  • Oportunidades de desarrollo profesional y crecimiento dentro de agap2.

Agap2 ofrece igualdad de oportunidades y garantiza un proceso de selección basado en criterios objetivos, valorando las competencias, experiencia y capacidades de cada candidatura, sin discriminación por razón de género, edad, nacionalidad, discapacidad, orientación sexual, identidad de género o cualquier otra circunstancia personal o social.