SRE - Madrid, Community of Madrid, Spain - Shakers
hace 5 horas
Madrid
Un banco mayorista español de referencia incorpora un/a Coordinador/a senior de Observabilidad y Monitorización. Rol clave para liderar la definición, implantación, operación y evolución del modelo de observabilidad de sus servicios tecnológicos, con visión end-to-end de salud, disponibilidad, rendimiento y experiencia de usuario. 🎯 Sobre el rol Actuarás como punto de coordinación entre el equipo de Proyecto y la Oficina de Observabilidad con equipos técnicos, operación, desarrollo, seguridad, proveedores y responsables de servicio. Enfoque estructurado, trazable, automatizado y orientado a prevención del impacto + mejora continua. Combina profundidad técnica con capacidad de gobierno, liderazgo y coordinación. 🎒 Lo que harás Gobierno de observabilidad y monitorización: • Definir y mantener estrategia, arquitectura, estándares y hoja de ruta., • Establecer criterios para métricas, logs, trazas, eventos, alertas, dashboards, SLI, SLO y umbrales., • Garantizar cobertura de monitorización end-to-end (infra, aplicaciones, integraciones, batch, cloud)., • Mantener inventario de activos monitorizados, dependencias, responsables, alertas y procedimientos. Diseño técnico e implementación: • Liderar diseño e implantación de plataformas de observabilidad en on-premise + híbrido + multicloud., • Coordinar instalación, actualización, hardening, HA, backup y recovery., • Definir estándares de instrumentación para aplicaciones, middleware, infra, redes, microservicios. Administración especializada de herramientas: • Dynatrace (OneAgent, ActiveGate, Smartscape, RUM, Synthetic, APM, Davis AI, Grail, DQL, alerting profiles, SLO, automatización API)., • Elastic Stack (Elasticsearch, Logstash, Kibana, Beats, pipelines ingesta, ILM, control cardinalidad)., • Grafana + Prometheus + Alertmanager + Loki + Tempo (dashboards, PromQL, LogQL)., • BMC Helix (Ops Management, Discovery, event management, correlación, integración ITSM/CMDB)., • Monitorización de redes (NNMi, ThousandEyes, SolarWinds, PRTG, Centreon, Zabbix)., • Monitorización Mainframe (BMC AMI Ops/MainView, OMEGAMON, IBM Z NetView, RMF, SMF, SYSVIEW)., • Otras: OpenTelemetry, Azure Monitor, CloudWatch, GCP Cloud Monitoring, Splunk, AppDynamics, New Relic. Eventos y ITSM: • Diseñar modelo de eventos que reduzca ruido + falsos positivos (correlación + enriquecimiento)., • Asegurar alertas accionables con severidad, contexto, procedimiento, escalado., • Integración con ITSM para creación/actualización/cierre de incidencias con trazabilidad end-to-end. Automatización y observabilidad como código: • Automatizar altas/cambios/bajas vía APIs, CI/CD, IaC (Terraform, Ansible)., • Git + control de versiones + revisión pares aplicado a dashboards, reglas, SLO, alertas., • Scripting Python, PowerShell, Bash. Seguridad y cumplimiento: • Principios mínimo privilegio, segregación funciones, gestión credenciales, cifrado, trazabilidad., • Tratamiento seguro datos telemetría + retención + enmascarado., • Apoyo auditorías + resiliencia + requerimientos regulatorios. Coordinación proyectos y proveedores: • Planificar proyectos de implantación, migración, consolidación y evolución., • Gestionar alcance, hitos, riesgos, dependencias, recursos, presupuesto, licencias., • Gobernar relación con fabricantes/proveedores., • Facilitar comités técnicos + informes ejecutivos. ✅ Imprescindibles • Perfil senior con experiencia técnica demostrable en entornos críticos de alta disponibilidad, preferiblemente sector financiero/bancario., • Dominio de los tres pilares de observabilidad: métricas + logs + trazas., • APM y experiencia digital (instrumentación, trazabilidad distribuida, RUM, sintética)., • Dynatrace en profundidad + al menos 2 plataformas adicionales entre Elastic Stack, Grafana/Prometheus, BMC Helix., • Sistemas e infraestructura: Linux + Windows + virtualización + redes TCP/IP + BBDD., • Cloud y cloud-native: AWS + Azure + GCP + Docker + Kubernetes + microservicios., • Automatización + DevOps: Git, CI/CD, Terraform, Ansible, Python/PowerShell/Bash., • ITIL + gestión de eventos/incidencias/problemas/cambios/capacidad., • Español profesional + inglés valorable. 💡 Suma puntos • Monitorización Mainframe (IBM Z, z/OS, CICS, Db2, IMS, MQ, JES, OMEGAMON, RMF)., • Monitorización de red (NNMi, ThousandEyes, SolarWinds, PRTG, Cisco DNA Center)., • OpenTelemetry en producción., • Certificaciones Dynatrace / Elastic / Grafana Labs / BMC / AWS / Azure / GCP., • ITIL 4 + PMP/PRINCE2/SAFe. 💻 Condiciones • Modalidad: freelance vía Shakers., • Duración: 6 meses inicial + 6 meses posibles adicionales, • Horario: L-J 8:00-17:30, V 8:00-15:00 (calendario Madrid)., • Ubicación: inicialmente híbrido en Madrid las primeras semanas, posteriormente remoto con visitas puntuales En Shakers nos ocupamos de la gestión del proyecto, la facturación y el acompañamiento durante toda la colaboración. Tú te centras en construir un modelo de observabilidad extremo a extremo.