EU remote
Senior DevOps | Responsable de infraestructura cloud
About this role
Somos una empresa europea de software con un ERP que cubre nóminas, planificación, facturación y contabilidad. La disponibilidad, la integridad de los datos y la recuperación son críticas. • INFRAESTRUCTURA ACTUAL: servidores alojados, servicios de AWS, Cloudflare, contenedores, SQL Server y componentes legacy sobre Windows. • APLICACIÓN MODERNA: .NET 10 y Blazor Server en contenedores, con SQL Server y conexiones SignalR con estado.
• TOOLING: IaC, actualmente con Terraform, además de Docker Compose, GitHub Actions, HAProxy, Nginx, Prometheus, Grafana, Loki, Alertmanager, OpenTelemetry y Zabbix. Buscamos un perfil DevOps sénior a jornada completa para responsabilizarse de nuestra infraestructura cloud y liderar de forma hands-on la migración a AWS de un ERP crítico para el negocio. Resultados iniciales esperados Assessment del estado actual y mapa de dependencias Arquitectura objetivo en AWS con riesgos, modelo de costes y prioridades de migración Primeras cargas migradas mediante un workflow repetible de IaC y CI/CD Procedimientos de backup y recuperación probados, con objetivos RTO y RPO acordados Dashboards, alertas y runbooks para los servicios críticos Evaluar la infraestructura actual, sus dependencias, riesgos, costes y carencias operativas Definir la arquitectura objetivo en AWS y un plan de migración incremental con criterios explícitos de cutover y rollback Implementar IaC con Terraform, AWS CDK u otra herramienta adecuada y hacer repetible el aprovisionamiento de entornos Migrar cargas manteniendo la compatibilidad con SQL Server, Windows y otras dependencias legacy Atender la gestión operativa diaria de la infraestructura: altas, bajas y cambios de usuarios, permisos, accesos y cuentas de servicio Gestionar certificados, DNS, secretos, parches, mantenimiento de servidores y otras solicitudes operativas del equipo Automatizar las tareas operativas repetitivas y documentarlas para reducir la intervención manual y los errores Mejorar CI/CD, la seguridad de las releases, los secretos, los controles de acceso y la separación de entornos Establecer observabilidad útil, planificación de capacidad, alertas y respuesta ante incidentes Definir y probar procedimientos de backup, restore, failover, RTO y RPO Mejorar la fiabilidad y los costes de AWS.