Reliability Engineer — Regulatory Reliability SOBRE NU Nu es el banco digital líder en América Latina, atendiendo a 140 millones de clientes en Brasil, México y Colombia. La compañía ha estado liderando una transformación industrial al aprovechar los datos y la tecnología patentada para desarrollar productos y servicios innovadores. Guiada por su misión de luchar contra la complejidad y empoderar a las personas, Nu atiende el viaje financiero completo de los clientes, promoviendo el acceso y el avance financiero con préstamos responsables y transparencia. La empresa está impulsada por un modelo de negocio eficiente y escalable que combina un bajo costo de servicio con rendimientos crecientes. El impacto de Nu ha sido reconocido en múltiples premios, incluyendo Time 100 Most Influential Companies, Fast Company’s Most Innovative Companies y Forbes World’s Best Banks. Visita nuestra Página Institucional https://www.nu.com/2026-en Sobre el rol Buscamos un Ingeniero de Confiabilidad para impulsar la confiabilidad, la resiliencia y la excelencia operativa de la infraestructura regulatoria de Nubank. En este rol, serás responsable de resultados críticos de confiabilidad para sistemas que soportan transferencias interbancarias en tiempo real, integraciones regulatorias y plataformas regulatorias clave. Trabajarás en infraestructura, software, redes, seguridad y operaciones para mantener los servicios de misión crítica disponibles, observables y resilientes bajo exigentes restricciones regulatorias y operativas. Qué harás - Ser responsable de la confiabilidad de extremo a extremo de los servicios de infraestructura regulatoria de TI, incluida la conectividad, los flujos de procesamiento de transacciones y los flujos de trabajo operativos relacionados con la liquidación. - Definir, medir y mejorar continuamente los SLI, SLO e indicadores de salud operativa para transacciones y plataformas críticas. - Liderar la respuesta a incidentes para eventos de producción de diferente severidad, coordinar la recuperación e impulsar postmortems de alta calidad con seguimiento concreto de las acciones correctivas. - Diseñar y evolucionar la observabilidad de la plataforma, con énfasis en el tracing, la salud de las colas, la validación de firmas, las señales de infraestructura y la detección temprana de enlaces regulatorios degradados o cuellos de botella en las transacciones. - Planificar y ejecutar ejercicios de recuperación ante desastres y continuidad del negocio, incluida la validación de failover, la preparación de contingencias y la verificación de RTO/RPO. - Reducir el toil operativo a través de la automatización, las herramientas y la mejora de los runbooks para procedimientos operativos y de fallas recurrentes. - Impulsar la planificación de capacidad y la ingeniería de rendimiento para garantizar que las plataformas puedan absorber de manera segura los volúmenes máximos de transacciones y la demanda comercial en evolución. - Colaborar estrechamente con los equipos de seguridad, redes, middleware e ingeniería de software para mejorar el endurecimiento de la plataforma, la resiliencia y la seguridad de la gestión de cambios. - Participar en una rotación de guardia. Qué buscamos - Experiencia en SRE, DevOps o ingeniería de producción operando sistemas de misión crítica y alta disponibilidad. - Experiencia práctica con plataformas de infraestructura de TI, entornos virtualizados e hiperconvergentes como VxRail.