ZENITH INFOTEK LLC
Líder en Ingeniería de Fiabilidad del Sitio SRE con experiencia en IA
Contratista independiente • Fully Remote - US
Título del puesto: Líder en Ingeniería de Fiabilidad del Sitio (SRE) con experiencia en IA
Ubicación: (Remota)
Duración: 9+ meses (Contrato)
Entrevista: Entrevista en vídeo
Duración: 9+ meses (Contrato)
Entrevista: Entrevista en vídeo
Resumen del puesto
Buscamos un líder experimentado en Ingeniería de Fiabilidad del Sitio (SRE) con amplia experiencia en desarrollo de aplicaciones Java, tecnologías en la nube, DevOps y soluciones impulsadas por IA. El candidato ideal liderará iniciativas centradas en mejorar la fiabilidad de las aplicaciones, la escalabilidad, la automatización y la excelencia operativa, aprovechando al mismo tiempo las tecnologías modernas de IA y IA generativa. Este puesto requiere una estrecha colaboración con los equipos de ingeniería, infraestructura y operaciones para construir aplicaciones empresariales altamente disponibles, resilientes y de alto rendimiento.
Responsabilidades clave
- Diseñar, desarrollar e implementar aplicaciones empresariales escalables, fiables y de alto rendimiento.
- Colaborar con los equipos de desarrollo, infraestructura y operaciones para mejorar la fiabilidad y disponibilidad del sistema.
- Construir y mejorar soluciones de automatización para agilizar el despliegue, la monitorización y los procesos operativos.
- Desarrollar y mantener pipelines CI/CD usando Jenkins, CloudBees o herramientas similares.
- Monitoriza el estado de la aplicación utilizando plataformas de observabilidad como New Relic, Datadog, Dynatrace y Splunk.
- Analizar el rendimiento del sistema, identificar cuellos de botella e implementar estrategias de optimización del rendimiento.
- Soluciones de diseño para alta disponibilidad, redundancia, recuperación automática y tolerancia a fallos.
- Realizar planificación de capacidad y gestionar el rendimiento de las aplicaciones según los objetivos de SLA/SLO.
- Liderar pruebas de concepto (POCs) y escalarlas con éxito a implementaciones a nivel empresarial.
- Implementar las mejores prácticas para la gestión del ciclo de vida de las aplicaciones, el seguimiento y la mejora continua.
- Trabaja con tecnologías en la nube de AWS para desplegar y gestionar aplicaciones nativas en la nube.
- Evalúa e integra las tecnologías de IA y IA generativa en los flujos de trabajo operativos.
- Mentorizar a equipos de ingeniería en principios SRE, prácticas DevOps e ingeniería de fiabilidad.
- Mantente al día con las tecnologías emergentes y recomienda soluciones innovadoras para mejorar la estabilidad y eficiencia de la plataforma.
Cualificaciones requeridas
- Licenciatura en Informática, Tecnología de la Información, Ingeniería o un campo relacionado.
- 10+ años de experiencia en desarrollo de aplicaciones Java empresariales y soporte en tiempo de ejecución.
- Experiencia sólida con:
- Java
- Bota de muelle
- Arquitectura de microservicios
- Marcos empresariales de Java
- Comprensión profunda de:
- Ingeniería de Fiabilidad del Sitio (SRE)
- Conceptos de Ingeniería de Fiabilidad
- Automatización
- Alta disponibilidad
- Recuperación automática
- Escalabilidad
- Redundancia
- Experiencia con servicios en la nube de AWS (se prefiere certificación AWS).
- Experiencia práctica con herramientas CI/CD como Jenkins o CloudBees.
- Sólido conocimiento de la observabilidad y herramientas de monitorización, incluyendo:
- Nueva reliquia
- Datadog
- Dinatracia
- Splunk
- Experiencia con PCF (Pivotal Cloud Foundry), App Pilot y Presto.
- Sólido conocimiento de la infraestructura de aplicaciones, entornos de ejecución, planificación de capacidad y gestión de SLA/SLO.
- Experiencia en el diseño y escalamiento de Pruebas de Concepto (POCs) en soluciones de nivel empresarial.
- Familiaridad con metodologías ágiles y prácticas DevOps.
- Excelentes habilidades para solucionar problemas, análisis y resolución de problemas.
Cualificaciones Preferidas
- Experiencia con tecnologías de Inteligencia Artificial (IA).
- Conocimiento práctico de plataformas y herramientas de IA generativa como:
- Google Cloud AI (Vertex AI/GHCP)
- Claude
- AWS Bedrock
- Experiencia implementando automatización operativa habilitada por IA.
- Las certificaciones profesionales o especializadas de AWS son un plus.
Habilidades técnicas
- Java
- Bota de muelle
- Microservicios
- AWS Cloud
- Jenkins
- CloudBees
- Splunk
- Datadog
- Dinatracia
- Nueva reliquia
- PCF (Fundición de Nube Pivotal)
- Piloto de aplicaciones
- Presto
- CI/CD
- DevOps
- Ingeniería de Fiabilidad del Sitio (SRE)
- Planificación de la capacidad
- SLA/SLO
- IA
- IA generativa
- AWS Bedrock
- Claude
- Google Cloud AI
Ágil
Este es un puesto remoto.