Líder en Ingeniería de Fiabilidad del Sitio SRE con experiencia en IA Fully Remote - US

ZENITH INFOTEK LLC

Líder en Ingeniería de Fiabilidad del Sitio SRE con experiencia en IA

Contratista independiente • Fully Remote - US
Título del puesto: Líder en Ingeniería de Fiabilidad del Sitio (SRE) con experiencia en IA
Ubicación: (Remota)
Duración: 9+ meses (Contrato)
Entrevista: Entrevista en vídeo


Resumen del puesto
Buscamos un líder experimentado en Ingeniería de Fiabilidad del Sitio (SRE) con amplia experiencia en desarrollo de aplicaciones Java, tecnologías en la nube, DevOps y soluciones impulsadas por IA. El candidato ideal liderará iniciativas centradas en mejorar la fiabilidad de las aplicaciones, la escalabilidad, la automatización y la excelencia operativa, aprovechando al mismo tiempo las tecnologías modernas de IA y IA generativa. Este puesto requiere una estrecha colaboración con los equipos de ingeniería, infraestructura y operaciones para construir aplicaciones empresariales altamente disponibles, resilientes y de alto rendimiento.


Responsabilidades clave
  • Diseñar, desarrollar e implementar aplicaciones empresariales escalables, fiables y de alto rendimiento.
  • Colaborar con los equipos de desarrollo, infraestructura y operaciones para mejorar la fiabilidad y disponibilidad del sistema.
  • Construir y mejorar soluciones de automatización para agilizar el despliegue, la monitorización y los procesos operativos.
  • Desarrollar y mantener pipelines CI/CD usando Jenkins, CloudBees o herramientas similares.
  • Monitoriza el estado de la aplicación utilizando plataformas de observabilidad como New Relic, Datadog, Dynatrace y Splunk.
  • Analizar el rendimiento del sistema, identificar cuellos de botella e implementar estrategias de optimización del rendimiento.
  • Soluciones de diseño para alta disponibilidad, redundancia, recuperación automática y tolerancia a fallos.
  • Realizar planificación de capacidad y gestionar el rendimiento de las aplicaciones según los objetivos de SLA/SLO.
  • Liderar pruebas de concepto (POCs) y escalarlas con éxito a implementaciones a nivel empresarial.
  • Implementar las mejores prácticas para la gestión del ciclo de vida de las aplicaciones, el seguimiento y la mejora continua.
  • Trabaja con tecnologías en la nube de AWS para desplegar y gestionar aplicaciones nativas en la nube.
  • Evalúa e integra las tecnologías de IA y IA generativa en los flujos de trabajo operativos.
  • Mentorizar a equipos de ingeniería en principios SRE, prácticas DevOps e ingeniería de fiabilidad.
  • Mantente al día con las tecnologías emergentes y recomienda soluciones innovadoras para mejorar la estabilidad y eficiencia de la plataforma.
Cualificaciones requeridas
  • Licenciatura en Informática, Tecnología de la Información, Ingeniería o un campo relacionado.
  • 10+ años de experiencia en desarrollo de aplicaciones Java empresariales y soporte en tiempo de ejecución.
  • Experiencia sólida con:
    • Java
    • Bota de muelle
    • Arquitectura de microservicios
    • Marcos empresariales de Java
  • Comprensión profunda de:
    • Ingeniería de Fiabilidad del Sitio (SRE)
    • Conceptos de Ingeniería de Fiabilidad
    • Automatización
    • Alta disponibilidad
    • Recuperación automática
    • Escalabilidad
    • Redundancia
  • Experiencia con servicios en la nube de AWS (se prefiere certificación AWS).
  • Experiencia práctica con herramientas CI/CD como Jenkins o CloudBees.
  • Sólido conocimiento de la observabilidad y herramientas de monitorización, incluyendo:
    • Nueva reliquia
    • Datadog
    • Dinatracia
    • Splunk
  • Experiencia con PCF (Pivotal Cloud Foundry), App Pilot y Presto.
  • Sólido conocimiento de la infraestructura de aplicaciones, entornos de ejecución, planificación de capacidad y gestión de SLA/SLO.
  • Experiencia en el diseño y escalamiento de Pruebas de Concepto (POCs) en soluciones de nivel empresarial.
  • Familiaridad con metodologías ágiles y prácticas DevOps.
  • Excelentes habilidades para solucionar problemas, análisis y resolución de problemas.
Cualificaciones Preferidas
  • Experiencia con tecnologías de Inteligencia Artificial (IA).
  • Conocimiento práctico de plataformas y herramientas de IA generativa como:
    • Google Cloud AI (Vertex AI/GHCP)
    • Claude
    • AWS Bedrock
  • Experiencia implementando automatización operativa habilitada por IA.
  • Las certificaciones profesionales o especializadas de AWS son un plus.
Habilidades técnicas
  • Java
  • Bota de muelle
  • Microservicios
  • AWS Cloud
  • Jenkins
  • CloudBees
  • Splunk
  • Datadog
  • Dinatracia
  • Nueva reliquia
  • PCF (Fundición de Nube Pivotal)
  • Piloto de aplicaciones
  • Presto
  • CI/CD
  • DevOps
  • Ingeniería de Fiabilidad del Sitio (SRE)
  • Planificación de la capacidad
  • SLA/SLO
  • IA
  • IA generativa
  • AWS Bedrock
  • Claude
  • Google Cloud AI
Ágil

Este es un puesto remoto.





Aplicar aquí.

* campos requeridos

Ubicación
Or
Or
If no code provided, add their name instead.
Política de privacidad