Líder en Ingeniería de Fiabilidad del Sitio SRE con experiencia en IA Fully Remote - US

ZENITH INFOTEK LLC

Líder en Ingeniería de Fiabilidad del Sitio SRE con experiencia en IA

Contratista independiente • Fully Remote - US
Título del puesto: Líder en Ingeniería de Fiabilidad del Sitio (SRE) con experiencia en IA
Ubicación: (Remota)
Duración: 9+ meses (Contrato)
Entrevista: Entrevista en vídeo


Resumen del puesto
Buscamos un líder experimentado en Ingeniería de Fiabilidad del Sitio (SRE) con amplia experiencia en desarrollo de aplicaciones Java, tecnologías en la nube, DevOps y soluciones impulsadas por IA. El candidato ideal liderará iniciativas centradas en mejorar la fiabilidad de las aplicaciones, la escalabilidad, la automatización y la excelencia operativa, aprovechando al mismo tiempo las tecnologías modernas de IA y IA generativa. Este puesto requiere una estrecha colaboración con los equipos de ingeniería, infraestructura y operaciones para construir aplicaciones empresariales altamente disponibles, resilientes y de alto rendimiento.


Responsabilidades clave
  • Diseñar, desarrollar e implementar aplicaciones empresariales escalables, fiables y de alto rendimiento.
  • Colaborar con los equipos de desarrollo, infraestructura y operaciones para mejorar la fiabilidad y disponibilidad del sistema.
  • Construir y mejorar soluciones de automatización para agilizar el despliegue, la monitorización y los procesos operativos.
  • Desarrollar y mantener pipelines CI/CD usando Jenkins, CloudBees o herramientas similares.
  • Monitoriza el estado de la aplicación utilizando plataformas de observabilidad como New Relic, Datadog, Dynatrace y Splunk.
  • Analizar el rendimiento del sistema, identificar cuellos de botella e implementar estrategias de optimización del rendimiento.
  • Soluciones de diseño para alta disponibilidad, redundancia, recuperación automática y tolerancia a fallos.
  • Realizar planificación de capacidad y gestionar el rendimiento de las aplicaciones según los objetivos de SLA/SLO.
  • Liderar pruebas de concepto (POCs) y escalarlas con éxito a implementaciones a nivel empresarial.
  • Implementar las mejores prácticas para la gestión del ciclo de vida de las aplicaciones, el seguimiento y la mejora continua.
  • Trabaja con tecnologías en la nube de AWS para desplegar y gestionar aplicaciones nativas en la nube.
  • Evalúa e integra las tecnologías de IA y IA generativa en los flujos de trabajo operativos.
  • Mentorizar a equipos de ingeniería en principios SRE, prácticas DevOps e ingeniería de fiabilidad.
  • Mantente al día con las tecnologías emergentes y recomienda soluciones innovadoras para mejorar la estabilidad y eficiencia de la plataforma.
Cualificaciones requeridas
  • Licenciatura en Informática, Tecnología de la Información, Ingeniería o un campo relacionado.
  • 10+ años de experiencia en desarrollo de aplicaciones Java empresariales y soporte en tiempo de ejecución.
  • Experiencia sólida con:
    • Java
    • Bota de muelle
    • Arquitectura de microservicios
    • Marcos empresariales de Java
  • Comprensión profunda de:
    • Ingeniería de Fiabilidad del Sitio (SRE)
    • Conceptos de Ingeniería de Fiabilidad
    • Automatización
    • Alta disponibilidad
    • Recuperación automática
    • Escalabilidad
    • Redundancia
  • Experiencia con servicios en la nube de AWS (se prefiere certificación AWS).
  • Experiencia práctica con herramientas CI/CD como Jenkins o CloudBees.
  • Sólido conocimiento de la observabilidad y herramientas de monitorización, incluyendo:
    • Nueva reliquia
    • Datadog
    • Dinatracia
    • Splunk
  • Experiencia con PCF (Pivotal Cloud Foundry), App Pilot y Presto.
  • Sólido conocimiento de la infraestructura de aplicaciones, entornos de ejecución, planificación de capacidad y gestión de SLA/SLO.
  • Experiencia en el diseño y escalamiento de Pruebas de Concepto (POCs) en soluciones de nivel empresarial.
  • Familiaridad con metodologías ágiles y prácticas DevOps.
  • Excelentes habilidades para solucionar problemas, análisis y resolución de problemas.
Cualificaciones Preferidas
  • Experiencia con tecnologías de Inteligencia Artificial (IA).
  • Conocimiento práctico de plataformas y herramientas de IA generativa como:
    • Google Cloud AI (Vertex AI/GHCP)
    • Claude
    • AWS Bedrock
  • Experiencia implementando automatización operativa habilitada por IA.
  • Las certificaciones profesionales o especializadas de AWS son un plus.
Habilidades técnicas
  • Java
  • Bota de muelle
  • Microservicios
  • AWS Cloud
  • Jenkins
  • CloudBees
  • Splunk
  • Datadog
  • Dinatracia
  • Nueva reliquia
  • PCF (Fundición de Nube Pivotal)
  • Piloto de aplicaciones
  • Presto
  • CI/CD
  • DevOps
  • Ingeniería de Fiabilidad del Sitio (SRE)
  • Planificación de la capacidad
  • SLA/SLO
  • IA
  • IA generativa
  • AWS Bedrock
  • Claude
  • Google Cloud AI
Ágil

Este es un puesto remoto.





Aplicar aquí.

* campos requeridos

Text me updates about my application
Message and data rates may apply. Message frequency varies. Reply STOP to opt out. Reply HELP for help. See our User Terms of Service and Privacy Policy for details.
Ubicación
Or
Or
If no code provided, add their name instead.
Política de privacidad