Puesto: Ingeniero Senior de Soporte a la Producción
Ubicación: Austin, TX (En el recinto)
Nivel de experiencia: 8+ años
Rol Propósito Es responsable del triaje de incidentes aumentado por IA, la ejecución del runbook y el análisis de causas raíz, y por separado es responsable de la detección de anomalías impulsadas por IA y las alertas de gasto/uso.
Responsabilidades clave:
• Propio triaje de incidentes aumentado por IA, ejecución de runbook y análisis de causas raíz en las 3 aplicaciones principales de FinOps y 50+ servicios.
• Construir y mantener alertas de detección de anomalías y gastos/uso impulsadas por IA.
• Apoyar el objetivo de tiempo de actividad del 99,99% durante el horario laboral central del PST (8:00-17:00)
• Operar dentro de la parte de soporte de entrega (niveles L1/L2/L3) dentro del 35% de la división de correr y soporte.
• Contribuir a establecer la base de los tiempos de respuesta/resolución de incidentes tras la transición.
Imprescindibles:
• 8–13 años en soporte de producción o SRE, incluyendo gestión de incidentes.
• Experiencia con herramientas de monitorización/alerta, idealmente nativas de GCP.
• Demostró disciplina de análisis de causas raíz a escala de producción.
Un gusto tener:
• Experiencia con herramientas de detección de anomalías basadas en IA.
• Node.js o Python para automatización/scripting de soporte.
Ubicación: Austin, TX (En el recinto)
Nivel de experiencia: 8+ años
Rol Propósito Es responsable del triaje de incidentes aumentado por IA, la ejecución del runbook y el análisis de causas raíz, y por separado es responsable de la detección de anomalías impulsadas por IA y las alertas de gasto/uso.
Responsabilidades clave:
• Propio triaje de incidentes aumentado por IA, ejecución de runbook y análisis de causas raíz en las 3 aplicaciones principales de FinOps y 50+ servicios.
• Construir y mantener alertas de detección de anomalías y gastos/uso impulsadas por IA.
• Apoyar el objetivo de tiempo de actividad del 99,99% durante el horario laboral central del PST (8:00-17:00)
• Operar dentro de la parte de soporte de entrega (niveles L1/L2/L3) dentro del 35% de la división de correr y soporte.
• Contribuir a establecer la base de los tiempos de respuesta/resolución de incidentes tras la transición.
Imprescindibles:
• 8–13 años en soporte de producción o SRE, incluyendo gestión de incidentes.
• Experiencia con herramientas de monitorización/alerta, idealmente nativas de GCP.
• Demostró disciplina de análisis de causas raíz a escala de producción.
Un gusto tener:
• Experiencia con herramientas de detección de anomalías basadas en IA.
• Node.js o Python para automatización/scripting de soporte.
Somos un empleador con igualdad de oportunidades y todos los candidatos calificados recibirán consideración por el empleo sin distinción de raza, color, religión, sexo, origen nacional, estado de discapacidad, estado de veterano protegido o cualquier otra característica protegida por la ley.
(si ya tienes un currículum en Indeed)
