← Back to your search

Talycap Global

Líder Técnico SRE y Observabilidad

DevOps / SRE

Employment

Not stated

Level

Not stated

Team

Tecnología de la Información (TI / IT)
Not doable from Austria

Country assessment

Not doable from Austria because the employer's own board marks it as not remote.

Our assessment is guidance. Confirm arrangements with the employer.

Skills mentioned in this posting

AWSAzureObservability

Job description

🎯 Objetivo del Cargo

Buscamos un Líder Técnico SRE y Observabilidad para participar en un proyecto de alto impacto, liderando la definición e implementación de estrategias de observabilidad y confiabilidad de plataformas. Será responsable de impulsar prácticas de monitoreo proactivo, gestión de incidentes, automatización y mejora continua, contribuyendo a la disponibilidad, estabilidad y rendimiento de entornos tecnológicos híbridos y multicloud.

✅ Requisitos Indispensables

Formación Académica

  • Profesional en Ingeniería de Sistemas.

  • Profesional en Ingeniería de Software.

  • Profesional en Ingeniería Electrónica.

  • Carreras afines.

Experiencia

  • Entre 5 y 6 años de experiencia en infraestructura, operaciones TI, plataformas o ingeniería de software.

  • Mínimo 2 años en roles relacionados con SRE (Site Reliability Engineering).

  • Mínimo 2 años en roles relacionados con Observability.

  • Mínimo 2 años en Reliability Engineering o Performance Engineering.

  • Mínimo 2 años de experiencia en automatización.

  • Experiencia en liderazgo técnico.

  • Experiencia coordinando iniciativas o células de trabajo.

⚙️ Conocimientos Técnicos Indispensables

Observabilidad

  • Diseño e implementación de estrategias de observabilidad.

  • Monitoreo end-to-end.

  • Observabilidad en entornos híbridos.

  • Observabilidad en entornos multicloud.

  • Gestión de métricas.

  • Gestión de logs.

  • Gestión de trazas.

  • Monitoreo proactivo.

Herramientas de Observabilidad

  • Experiencia en al menos una de las siguientes:

    • Dynatrace.

    • Datadog.

    • New Relic.

    • Prometheus.

    • Grafana.

SRE

  • SLI.

  • SLO.

  • SLA.

  • Incident Management.

  • Problem Management.

  • Root Cause Analysis (RCA).

  • Capacity Planning.

  • Error Budgets.

  • Capacidad para definir e implementar prácticas SRE.

Cloud

  • AWS.

  • Azure.

Automatización

  • Automatización operativa.

  • Self-Healing.

⭐ Conocimientos Deseables

Certificaciones

  • SRE Foundation.

  • SRE Practitioner.

  • Dynatrace.

  • Datadog.

  • New Relic.

  • Prometheus.

  • Grafana.

  • AWS.

  • Azure.

Performance Engineering

  • Pruebas de carga.

  • Pruebas de estrés.

  • Chaos Engineering.

SAP

  • SAP RISE.

  • SAP Clean Core.

  • SAP Activate.

  • SAP Basis Cloud.