Ingeniero/a Senior de Infraestructura AWS y Observabilidad (EKS + SRE)
Aviso de fuente externaen Cognit Labs
Ingeniero/a Senior de Infraestructura AWS y Observabilidad (EKS + SRE) 📍Presencial · Tiempo completo 🚀 Buscamos un/a ingeniero/a senior de infraestructura con mucha profundidad técnica...
Enlace de postulación no disponible
Salario
No especificado
Ubicación
Buenos Aires, Argentina
Tipo de empleo
No especificado
Modalidad
No especificado
Ingeniero/a Senior de Infraestructura AWS y Observabilidad (EKS + SRE)
Buenos Aires, Argentina
Enlace de postulación no disponible
Descripción del empleo
Ingeniero/a Senior de Infraestructura AWS y Observabilidad (EKS + SRE)
📍Presencial · Tiempo completo
🚀 Buscamos un/a ingeniero/a senior de infraestructura con mucha profundidad técnica en AWS y Kubernetes para trabajar sobre la observabilidad, la capacidad y la confiabilidad de una plataforma SaaS multi-tenant de gestión comercial: decenas de microservicios .NET y Python desplegados sobre EKS, con imágenes publicadas desde GitHub Actions, mensajería asíncrona y cargas de datos e IA.
Vas a instrumentar lo que hoy no se ve, diseñar las alertas que avisan antes del impacto, dimensionar la capacidad del cluster y convertir los arreglos de urgencia en infraestructura como código.
✅ Requisitos
AWS en profundidad: EKS, VPC y su red (subnets, CIDR, ENIs, NAT, ruteo), IAM, ECR, SQS, S3 y CloudWatch, con criterio para dimensionar antes de desplegar.Kubernetes real: scheduler, requests y limits, probes de liveness y readiness, presupuestos de disrupción, distribución entre zonas, autoescalado y estrategias de rollout y rollback.EKS específico: el modelo de una IP de VPC por pod y sus consecuencias de capacidad, prefix delegation, y Karpenter con sus NodePools, límites y consolidación.Observabilidad con OpenTelemetry en sus tres señales, instrumentando servicios .NET y Python, con propagación de contexto entre servicios y criterio de cardinalidad y costo.Definición de salud por servicio: indicadores, objetivos y presupuesto de error (SLIs, SLOs, error budget).Diseño de alertas accionables: síntoma antes que causa, umbral justificado, severidad y runbook enlazado.Detección de cuellos de botella: saturación de CPU, memoria, red, IPs, pools de conexión y thread pool; latencia en percentiles altos; profundidad y lag de colas.Infraestructura como código con Terraform: módulos, estado, plan previo y detección de drift.CI/CD con GitHub Actions: workflows reutilizables, publicación de imágenes y despliegue a Kubernetes con reversión.Docker con builds multi-etapa y manejo de secretos que no quedan en la imagen.Linux y redes: DNS, TLS y diagnóstico cuando hay que bajar a la capa de red.Scripting en Bash y Python para automatizar diagnóstico y tareas repetitivas.Gestión de incidentes: severidades, coordinación, comunicación y post-mortem con acciones que se ejecutan.
⭐ Deseables
Infraestructura como código con CDK o Pulumi como alternativa a Terraform.Go para scripting y automatización.Stack de métricas y dashboards (Prometheus y Grafana, CloudWatch o suites comerciales), con criterio de diseño del tablero.Gestión de secretos con servicio dedicado y montaje seguro en build.Seguimiento del costo de infraestructura: atribución, right-sizing y uso de instancias spot.
🧩 Perfil ideal
Es un rol de especialista técnico y de monitoreo activo. No buscamos a alguien que apague incendios rápido: buscamos a quien encuentre el próximo problema mientras todavía es una métrica que sube despacio. La persona ideal:Es proactiva y preventiva: instrumenta lo que no se ve y convierte los arreglos de urgencia en infraestructura como código, en lugar de acumular parches.Tiene conciencia de radio de impacto: entiende que la plataforma es multi-cliente y que un cambio de infraestructura los alcanza a todos a la vez.Tiene criterio sobre la fatiga de alertas: sabe qué merece despertar a alguien y qué no.Usa asistentes de IA a diario y tiene la capacidad de detectar cuándo proponen un manifiesto o una política de permisos que abre un problema.
¿Es tuya esta vacante?
Reclámala gratis y recibe candidatos con video en CazVid.