DevOps Engineer

Hace 5 días

Tlanepantla municipio, Estado de Puebla, México Workana Jornada completa
Workana , estamos acompañando a una empresa tecnológica líder en la búsqueda de un/a DevOps Engineer para sumarse a un equipo enfocado en construir y operar plataformas de alta disponibilidad y escala. La compañía construye tecnología en hiperescala, donde las decisiones de ingeniería impactan a millones de usuarios y a operaciones críticas de bancos, retailers y grandes empresas. Cuenta con más de 100 profesionales trabajando sobre sistemas distribuidos resilientes y plataformas capaces de procesar miles de millones de interacciones al año. Si te interesa automatizar procesos, resolver problemas complejos de infraestructura y construir plataformas confiables que puedan escalar, esta oportunidad puede ser para vos. El objetivo de esta posición es construir y operar la capa de entrega y ejecución de los servicios, desde CI/CD y contenedores hasta deployments en Kubernetes o VMs, observabilidad básica y troubleshooting de producción. Buscamos una persona hands-on , capaz de tomar un servicio nuevo y llevarlo desde el repositorio hasta un deployment reproducible, confiable y operable, utilizando los estándares definidos por el equipo. automatización, infraestructura, confiabilidad y resolución de problemas , donde tendrás la oportunidad de trabajar directamente sobre los sistemas que soportan servicios de alta escala. Crear y mantener pipelines de build, test, versionado, publicación de imágenes y deployment. Diseñar y crear nuevos pipelines, no solo modificar los existentes. Kubernetes: Crear y mantener deployments, services, configmaps, secrets, ingress, probes, resource limits/requests, autoscaling y otros recursos necesarios para ejecutar servicios. Crear deployments de Kubernetes desde cero. Crear y mantener charts o configuraciones Helm reutilizables para los servicios del equipo. Deployments en VMs: Configurar y operar servicios que, por sus características, deban desplegarse fuera de Kubernetes. Docker: Mantener prácticas consistentes de empaquetado. Diagnosticar problemas relacionados con DNS, TLS, Ingress, load balancers, puertos, conectividad y routing a nivel de plataforma. Participar activamente en la investigación de fallas de deployment, infraestructura y runtime, trabajando hasta llegar a la causa raíz o a una mitigación. Documentación operativa: Mantener runbooks y documentación suficiente para que los deployments y procedimientos críticos no dependan de conocimiento tribal. Requirements 5+ años de experiencia en roles DevOps, Platform Engineering, SRE o similares, con experiencia práctica trabajando en entornos de producción. Experiencia práctica administrando Linux en entornos de desarrollo o producción. Experiencia sólida con Docker: imágenes, networking, volúmenes, debugging y buenas prácticas de build. Experiencia real desplegando y operando workloads en Kubernetes. Capacidad de crear deployments de Kubernetes desde cero y no únicamente administrar configuraciones existentes. Experiencia creando o manteniendo pipelines de CI/CD, con capacidad para diseñar un pipeline nuevo para un servicio. Experiencia con Helm o una herramienta equivalente para empaquetado/configuración de Kubernetes. Conocimientos prácticos de networking: DNS, TLS, puertos, ingress, load balancers y troubleshooting de conectividad. Experiencia con observabilidad y diagnóstico mediante logs, métricas y health checks. Capacidad para automatizar tareas utilizando Bash, Python u otro lenguaje de scripting. Experiencia con Infrastructure as Code, idealmente Terraform. Capacidad para investigar incidentes y problemas desconocidos de forma estructurada y autónoma. Inglés técnico funcional para documentación, herramientas y comunicación básica con vendors o soporte. Experiencia con IBM Cloud / IBM Cloud Kubernetes Service (IKS). Experiencia con cert-manager, NGINX Ingress u otros controladores de ingreso. Experiencia con Datadog y/o OpenTelemetry. Experiencia con Prometheus y Grafana. Experiencia administrando DNS o configuración en Cloudflare. Experiencia con sistemas de alta concurrencia o workloads de tiempo real. Trabajo 100% remoto en todo LatAm. Proyecto con impacto real sobre millones de usuarios y operaciones críticas de grandes empresas.