🎁 Antes de postularte, practica esta entrevista. Crea tu cuenta gratis en WorkMundi y recibe un Entrenamiento de Entrevista en HelpsYouSpeak — sin costo, sin tarjeta. Quiero mi entrenamiento →
🚀 ¡En HITSS buscamos un/a Ingeniero/a de Operaciones de Datos e Inteligencia Artificial! En HITSS estamos buscando un/a profesional con experiencia en Data Engineering, DevOps, Platform Engineering o Site Reliability , que quiera asumir el desafío de asegurar la continuidad, estabilidad y automatización de servicios de datos e Inteligencia Artificial en ambientes productivos sobre AWS . 🎯 ¿Cuál será tu misión? Asegurar la continuidad operacional de pipelines de datos, servicios de inferencia con modelos de lenguaje y asistentes de voz que operan en producción sobre AWS , desarrollando mecanismos de detección temprana, observabilidad y recuperación automática de incidentes. La posición tendrá un fuerte foco en automatización, confiabilidad y mejora continua , buscando reducir progresivamente la intervención manual sobre los servicios productivos. 💻 Principales responsabilidades 🔹 Diseñar e implementar alertas para detectar incidentes de manera temprana. 🔹 Desarrollar mecanismos de remediación automática para fallas recurrentes. 🔹 Implementar estrategias de resiliencia como reintentos, backoff exponencial, reprocesamiento y degradación controlada. 🔹 Implementar y fortalecer la observabilidad de pipelines, servicios de IA y sistemas de voz. 🔹 Monitorear métricas de inferencia y voz, incluyendo latencia, errores, consumo de tokens y costos. 🔹 Optimizar mecanismos de orquestación, colas y procesos de recuperación. 🔹 Atender y resolver incidentes en ambientes productivos. 🔹 Realizar análisis de causa raíz (RCA), buscando eliminar de manera definitiva las fallas. 🔹 Administrar consumo, latencia y límites de tasa asociados a servicios de modelos de lenguaje y voz. 🔹 Generar y mantener documentación operativa para asegurar la continuidad de los servicios. 🧠 ¿Qué buscamos? Al menos 3 años de experiencia en Ingeniería de Datos, DevOps, Ingeniería de Plataforma, SRE u Operaciones Técnicas de sistemas productivos. Experiencia desarrollando y depurando código Python en ambientes productivos . Experiencia trabajando con AWS . Capacidad para diagnosticar y resolver incidentes productivos mediante análisis de logs, trazabilidad y reproducción de errores. Conocimientos de patrones de resiliencia: idempotencia, reintentos con backoff exponencial, dead-letter queues y manejo de timeouts . Dominio de SQL y Git . Experiencia con herramientas de integración y despliegue continuo. ☁️ Tecnologías AWS Se requiere experiencia con al menos: AWS Lambda Amazon S3 Amazon CloudWatch AWS IAM Step Functions, ECS/Fargate o MWAA/Airflow ⭐ Será un plus si cuentas con experiencia en: Operación de asistentes de voz o sistemas conversacionales en tiempo real. Amazon Connect, Amazon Lex u otras plataformas de voz. Amazon Bedrock, OpenAI, Anthropic u otras APIs de modelos de lenguaje. Gestión de límites de tasa, fallback entre modelos, caché y optimización de costos por token. Terraform o AWS CDK. Datadog, Grafana, Langfuse, LangSmith o Arize. Docker, ECS o EKS. dbt. Inglés técnico a nivel de lectura. 📍 Ubicación: Santiago, Región Metropolitana. 🏢 Modalidad: Híbrida. 🚀 Si tienes experiencia en AWS, Python, Data Engineering, DevOps, automatización y operación de sistemas productivos , ¡queremos conocerte! 📩 Postula y sé parte de HITSS, impulsando soluciones tecnológicas y transformación digital. #HITSS #Empleo #TI #AWS #Python #DataEngineering #DevOps #SRE #Cloud #InteligenciaArtificial #Data #MachineLearning #Tecnología #Santiago #Chile