AI DevOps / Site Reliability Engineer

Acltecnologia — Chile · Posted ~3 hours ago

Mid Full-time Hybrid

Skills

DevOps SRE CI/CD Jenkins AWS Azure GCP Monitoring Observability AI deployment Automation

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

Work as a DevOps/SRE specialist responsible for bringing AI solutions reliably into production. You will standardize CI/CD pipelines, automate integration and deployment, implement monitoring and code-quality controls, operate production AI infrastructure, and establish scalable DevOps practices across a multi-cloud environment.

Highlights

Hybrid role focused on operationalizing AI solutions, standardizing CI/CD, improving observability and platform stability, and establishing DevOps best practices for AI workloads. The position offers cross-functional collaboration with technical leads, AI engineers, and development teams.

Description

En ACL Tecnología, empresa líder en soluciones tecnológicas con más de 35 años de experiencia en Latinoamérica, estamos buscando un DevOps / SRE IA. Esquema de trabajo hibrido - Santiago. 🔥 ¿Qué harás? Homologar y estandarizar pipelines de CI/CD entre las distintas células de desarrollo.Implementar mecanismos de monitoreo y control de calidad de código.Automatizar procesos de integración, despliegue y operación de soluciones de IA.Administrar y operar el AI Gateway en ambientes productivos.Asegurar la disponibilidad, estabilidad y observabilidad de la plataforma.Gestionar el traspaso técnico de componentes desarrollados por el AI Engineer, asegurando su correcta operación.Definir estándares y buenas prácticas de DevOps aplicadas a soluciones de IA.Trabajar coordinadamente con Tech Leads, AI Engineers y equipos de desarrollo. 🎯 ¿Qué buscamos? Experiencia como DevOps/SRE (3+ años) con dominio de CI/CD, idealmente Jenkins. Conocimiento práctico de entornos multi-cloud (AWS, Azure, GCP) y de infraestructura on-premise, con foco en portabilidad y evitar dependencia de un solo proveedor.Experiencia operando y homologando herramientas de calidad/seguridad de código en pipeline: SonarQube y Dependabot (o equivalentes).Conocimiento de operación productiva de servicios críticos: monitoreo, alertamiento, gestión de incidentes, SLOs/SLIs.Familiaridad con conceptos de gobierno de IA en producción: gateways de tráfico a LLMs, control de failover entre proveedores, gestión de accesos y cuentas corporativas.Conocimiento básico de bases de datos relacionales (Oracle) y de bases vectoriales (PostgreSQL + pgvector) a nivel de operación/mantenimiento. Requisitos deseables Experiencia previa operando un AI Gatewayo proxy de LLMs en producción (autenticación centralizada, métricas de consumo de tokens, políticas de DLP).Conocimiento de *semantic caching* (PostgreSQL + pgvector) y de cómo optimizar su performance y tasa de acierto.Experiencia construyendo o manteniendo paneles de administración de infraestructura (gestión de cuentas/accesos, métricas de costo por usuario/célula/proyecto).Certificaciones cloud (AWS/Azure/GCP) o de SRE.Experiencia en homologación de estándares de CI/CD y calidad de código a escala (múltiples equipos/células en simultáneo), no solo un equipo único.Experiencia en entornos regulados donde la auditoría de accesos y consumo es un requisito de cumplimiento. 🌟 Nuestra cultura En ACL, transformamos desafíos en oportunidades. Con más de 30 años apoyando a empresas en Chile y LATAM, combinamos experiencia, innovación y tecnología para entregar soluciones a medida en Desarrollo de Software, QA, IA y Staff Augmentation. Más que un proveedor, somos un socio estratégico que entiende las necesidades de cada cliente y trabaja a su lado para alcanzar sus objetivos. Para nuestro Team Aceliano, somos un espacio de aprendizaje, crecimiento y realización profesional. En ACL promovemos la inclusión bajo la Ley 21.015. ¡Todas las personas son bienvenidas a participar!