DevOps Site Reliability Engineer

Akkodis — Canada · Posted ~2 hours ago

Senior Contract Hybrid Visa History ✓

Skills

Linux DevOps Site Reliability Engineering Automation Cloud Infrastructure CI/CD

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

A DevOps and SRE role focused on improving operational excellence, automation, and reliability of enterprise technology environments.

Highlights

Contract opportunity supporting enterprise technology platforms with focus on reliability, scalability, and automation.

Description

Titre du poste : Ingénieur DevOps / Ingénieur en fiabilité des sites (SRE) – Linux Job Title: DevOps / Site Reliability Engineer – Linux Niveau d’expérience : Niveau intermédiaire à senior Experience Level: Mid-Senior Level Nombre de postes : 1 Open Positions: 1 Niveau du poste : FTC / Contrat Job Level: FTC / Contract Lieu : Montréal, Québec – Mode hybride, 3 jours sur site par semaine Location: Montreal, QC – Hybrid, 3 days onsite/week À propos du mandat About the Engagement Une importante organisation de services financiers recherche un(e) ingénieur(e) DevOps / SRE expérimenté(e) pour soutenir la fiabilité, l’évolutivité, l’automatisation et l’excellence opérationnelle de ses plateformes technologiques d’entreprise. A leading financial services organization is seeking an experienced DevOps / Site Reliability Engineer (SRE) to support the reliability, scalability, automation, and operational excellence of enterprise technology platforms. Le rôle exige une solide expérience pratique de l’administration Linux, des pratiques DevOps, de l’automatisation, de la surveillance, de la gestion des incidents et des technologies infonuagiques dans un environnement hautement réglementé et à haute disponibilité. The role requires strong hands-on experience with Linux administration, DevOps practices, automation, monitoring, incident management, and cloud technologies within a highly regulated and high-availability environment. Le candidat travaillera en étroite collaboration avec les équipes de développement logiciel, d’infrastructure, de soutien applicatif, de cybersécurité et d’autres équipes technologiques afin de créer des services fiables, d’automatiser les processus opérationnels, d’améliorer les performances des systèmes et d’assurer la stabilité des environnements de production. The successful candidate will work closely with software engineering, infrastructure, application support, cybersecurity, and other technology teams to build reliable services, automate operational processes, improve system performance, and ensure production stability. Services à fournir Services to be Provided Concevoir, mettre en œuvre, maintenir et soutenir des systèmes et applications basés sur Linux à haute disponibilité.Design, implement, maintain, and support highly available Linux-based systems and applications.Automatiser les processus de provisionnement, de configuration, de déploiement, de surveillance et d’exploitation à l’aide de scripts et d’outils DevOps.Automate infrastructure, deployment, monitoring, and operational processes using scripting and DevOps tools.Soutenir les pipelines CI/CD et intégrer des pratiques de test et de déploiement automatisés.Support CI/CD pipelines and integrate automated testing and deployment practices.Surveiller la disponibilité, les performances, la capacité et la fiabilité des systèmes dans les environnements de production.Monitor system availability, performance, capacity, and reliability across production environments.Résoudre des problèmes complexes liés à l’infrastructure, aux applications, aux réseaux et aux systèmes.Troubleshoot complex infrastructure, application, networking, and system issues.Participer à la gestion des incidents, à la gestion des problèmes, à l’analyse des causes fondamentales et au rétablissement des services.Participate in incident management, problem management, root-cause analysis, and service recovery activities.Collaborer avec les équipes de développement et d’infrastructure afin d’améliorer la fiabilité des applications et l’efficacité opérationnelle.Collaborate with development and infrastructure teams to improve application reliability and operational efficiency.Mettre en œuvre des pratiques d’Infrastructure as Code et de gestion de configuration.Implement Infrastructure as Code and configuration management practices.Soutenir les environnements infonuagiques et sur site et contribuer aux initiatives de modernisation.Support cloud and on-premises environments and assist with modernization initiatives.Participer aux déploiements en production, aux activités de mise en production et aux processus de gestion des changements.Participate in production deployments, release activities, and change management processes.Développer et maintenir la documentation technique, les procédures opérationnelles et les guides d’exploitation.Develop and maintain technical documentation, operational procedures, and support runbooks.Participer à une rotation de garde et fournir du soutien en production au besoin.Participate in an on-call rotation and provide production support when required.Identifier les possibilités de réduire les activités opérationnelles manuelles grâce à l’automatisation et aux capacités libre-service.Identify opportunities to reduce manual operational activities through automation and self-service capabilities.Expertise requise Expertise Required Plus de 5 ans d’expérience en DevOps, SRE, ingénierie des systèmes, ingénierie de l’infrastructure ou dans un domaine connexe.5+ years of experience in DevOps, Site Reliability Engineering, Systems Engineering, Infrastructure Engineering, or a related discipline.Solide expérience pratique avec les systèmes d’exploitation Linux/Unix, leur administration, leur dépannage et leur optimisation des performances.Strong hands-on experience with Linux/Unix operating systems, administration, troubleshooting, and performance tuning.Solide expérience en scripting avec Python, Bash ou Shell.Strong scripting/programming experience with Python, Bash, or Shell scripting.Expérience avec Git et les pratiques modernes de gestion de versions.Experience with Git and modern software development/version-control practices.Expérience pratique des outils et méthodologies CI/CD.Hands-on experience with CI/CD tools and methodologies.Expérience avec Docker et/ou Kubernetes.Experience with Docker and/or Kubernetes.Expérience avec les outils d’Infrastructure as Code tels que Terraform ou Ansible.Experience with Infrastructure as Code, such as Terraform or Ansible.Solide compréhension des concepts réseau, notamment TCP/IP, DNS, HTTP/HTTPS, équilibrage de charge, pare-feu et dépannage de connectivité.Strong understanding of networking concepts including TCP/IP, DNS, HTTP/HTTPS, load balancing, firewalls, and connectivity troubleshooting.Expérience avec les solutions d’entreprise de surveillance, de journalisation, d’alerte et d’observabilité.Experience with enterprise monitoring, logging, alerting, and observability solutions.Expérience avec des plateformes infonuagiques telles qu’AWS, Azure ou GCP.Understanding of cloud platforms such as AWS, Azure, or GCP.Solide compréhension des concepts de disponibilité, d’évolutivité, de résilience, de capacité et de reprise après sinistre.Strong understanding of system availability, scalability, resilience, capacity, and disaster-recovery concepts.Expérience du soutien d’applications et d’infrastructures dans des environnements de production.Experience supporting applications and infrastructure in production environments.Excellentes capacités d’analyse, de dépannage et de résolution de problèmes.Strong troubleshooting, analytical, and problem-solving skills.Excellentes aptitudes en communication et en collaboration.Excellent communication and collaboration skills.À propos du poste What will you be doing? Administrer et soutenir les serveurs Linux et les applications d’entreprise dans les environnements de développement, de test et de production.Manage and support Linux servers and enterprise applications across development, testing, and production environments.Développer des automatisations pour le provisionnement, la configuration, les déploiements, la surveillance et les tâches opérationnelles.Build automation for provisioning, configuration, deployments, monitoring, and operational tasks.Développer et maintenir des pipelines CI/CD afin de permettre une livraison logicielle fiable et répétable.Develop and maintain CI/CD pipelines to enable reliable and repeatable software delivery.Collaborer avec les équipes applicatives afin d’identifier les risques liés à la fiabilité et de mettre en œuvre les mesures correctives appropriées.Work with application teams to identify reliability risks and implement appropriate remediation.Analyser les incidents de production et effectuer des analyses détaillées des causes fondamentales.Analyze production incidents and perform detailed root-cause analysis.Développer des solutions de surveillance, d’alerte, des tableaux de bord et des indicateurs opérationnels afin d’améliorer l’observabilité des systèmes.Develop monitoring, alerting, dashboards, and operational metrics to improve system observability.Identifier les goulots d’étranglement et effectuer des analyses de performance et de capacité.Identify system bottlenecks and perform performance and capacity analysis.Soutenir les mises en production et les changements d’infrastructure conformément aux processus établis de gestion des changements.Support application releases and infrastructure changes while following established change-management processes.Participer aux activités de reprise après sinistre, de résilience et de continuité des activités.Participate in disaster recovery, resilience, and business-continuity activities.Maintenir la documentation opérationnelle, les articles de connaissances et les guides d’exploitation.Maintain operational documentation, knowledge articles, and runbooks.Collaborer avec des équipes technologiques mondiales et participer aux pratiques de livraison Agile.Collaborate with global technology teams and participate in Agile delivery practices.