Cloud DevOps Engineer

Lancesoft — Canada · Posted ~21 hours ago

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Description

Job Title: Cloud DevOps Engineer Job Duration: 12 Months Location: Kanata, Ontario, K2V 1C2 Pay Rate: 43.90 CAD per hour Shift Timing Monday to Friday, First Shift Job Description: Seeking a Senior Cloud DevOps Engineer to join the Cloud Operations organization. This role is responsible for the reliability, scalability, automation, and continuous improvement of IAM cloud infrastructure and platforms across AWS and GCP, with a strong focus on automation, observability, and AI-assisted operations (AIOps). Responsibilities: · Essential Functions / Key Areas of Responsibility · Cloud Operations & Reliability Engineering · Operate and support production-grade, highly available IAM cloud services · Ensure availability, performance, resilience, and security of platforms · Participate in L2/L3 incident response, root-cause analysis, and post-incident reviews · Take part in a 24/7 follow-the-sun on-call rotation · Drive continuous improvements to operational stability and service quality · DevOps, Automation & Infrastructure as Code · Design, implement, and maintain Infrastructure as Code (IaC) using Terraform · Build and maintain CI/CD pipelines (GitLab) · Deploy and manage Kubernetes-based platforms (EKS, GKE, OpenShift) · Automate provisioning, deployment, validation, and rollback processes · Review DevOps code to ensure quality, security, and consistency · Observability & AIOps Initiatives · Implement monitoring, logging, and alerting using Datadog · Leverage AIOps capabilities for anomaly detection and alert correlation · Support faster root-cause identification during incidents · Contribute to predictive analytics such as capacity forecasting and failure prevention · AI-Assisted Operations & Automation · Use AI-powered copilots for troubleshooting and diagnostics · Generate and improve operational documentation and runbooks using AI · Develop automated remediation and self-healing workflows · Integrate AI-assisted insights into operational workflows · Database & Platform Services (Supporting Role) · Support cloud databases: PostgreSQL, MySQL, MSSQL, MongoDB, Elastic · Contribute to upgrades, backups, HA/DR, and monitoring · Assist with data migrations where required · Ensure database security and performance · Collaboration, Documentation & Governance · Produce design documents, runbooks, and operational procedures · Collaborate with Automation Architects, SREs, and R&D teams · Improve scalability, reliability, security, and cost efficiency · Follow ITIL-aligned operational processes · Operate in regulated and security-sensitive environments Qualification: Minimum Requirements: Skills, Experience, Education, Technical/Specialized Knowledge, Certifications, Language5+ years operating cloud-based production systemsStrong Kubernetes orchestration experienceHands-on Terraform and Infrastructure as Code expertiseCI/CD pipeline experience (GitLab)AWS or GCP experienceScripting and automation (Python, YAML, JSON, Bash)Experience with observability toolsStrong Linux knowledge Preferred Qualifications: Experience with AIOps platforms or ML-assisted monitoringAI-assisted DevOps or Cloud Operations exposureIAM or regulated environment experienceITIL or COBIT familiarityExperience in globally distributed teams Education: Bachelor’s degree in Computer Science, Engineering, or equivalent experienceTools & TechnologiesCloud: AWS, GCPPlatforms: Kubernetes, Helm, OpenShiftIaC & Automation: Terraform, AnsibleCI/CD: GitLabObservability: DatadogCollaboration: Jira, Confluence, Slack, Office 365AI Tooling: AIOps platforms, internal AI copilots