AWS Cloud & Site Reliability Engineer

Air Bank A S — Czechia · Posted ~3 hours ago

Mid Full-time

Skills

AWS cloud infrastructure site reliability engineering automation incident management Kubernetes

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

Join an SRE team responsible for building, operating, and continuously improving AWS cloud environments supporting services with demanding availability, security, and performance requirements. You will have broad ownership, solve operational challenges, and collaborate closely with other engineers while helping shape cloud architecture and reliability practices.

Highlights

Work on highly available and secure cloud infrastructure with significant influence over architecture, reliability, performance, and long-term cloud improvements.

Description

Když si klient Air Bank otevře aplikaci, očekává, že všechno bude fungovat. Rychle, bezpečně a bez výpadků. Právě o to se starají naše technologické týmy – a nyní hledáme nového kolegu nebo kolegyni do SRE týmu pro věrnostní program Unity. V roli Cloud AWS & SRE nám pomůže stavět, provozovat a dál rozvíjet cloudové prostředí pro služby s vysokými nároky na dostupnost, bezpečnost a výkon. Nemusíte být expert na úplně všechno. Důležité je, abyste měli pevný základ v AWS a zkušenosti alespoň s některými oblastmi, jako jsou Kubernetes, automatizace, observabilita, provozní spolehlivost nebo řešení incidentů. Hledáme člověka, který se dokáže samostatně rozhodovat, umí převzít odpovědnost a své řešení srozumitelně vysvětlit, těší se na spolupráci s ostatními a chce cloud prostředí dlouhodobě zlepšovat. AWS u nás není experiment ani vedlejší projekt. Je to strategické prostředí, které intenzivně rozvíjíme. Budete mít možnost ovlivnit nejen jednotlivé služby, ale také architekturu, automatizaci, provozní standardy a způsob, jakým cloud v rámci Air Bank a Unity používáme. Co vás u nás čeká? AWS infrastruktura a cloudové službyBudete navrhovat, konfigurovat a provozovat služby v AWS. Podle svých zkušeností se můžete věnovat například síťové infrastruktuře, IAM, compute službám, databázím, storage, integračním službám nebo návrhu vysoce dostupných řešení. Site Reliability EngineeringPomůžete nám nastavovat prostředí tak, aby bylo stabilní, měřitelné a dlouhodobě udržitelné. Budete pracovat s principy SLI, SLO a error budgetů a řešit kapacitu, výkon, dostupnost i odolnost vůči výpadkům. Amazon EKS a kontejnerové platformyČeká vás práce s Kubernetes v AWS, provoz a rozvoj EKS clusterů i podpora týmů při nasazování kontejnerizovaných aplikací. Budete řešit dostupnost, škálování, konektivitu, bezpečnost i efektivní využití prostředků. Infrastructure as Code a automatizaceCloudovou infrastrukturu chceme řídit jako kód. Budete vytvářet a rozvíjet automatizaci pomocí Terraform a dalších nástrojů, odstraňovat ruční kroky a pomáhat budovat opakovatelné a auditovatelné postupy. CI/CD a GitOpsBudete spolupracovat na bezpečném a automatizovaném doručování změn do cloudového prostředí. Pomůžete nám rozvíjet deployment pipelines, GitOps postupy, automatizované kontroly i řízení konfigurací. Observabilita a proaktivní dohledZapojíte se do rozvoje monitoringu, logování, trasování a alertingu. Cílem není mít co nejvíc alertů, ale správné informace ve správný čas – ideálně dříve, než problém zaznamenají naši klienti. Řešení incidentů a odstraňování jejich příčinKdyž nastane problém, budete ho řešit napříč aplikacemi, Kubernetes, sítí i AWS službami. Po obnovení provozu se zaměříte na skutečnou příčinu, automatizaci nápravy a prevenci opakování. Součástí role bude podle nastavení týmu také pohotovostní podpora kritických služeb. Bezpečnost a odolnost prostředíBudete spolupracovat na nastavení přístupů, síťové bezpečnosti, správy tajemství, šifrování, zálohování a disaster recovery. V bankovním prostředí potřebujeme, aby byly bezpečnost a dohledatelnost přirozenou součástí každého řešení. Spolupráce napříč Air Bank a UnityBudete v každodenním kontaktu s vývojáři, architekty, aplikační podporou, bezpečností, databázovými i infrastrukturními týmy. Pomůžete nám sjednocovat technické standardy, sdílet know-how a vytvářet cloudovou platformu, která týmům skutečně usnadní práci. Jak si vás představujeme? Máte praktické, alespoň 2-3 leté zkušenosti s provozem produkčních služeb a návrhem řešení a architektury v AWS.Umíte pracovat s Infrastructure as Code a automatizovat pomocí Terraform a Teragrunt (min. 2 roky praxe).Orientujete se alespoň v části služeb jako EKS, EC2, VPC, IAM, Route 53, Elastic Load Balancing, S3, RDS/Aurora nebo CloudWatch.Rozumíte Linuxu, sítím a provozu distribuovaných aplikací.Máte zkušenosti s Kubernetes a kontejnerizovanými aplikacemi.Rozumíte principům CI/CD a automatizovaného nasazování.Dokážete analyzovat problémy napříč více technologickými vrstvami a hledat jejich skutečnou příčinu.Přemýšlíte nad dostupností, škálováním, bezpečností, výkonem i náklady.Dokážete fungovat samostatně, ale zároveň sdílet informace a spolupracovat s týmem.V produkčním prostředí pracujete pečlivě – změny automatizujete, testujete, měříte a umíte je bezpečně vrátit.Aktivně využíváte AI nástroje při analýze problémů, automatizaci nebo každodenní technické práci.Domluvíte se česky a zvládnete technickou komunikaci v angličtině. Co oceníme jako výhodu navíc? Zkušenost s migracemi mezi cloudovými platformami, zejména mezi MS Azure a AWS.Návrh AWS prostředí pro větší organizace nebo regulované společnosti (banka, pojišťovna, fintech nebo jiné prostředí s vysokými nároky na dostupnost a bezpečnost).AWS Organizations, Control Tower nebo víceúčtová AWS architektura.GitOps a nástroje jako Argo CD nebo Flux.Prometheus, Grafana, Loki, OpenTelemetry nebo AWS observability služby.Správa identit, IAM, KMS, Secrets Manager a bezpečnostní služby AWS.Automatizované řešení incidentů a provozní runbooky.Disaster recovery, multi-region architektura a pravidelné testování obnovy.Relační i NoSQL databáze a řešení aplikační konektivity.Optimalizace výkonu a cloudových nákladů.Python, Bash, Go nebo jiný jazyk používaný pro automatizaci.