Data Reliability Engineer

Emagine — Norway · Posted ~23 hours ago

Contract

Skills

Azure Cloud data platforms Data integration Data reliability Data platform modernization Scalable data systems Secure data systems Data analytics platforms You build it, you run it Microsoft Azure

🔓 Log in to save this job, tailor your resume & track your apply process — 7 days free, no card needed.

Log in to add to target list

Summary ✨ AI‑Generated

A consulting opportunity focused on ensuring the stability, security, and scalability of a modern cloud-based data and analytics platform. You will contribute to a major modernization program involving extensive integrations and datasets, while supporting production systems through a build-and-run ownership model.

Highlights

Work on a major multi-year cloud data modernization initiative involving a large-scale data platform, numerous integrations, and hundreds of datasets. The role emphasizes stability, security, scalability, and end-to-end ownership.

Description

Oppdragsbeskrivelse: Dagens dataplattformer skal moderniseres ved at det etableres en ny dataplattform i skyen (Azure) i perioden 2024 til 2028. Dagens løsninger skal bygges på nytt på ny dataplattform for å ikke ta med seg teknisk- og data-gjeld. Løsningen består av om lag 100 integrasjoner og 450 datasett som i dag benyttes til økonomiske modeller og analyser. Antall brukere er om lag 200. Moderniseringen er organisert som et prosjekt med en trinnvis implementering av virksomhetsprosesser. Prosjektet vil forvalte produksjonssatte løsninger i på ny dataplattform i prosjektperioden etter prinsippet «You build it, you run it». Dagens og ny dataplattform vil leve i parallell mens dagens plattform gradvis fases ut. Det vil være behov for integrasjoner mellom nye og eksisterende løsning i denne perioden. Til Ny data- og analyseplattform (NDP) har Norges Bank behov for bistand fra en konsulent i rollen som Data Reliability Engineer. Rollen skal bidra til å sikre stabil, sikker og skalerbar drift av plattformen gjennom teknisk arbeid med datainfrastruktur, produksjonssetting, automatisering, overvåking, feilhåndtering og datakvalitet. Rollen er operativ og teknisk. Du vil eierskap for tekniske prosesser samt arbeide hands-on med feilsøking, kode og automatisering, samtidig som du samarbeider tett med leveranseteam, plattformteam og Data Governance om drift og videreutvikling av plattformen. ANSVAR OG OPPGAVER Som Data Reliability Engineer vil du blant annet: Bidra til standardisering og beste praksis for utvikling, produksjonssetting, observability og drift av datapipelines på tvers av leveranseteamene.Utvikle og videreutvikle felles rammeverk, biblioteker, maler og verktøy som gjør det enklere for leveranseteamene å bygge robuste, skalerbare og forvaltbare dataløsninger. Eie og videreutvikle driftsprosessen for dataplattformen, inkludert ansvarsfordeling, hendelseshåndtering, eskalering og kontinuerlig forbedring.Etablere og videreutvikle overvåking, logging, metrics og alerting, slik at feil og avvik oppdages tidlig og kan håndteres effektivt.Definere, følge opp og forbedre sentrale mål for reliability og datakvalitet, som data freshness, completeness, correctness, tilgjengelighet, batchsuksessrate og MTTR.Automatisere operative oppgaver og utvikle løsninger som reduserer operasjonell risiko og behovet for manuell oppfølging.Utvikle robuste mekanismer for retry, restart, recovery og håndtering av avhengigheter og feil i datapipelines.Bidra til utvikling og forbedring av CI/CD, deployment og releaseprosesser for datapipelines og øvrige komponenter på dataplattformen.Oppdage og klassifisere produksjonshendelser, varsle riktig leveranseteam og eie koordineringen av hendelsesprosessen fra oppdagelse til avslutning.Lede postmortems og følge opp at læring og korrigerende tiltak omsettes i forbedringer av plattformen, felles rammeverk og arbeidsprosesser, slik at risikoen for tilsvarende hendelser reduseres.Analysere og forbedre ytelse, skalerbarhet, ressursbruk og kostnader i Databricks og Azure.Dokumentere felles rammeverk, tekniske avhengigheter, driftsrutiner, feilsøkingsprosedyrer og runbooks.Samarbeide tett med leveranseteam, plattformteam, Data Governance og andre fagmiljøer for å sikre robuste og forvaltbare løsninger. Kompetanser Erfaring med utvikling, videreutvikling og drift av dataplattformer, datapipelines eller datainfrastruktur som brukes i produksjon.God erfaring med Azure og Databricks, eller tilsvarende skybaserte data- og analyseplattformer.God forståelse av distribuerte databehandlingsprosesser, batch-prosessering, schedulering, avhengigheter og feilhåndtering.Praktisk erfaring med programmering og scripting, fortrinnsvis Python og SQL. Erfaring med gode prinsipper for strukturert kode og automatisert testing.Erfaring med overvåking og observability, eksempelvis Grafana, Azure Monitor, Prometheus eller tilsvarende.Erfaring med logging, metrics, alerting og praktisk feilsøking av produksjonsproblemer.Erfaring med CI/CD, automatiserte deployments og versjonskontroll.Erfaring med Infrastructure as Code og automatisering av infrastruktur og driftsoppgaver.God forståelse av prinsipper for robusthet, skalerbarhet, tilgjengelighet og operasjonell kvalitet i produksjonssystemer. Ønskelige kompetanser Erfaring med Azure-tjenester knyttet til dataplattformer, eksempelvis Azure Data Factory, Azure Storage, Azure SQL/PostgreSQL, Azure Monitor og Entra ID.Erfaring med Databricks Workflows/Jobs, Parquet, Delta Lake og Spark.Erfaring med Terraform eller tilsvarende Infrastructure as Code-verktøy.Erfaring med Azure DevOps, GitHub Actions eller tilsvarende verktøy for CI/CD og arbeidsflyt.Erfaring med etablering og oppfølging av SLI, SLO og SLA for produksjonstjenester.Kjennskap til Site Reliability Engineering/Data Reliability Engineering og prinsipper som automatisering, error budgets, toil reduction, observability og blameless postmortems.Erfaring fra regulerte eller samfunnskritiske miljøer, eksempelvis finans, forsikring eller offentlig sektor.Kjennskap til DORA, ITIL eller tilsvarende rammeverk for operasjonell styring og hendelseshåndtering.Erfaring med datakvalitet, validering og automatisert kontroll av data.Kjennskap til ServiceNow eller tilsvarende verktøy for incident- og change management.Erfaring med tidsserier, statistikk eller andre datatyper og analyseområder som er relevante for sentralbankvirksomhet. Utdanning Relevant høyere utdanning, fortrinnsvis mastergrad, innen datateknologi, informatikk, matematikk, statistikk eller tilsvarende. Relevant erfaring kan kompensere for formell utdanning. PERSONLIGE EGENSKAPER Lagspiller som samarbeider godt med utviklere, plattformressurser, data engineers og andre fagmiljøer.Løsningsorientert og analytisk, med evne til å identifisere årsaken til komplekse tekniske problemer.Strukturert og i stand til å prioritere og arbeide effektivt ved produksjonshendelser og tidssensitive leveranser.Tar eierskap til problemer og følger dem gjennom fra identifisering til varig løsning.God erfaring med tverrfaglig samarbeid på tvers av team, roller og fagområder.Bruker- og produktorientert, med forståelse for at stabilitet, datakvalitet og forutsigbarhet er sentrale deler av produktet. Gode kommunikasjonsferdigheter på norsk og engelsk, både muntlig og skriftlig. Omfang og varighet: Fra asap-31.12.26, Opsjon 6 måneder + 6 måneder + 6 måneder Arbeidssted: Oslo Intern søknadsfrist: 20.08