Under motorhjelmen: Sådan sikrer Netflix sig mod nedbrud

Netflix er blandt verdens største cloud-kunder. Se her, hvordan selskabet har opbygget sin cloud-service, så du undgår at blive ramt af fejl og nedbrud.

Artikel top billede

Netflix har med sine 38 millioner kapacitets-krævende kunder fordelt på 40 lande katapulteret sig op i superligaen af verdens største og mest krævende cloud-kunder

Selskabet streamer flere hundrede millioner timers indhold hver eneste måned, og det er noget, der stiller krav til leverandørernes muskler.

Lad os tage et kig på nogle af denne gigantiske cloud-forbrugers erfaringer, som vi (måske) kan lære noget af.

Erfaringerne stammer fra selskabets cloud-direktør Ariel Tseitlin, der for nylig talte med Computerworlds amerikanske nyhedsbureau.

Selskabets kunde-rettede tjenester - blandt andet en stor database, der på baggrund af den enkelte brugers seer-vaner kommer med udvalgte anbefalinger - kører på Amazons store public-cloud tjeneste, Amazon Web Service.

Netflix' indholdsplatform hedder Open Connect, som selskabet driver sammen med lokale ISP'ere.

Mikro-tjenester

En af Netflix' erklærede mål er at bygge et system, hvor effekten af nedetid eller service-nedbrud i cloud'en har mindst mulig effekt for det mindst mulige antal brugere - mindst mulig 'blast radius,' som Netflix selv betegner det.

Løsningen: Enkle og simple backup-løsninger, der minimerer abstraktions-nivauet.

Eksempel: Crasher databasen, der præsenterer forslag til den enkelte bruger på baggrund af historik, vil Netflix præsentere en generisk liste med nogle af de mest populære titler, der ikke er personlige.

På den måde minimeres system-belastningen ved et crash, hvorved andre systemer ikke overbelastes.

Skalering - masser af redundans

Suget på Netflix' varierer, og det er derfor vigtigt for selskabet at kunne skalere i en fart, så der hele tiden er kapacitet nok til alle kunder, der logger på tjenesten.

Netflix' løsning er at anvende forskellige systemer.

Hver tjeneste bliver således udsendt til mindst tre såkaldte 'Availability Zones,' der er isolerede lokationer i Amazons cloud-løsning.

Open source-systemer får det hele til at crashe

Hver af de tre 'Availability Zones' kan skalere individuelt.

Det betyder blandt andet, at Netflix kan lede trafikken over på en sund AZ'er, hvis en af dem går ned.

Hertil kommer, at hele Netflix-tjenesten er spejlet i to gigantiske regioner i Amazon-clouden - nemlig US East og EU West, der replikerer asynkront.

Det betyder, at den ene af de to regioner kan tage over, hvis den anden fejler, så tjenesten hele tiden vil være tilgængelig.

Vær modstandsdygtig

Netflix er plastret til med monitoreringsløsninger og alert-løsninger, der melder, når der opstår fejl.

Selskabet har selv udviklet en ny platform til monitorering af selskabets tjenester og til at løse de fejl, der finder sted.

Værktøjskassen hedder 'The Simian Army' og består af en serie open source-baserede værktøjer, som anvendes til løbende test af systemerne.

Blandt dem finder vi værktøjer med navne som Chaos Monkey, der løbende nedlukker tilfældige tjenester for at teste, om backup-systemerne i applikations-laget nu også virker.

Hertil kommer værktøjet Chaos Gorilla, der sporadisk kan finde på at lukke en helt 'Availability Zone' ned for på samme måde at se, om nødsystemerne virker.

Selskabet arbejder for tiden på at udvikle værktøjet Chaos Kong, som på samme måde skal kunne lukke en hel region ned.

Cloud-chef Ariel Tseitlin siger til Computerworlds amerikanske nyhedsbureau, at selskabet går så meget op i monitorering og test, at den interne snak ofte går på, at Netflix egentlig er et monitorerings-selskab, der af og til leverer film til brugerne.

Netflix forventer inden for de kommende år også at flytte alle selskabets in-house back-end tjenester over i cloud'en. Målet er slet ikke at køre egne datacentre overhovedet.

Selskabet har allerede flyttet fra Exchange til Google Apps.

Blandt de kommende udfordringer er arbejdet med at flytte betalingsløsningerne ud i skyen.

Læs også: Sådan får du adgang til den amerikanske udgave af Netflix

Læses lige nu
    Computerworld Events

    Vi samler hvert år mere end 6.000 deltagere på mere end 70 events for it-professionelle.

    Ekspertindsigt – Lyt til førende specialister og virksomheder, der deler viden om den nyeste teknologi og de bedste løsninger.
    Netværk – Mød beslutningstagere, kolleger og samarbejdspartnere på tværs af brancher.
    Praktisk viden – Få konkrete cases, værktøjer og inspiration, som du kan tage direkte med hjem i organisationen.
    Aktuelle tendenser – Bliv opdateret på de vigtigste dagsordener inden for cloud, sikkerhed, data, AI og digital forretning.

    Sikkerhed | Højbjerg, Aarhus

    Cyber Security Summit 2026 - Aarhus

    Lær om organisationers evne til at modstå, håndtere og komme videre efter alvorlige digitale hændelser, herunder ledelsesansvar, forretningskritiske afhængigheder og de valg, der afgør, om plan B holder, når systemer eller leverandører svigter.

    Digital transformation | Aarhus

    AI i det offentlige - Aarhus

    Hør hvordan offentlige AI-løsninger skaleres til stabil drift med reel effekt. Få erfaringer, arkitekturvalg og styringsgreb fra frontløbere. Lær at bygge fælles AI-infrastruktur med ansvarlighed, sikkerhed og compliance.

    Digital transformation | Køge

    Derfor skal du videre fra Dynamics AX – og sådan gør du

    Computerworld giver klar viden om vejen videre fra Dynamics AX. Du ser forskellen mellem AX og moderne cloud-ERP og får et konkret beslutningsgrundlag for næste skridt. Tilmeld dig og få styr på skiftet til Dynamics 365 FO eller BC.

    Se alle vores events inden for it

    Forsvarets Efterretningstjeneste

    IT-direktør til Forsvarets Efterretningstjeneste

    Københavnsområdet

    Politiets Efterretningstjeneste

    Empatisk sektionsleder til PET's digitale indhentning

    Københavnsområdet

    Capgemini Danmark A/S

    AI Data Architect

    Københavnsområdet

    AP Pension

    AP Pension søger erfaren Product Owner

    Københavnsområdet

    Navnenyt fra it-Danmark

    Lector ApS har pr. 9. juli 2026 ansat Simeon Dimitrov som IT-konsulent i Lectors TeamShare-gruppe. Han skal især beskæftige sig med cloud og infrastruktur samt design og optimering af Lectors infrastruktur og løsninger. Han kommer fra en stilling som DevOps Engineer hos Kraftvaerk. Han har tidligere beskæftiget sig med Azure og onprem infrastruktur, automatisering, implementering og optimering af cloudløsninger. Nyt job

    Simeon Dimitrov

    Lector ApS

    Immeo har pr. 1. maj 2026 ansat Sofie Amalie Buur som Consultant. Hun kommer fra en stilling som Frontend Engineer & UI/UX Designer hos Valyrion. Hun er uddannet Cand.it. Softwaredesign ved ITU. Nyt job
    IFS Danmark A/S har pr. 1. juni 2026 ansat Lasse Hounsgaard som AI Account Executive. Lasse skal især beskæftige sig med udrulning af IFS.ai Logistics i Norden. Lasse kommer fra en stilling som Manufacturing Account Executive hos Autodesk ApS. Lasse er uddannet cand.merc. i International Virksomhedsøkonomi. Lasse har tidligere beskæftiget sig med digitalisering af danske og nordiske virksomheder. Nyt job

    Lasse Hounsgaard

    IFS Danmark A/S

    IFS Danmark A/S har pr. 2. marts 2026 ansat Marlene Gudman som HR Business Partner. Hun skal især beskæftige sig med HR i Danmark og Norden og lede udvalgte internationale HR-projekter. Hun kommer fra en stilling som Nordic Lead HR Business Partner hos Salesforce. Hun har tidligere beskæftiget sig med international HR med fokus på udvikling af og udfordringer i HR ud fra et forretningsperspektiv. Nyt job

    Marlene Gudman

    IFS Danmark A/S