Google: Sådan sikrer vi høj oppetid på vores tjenester

Google henter meget høj oppetid ved at give team-folkene bag hver enkelt Google-tjeneste lov til, at tjenesterne går ned. Se her, hvordan det hænger sammen.

Artikel top billede

(Foto: Dan Jensen)

Oppetid er afgørende for et internet-selskab af Googles størrelse - ikke mindst når det gælder selskabets satsning rettet mod erhvervslivet og professionelle, cloud-baserede løsninger.

Google har gennem årene udviklet en særlig tilgang til oppetid, som Ben Treynor, der er udviklingschef og grundlægger af Googles såkaldte reliability-team, har stået i spidsen for.

Først og fremmest sigter Google ikke efter 100 procent oppetid, da det er et urealistisk mål at sætte sig, mener Ben Treynor.

Hvert Google-produkt har derfor fået fastlagt den maksimalt acceptable nedetid i de SLA'er, der hører til hvert produkt.

Med en maksimal acceptabel nedetid på for eksempel 0,01 procent (altså oppetid på 99,9 procent) kan en tjeneste 'lovligt' være nede i 43 minutter om måneden eller otte timer og 40 minutter om året.

Ben Treynor kalder denne tilladte nedetid for 'fejl-budgettet.'

Internt i Google-organisationen gælden den tommelfinger-regel, at de forskellige team-ledere og deres hold ikke behøver at være helt perfekte - sålænge de kan levere mindre nedetid end SLA'en for det produkt, som de passer, tilsiger.

Det betyder, at hvert produkt-team kan trække på deres eget 'fejl-budget,' som bare ikke må overskrides - og som helst skal være langt fra udfyldt.

Ben Treynor siger, at de traditionelle modeller for oppetid næsten altid er plaget af, at de såkaldte 'site reliability engineers' - altså driftsfolkene - ikke har samme tilgang til arbejdet som produkt-cheferne.

Produkt-cheferne vil nemlig altid gerne tilføre flere services og flere løsninger til produktet, mens drifts-folkene ikke bryder sig om forandringer, fordi alle forandringer - og ikke mindst nye løsninger - altid medfører nye problemer.

Ifølge Ben Treynor giver 'fejl-budgettet' i SLA'erne plads til, at produkt-cheferne og drifts-folkene kan mødes et sted på midten.

Er nødt til at fokusere på stabilitet

For produkt-folkene kan kun launche nye løsninger, hvis produktet lever op til oppetids-kravene i SLA'en. Er nedetiden større, end det maksimalt er tilladt i SLA'en, kan teamet ikke sætte nye løsninger og services i søen.

Ifølge Google ligger fidusen i, at produkt-folkene med denne regel er nødt til at fokusere på at udvikle pålidelige og stabile systemer, fordi de ellers får problemer med den videre udvikling.

Med plads til en smule nedetid får udviklerne til gengæld en smule spillerum, så udviklingen ikke bliver forkrampet og for langvarig, fordi ingen tør tage chancer.

Tilgangen ser faktisk ud til at virke. I hvert fald viser tal fra analysehuset CloudHarmony, at Googles cloud-platform er blandt de mest stabile af de store platforme.

I fjor var Google Cloud Platform således nede i alt 4,46 timer, mens Microsoft Azure til sammenligning var nede i 39,77 timer med i alt 92 nedbrud.

Amazon Web Services - der især er stor på det amerikanske marked - var kun nede i 2,41 timer hele sidste år.

Du kan se mere om de store cloud-tjenesters nedetid her: Opgørelse: Så ofte går dine cloud-løsninger i sort

Du kan se Ben Treynor fortælle om Googles tilgang til nedetid og oppetid her.

Læses lige nu

    Annonce

    Computerworld Events

    Vi samler hvert år mere end 6.000 deltagere på mere end 70 events for it-professionelle.

    Ekspertindsigt – Lyt til førende specialister og virksomheder, der deler viden om den nyeste teknologi og de bedste løsninger.
    Netværk – Mød beslutningstagere, kolleger og samarbejdspartnere på tværs af brancher.
    Praktisk viden – Få konkrete cases, værktøjer og inspiration, som du kan tage direkte med hjem i organisationen.
    Aktuelle tendenser – Bliv opdateret på de vigtigste dagsordener inden for cloud, sikkerhed, data, AI og digital forretning.

    Digital transformation | Frederiksberg

    Roundtable: AI i drift – fra eksperimenter til ansvar, værdi og kontrol

    AI-initiativerne breder sig hurtigt, men skaleringen halter. Kun hver fjerde virksomhed har flyttet en større del af sine AI-eksperimenter i produktion. Computerworld samler en udvalgt kreds af CIO’er og digitale beslutningstagere til et...

    Sikkerhed | Online

    Det du glemmer i Azure - men aldrig on-prem: Sådan genfinder du kontrollen

    Undgå dyre fejl i Azure. Få styr på udfasede services, skjulte omkostninger og governance. Lær, hvordan Reserved Instances, Azure Hybrid Benefit og de rette styringsmekanismer giver mere værdi, lavere omkostninger og en mere robust Azure-platform....

    Se alle vores events inden for it

    Navnenyt fra it-Danmark

    Netip A/S har pr. 1. juli 2026 ansat Jacob Holm Jensen som Supportkonsulent ved netIP's kontor i Thisted. Han kommer fra en stilling som IT Supporter hos Revisionsselskabet RSM. Han er uddannet Datatekniker hos netIP - Jacob vender dermed hjem igen. Nyt job

    Jacob Holm Jensen

    Netip A/S

    Fellowmind Denmark A/S har pr. 1. september 2026 ansat Morten Jakobi som Business Unit Director. Han skal især beskæftige sig med at samle og udvikle Fellowminds forretning inden for Managed Services, Cloud Infrastructure & Security. Han kommer fra en stilling som Chief Executive Officer hos Inventio.it A/S. Han har tidligere beskæftiget sig med Ledelse og udvikling af Managed Services, serviceforretninger og transformation i Norden og Benelux. Nyt job

    Morten Jakobi

    Fellowmind Denmark A/S

    Norriq Danmark A/S har pr. 2. marts 2026 ansat Sarah Strøyer Hove som Consultant ERP. Hun skal især beskæftige sig med de nyeste teknologiske muligheder sammen med forretningsprocesserne. Hun kommer fra en stilling som Business Controller hos NGI A/S. Hun er uddannet hos Professionshøjskolen UCN som markedsføringsøkonom og International Handel og Markedsføring. Hun har tidligere beskæftiget sig med lager og logistik. Nyt job

    Sarah Strøyer Hove

    Norriq Danmark A/S

    Norriq Danmark A/S har pr. 3. august 2026 ansat Jeppe Lindberg som Developer. Han skal især beskæftige sig med at være med til at analysere, designe og udvikle skræddersyede forretningsløsninger til vores kunder i Business Central. Han kommer fra en stilling som Business Central Developer hos Evexo. Han er uddannet hos Aalborg Universitet- Master's degree, Computer Software Engineering. Nyt job

    Jeppe Lindberg

    Norriq Danmark A/S