IT-seisokin hinta näkyy harvoin yhdellä rivillä. Se jakautuu pysähtyneeseen tuotantoon, odottaviin työntekijöihin, myöhästyneisiin toimituksiin ja palautumistyöhön, joka jatkuu vielä pitkään sen jälkeen, kun järjestelmä on taas käynnissä. Kun hinta lasketaan auki, on helpompi päättää, mihin korkea käytettävyys kannattaa.
Lyhyesti
IT-seisokin kustannus muodostuu neljästä osasta. Korkea käytettävyys kannattaa niissä järjestelmissä, joissa seisokkien vuosikustannus ylittää varautumisen hinnan.
- Menetetty tuotanto tai myynti, jota ei saada kiinni.
- Työaika, joka kuluu odottamiseen ja uudelleen tekemiseen.
- Palautumistyö, ylityöt, hävikki ja mahdolliset sopimussakot.
- Epäsuorat seuraukset, kuten myöhästyneet toimitukset, menetetty tieto ja heikentynyt asiakasluottamus.
- Hyväksyttävä riskitaso määritellään järjestelmä kerrallaan.
Moni johtoryhmä tietää, mitä IT-infra maksaa vuodessa. Harvempi tietää, mitä tunnin katko tuotantojärjestelmässä maksaa. Ilman sitä lukua investoinnit toimintavarmuuteen näyttävät pelkiltä kuluilta, ja päätös tehdään usein vasta ensimmäisen ison häiriön jälkeen.
Tässä kirjoituksessa käymme läpi, mistä seisokin hinta muodostuu, miten sen voi laskea omalle yritykselle ja miten hyväksyttävä riskitaso määritellään niin, että korkea käytettävyys kohdistuu oikeisiin järjestelmiin.
Mistä IT-seisokin suorat kustannukset muodostuvat?
IT-seisokin suorat kustannukset ovat menetetty kate, joutokäynnillä oleva työaika, palautumiseen kuluva työ ja sopimuksiin perustuvat korvaukset. Ne näkyvät kirjanpidossa, mutta harvoin samalla rivillä. Siksi niiden summa yllättää.
- Menetetty tuotanto ja myynti. Jos tuotanto tai tilausten käsittely pysähtyy eikä menetettyä aikaa saada kiinni, katetta menetetään jokaiselta katkotunnilta.
- Joutokäynti. Palkat juoksevat, vaikka järjestelmä ei toimi. Tuotannossa sama koskee koneita ja linjoja.
- Menetetyn ajan kiinniotto. Kun pysähdys otetaan kiinni, se maksaa ylityökorvauksina, lisävuoroina ja kiirekuljetuksina.
- Palautumistyö. Vian selvitys, korjaus, tietojen palautus ja tarkistukset vievät oman IT-tiimin ja kumppanien aikaa.
- Hävikki ja ylösajo. Prosessiteollisuudessa kesken jäänyt erä voi mennä hukkaan, ja linjan uudelleenkäynnistys vie aikaa vielä järjestelmän palauduttua.
- Sopimussakot. Toimitusviiveet voivat laukaista asiakassopimusten viivästyssakot tai palvelutasokorvaukset.
Tuotannon pysähtyminen on näistä yleensä suurin erä. Teollisuudessa IT-katko pysäyttää harvoin pelkän IT:n. Kun tuotannonohjaus, toiminnanohjausjärjestelmä tai etätyöpöytäympäristö on poissa käytöstä, työ pysähtyy myös tehtaan lattialla, varastossa ja asiakaspalvelussa.
Mitkä seisokin kustannukset jäävät helposti laskematta?
Epäsuorat kustannukset syntyvät katkon jälkeen. Niitä ovat myöhästyneet toimitukset, heikentynyt asiakasluottamus, johdon ja asiantuntijoiden aika sekä menetetty tieto. Ne ovat vaikeampia laskea, mutta usein juuri ne ratkaisevat, kuinka kalliiksi katko lopulta tulee.
- Toimitusketju. Myöhästynyt toimitus siirtää ongelman asiakkaalle, jonka oma tuotanto voi odottaa teidän osianne.
- Luottamus. Toistuvat katkot heikentävät mainetta toimitusvarmana kumppanina, ja ostajat arvioivat juuri sitä kilpailutuksissa.
- Johdon aika. Häiriön selvittäminen, asiakkaille tiedottaminen ja jälkipuinti vievät aikaa, joka oli varattu kehitykselle.
- Tiedon menetys. Kun tietoja palautetaan varmuuskopiosta, edellisen varmistuksen jälkeen tehty työ on tehtävä uudelleen tai se menetetään.
Kansainväliset selvitykset antavat suuruusluokan. Splunkin ja Oxford Economicsin vuonna 2024 julkaiseman selvityksen mukaan seisokit maksavat maailman 2 000 suurimmalle pörssiyhtiölle noin 400 miljardia dollaria vuodessa, mikä vastaa 9 prosenttia niiden voitoista. Suurin yksittäinen erä on menetetty liikevaihto. Uptime Instituten vuoden 2025 katkosanalyysissä 54 prosenttia vastaajista arvioi viimeisimmän merkittävän katkonsa maksaneen yli 100 000 dollaria ja 20 prosenttia yli miljoona dollaria.
Suomalaisen keskisuuren yrityksen euromäärät ovat pienempiä, mutta logiikka on sama. Seisokin hinta kasvaa sitä mukaa, mitä tiiviimmin IT on kytketty tuotantoon ja toimitusketjuun.
Miten palautumisaika ja tiedon menetys vaikuttavat hintaan?
Seisokin hinta riippuu kahdesta luvusta. Palautumisaika kertoo, kuinka kauan liiketoiminta on pysähdyksissä. Tiedon menetys kertoo, kuinka paljon jo tehtyä työtä katoaa. Näille asetetaan tavoitteet, joita kutsutaan nimillä RTO (Recovery Time Objective) ja RPO (Recovery Point Objective).
Palautumisaika on yleensä pidempi kuin itse vika. Järjestelmä voi olla teknisesti kunnossa tunnissa, mutta tietojen tarkistus, integraatioiden uudelleenkäynnistys ja tuotannon ylösajo jatkuvat sen jälkeen. Mittaa siksi palautumisaika siitä hetkestä, kun työ pysähtyy, siihen hetkeen, kun työ jatkuu normaalisti.
Tiedon menetyksen hinta lasketaan työtunteina. Jos tilausjärjestelmä varmistetaan kerran yössä ja vika tulee iltapäivällä, koko päivän tilaukset, kirjaukset ja muutokset on syötettävä uudelleen, jos ne ylipäätään saadaan selville. RTO- ja RPO-tavoitteiden määrittelystä kerromme tarkemmin oppaassa IT-infran toimintavarmuudesta, ja palautusten toteutus on osa Soforin datan varmistuspalveluita.
Miten IT-seisokin kustannus lasketaan omalle yritykselle?
IT-seisokin kustannus lasketaan järjestelmä kerrallaan. Selvitä, mitä yksi katkotunti maksaa, kerro se katkon kestolla ja lisää kertaluonteiset kulut. Laskelmaan riittää neljä lukua.
Laskentamalli
Seisokin kustannus = (menetetty kate tunnissa + joutokäynnin palkkakustannus tunnissa) × katkon kesto + palautumistyö + hävikki ja jälkiseuraukset
Alla olevan esimerkin yritys ja luvut ovat oletuksia, jotka voit korvata omillanne. Teollisuusyrityksen liikevaihto on 50 miljoonaa euroa, ja tuotantoa on noin 5 000 tuntia vuodessa. Toiminnanohjausjärjestelmä on poissa käytöstä neljä tuntia kesken arkipäivän.
| Kustannuserä | Neljän tunnin katko |
|---|---|
| Menetetty kate10 000 euroa liikevaihtoa tunnissa, kate 30 prosenttia | 12 000 € |
| Joutokäynti80 henkilöä, 45 euroa tunnissa sivukuluineen | 14 400 € |
| Palautumistyö3 asiantuntijaa, 8 tuntia, 100 euroa tunnissa | 2 400 € |
| Hävikki ja ylösajoHylätty erä ja linjan uudelleenkäynnistys | 5 000 € |
| Yhteensä ennen epäsuoria kustannuksia | 33 800 € |
Laskelmaan liittyy kaksi tarkennusta. Ensinnäkin, jos pysähdys saadaan kiinni ylitöillä, korvaa menetetty kate ylityön kustannuksella, jotta samaa euroa ei lasketa kahteen kertaan. Toiseksi ajankohta ratkaisee. Jos katko osuu kuunvaihteen laskutukseen tai kiireelliseen toimitukseen, samat neljä tuntia voivat maksaa moninkertaisesti.
Laskelman tärkein hyöty on yhteinen luku. Kun talousjohto, tuotanto ja IT katsovat samaa tuntihintaa, keskustelu varautumisesta muuttuu riskienhallinnaksi.
Mitä korkea käytettävyys tarkoittaa käytännössä?
Korkea käytettävyys tarkoittaa, että järjestelmä toimii myös silloin, kun yksittäinen palvelin, levy, verkkoyhteys tai sähkönsyöttö pettää. Se toteutetaan kahdennetuilla komponenteilla, palvelinklustereilla, jotka siirtävät kuorman automaattisesti toimivalle laitteelle, sekä jatkuvalla valvonnalla.
Käytettävyys ilmoitetaan prosentteina vuoden tai kuukauden ajasta. Prosenttien erot näyttävät pieniltä, mutta tunneiksi muutettuina ne ovat suuria.
| Käytettävyys | Katkoa vuodessa | Katkoa kuukaudessa |
|---|---|---|
| 99 % | 87 h 36 min | 7 h 18 min |
| 99,5 % | 43 h 48 min | 3 h 39 min |
| 99,9 % | 8 h 46 min | 44 min |
| 99,95 % | 4 h 23 min | 22 min |
| 99,99 % | 53 min | 4 min |
Palvelutason prosentti koskee yleensä yhtä palvelua tai komponenttia. Käyttäjä tarvitsee koko ketjun. Jos tuotannonohjaus tarvitsee toimiakseen palvelimen, tietokannan ja verkkoyhteyden ja kunkin käytettävyys on 99,9 prosenttia, koko ketjun käytettävyys on noin 99,7 prosenttia. Yhden osan 8 h 46 min kasvaa ketjussa noin 26 tuntiin vuodessa.
Tarkista myös, lasketaanko suunnitellut huoltokatkot mukaan palvelutasoon. Moni sopimus rajaa ne ulkopuolelle, vaikka tuotannon näkökulmasta pysähdys on sama. Korkean käytettävyyden ympäristössä päivitykset voidaan tehdä solmu kerrallaan ilman käyttökatkoa.
Miten hyväksyttävä riskitaso määritellään?
Hyväksyttävä riskitaso määritellään vertaamalla seisokkien odotettua vuosikustannusta siihen, mitä varautuminen maksaa. Korkea käytettävyys kannattaa siellä, missä katkojen vähenemisellä säästetty summa on suurempi kuin ratkaisun investointi ja ylläpito.
Käytännössä määrittely etenee neljässä vaiheessa.
- Luokittele järjestelmät. Erota tuotantokriittiset järjestelmät liiketoimintakriittisistä ja tukevista. Kaikki eivät tarvitse samaa tasoa.
- Laske tuntihinta kriittisimmille. Käytä yllä olevaa mallia ja pyydä luvut talouden ja tuotannon omistajilta.
- Selvitä nykytila. Kuinka monta tuntia katkoja järjestelmässä oli viime vuonna, ja kuinka kauan palautuminen oikeasti kesti.
- Päätä tavoite ja hinta. Määritä käytettävyys-, RTO- ja RPO-tavoite ja vertaa varautumisen vuosikustannusta seisokeista säästettyyn summaan.
Esimerkkiyrityksessä toiminnanohjausjärjestelmän katkot ovat kestäneet yhteensä 20 tuntia vuodessa. Jos korkean käytettävyyden ratkaisu ja parempi valvonta lyhentävät ne viiteen tuntiin, säästö on 15 tuntia kertaa 8 450 euroa eli noin 127 000 euroa vuodessa. Tätä summaa verrataan ratkaisun vuosikustannukseen.
Sama laskelma toimii myös toiseen suuntaan. Tukijärjestelmälle, jonka katkotunti maksaa muutaman sadan euron, riittää toimiva varmistus ja sovittu palautumisaika. Toimintavarmuus syntyy siitä, että varautuminen mitoitetaan liiketoiminnan todellisen riskin mukaan.
Millä keinoilla IT-seisokit lyhenevät?
IT-seisokit lyhenevät, kun yksittäiset vikapisteet poistetaan, ympäristöä valvotaan ympäri vuorokauden, muutokset tehdään hallitusti ja palautuminen on testattu. Tekniikka on näistä vain yksi osa.
Uptime Instituten vuoden 2025 analyysin mukaan lähes 40 prosenttia organisaatioista on kärsinyt kolmen viime vuoden aikana merkittävästä ihmisen virheestä johtuneesta katkosta. Näistä 85 prosenttia johtui siitä, että menettelyjä ei noudatettu tai menettelyissä itsessään oli puutteita. Toimintamallit, dokumentaatio ja vastuunjako ovat siksi yhtä tärkeitä kuin kahdennetut laitteet.
- Kahdennus ja klusterointi. Kriittiset palvelimet, tallennus ja yhteydet kahdennetaan, jotta yksittäinen vika ei pysäytä palvelua. Korkean käytettävyyden palvelinklusterit ovat osa Soforin palvelinhallintaa.
- Valvonta ympäri vuorokauden. Kapasiteetin ja poikkeamien seuranta paljastaa ongelmat ennen kuin käyttäjä huomaa ne.
- Hallitut päivitykset. Huoltoikkunat, testaus ja paluusuunnitelma estävät päivityksiä muuttumasta katkoiksi.
- Testattu palautuminen. Varmuuskopio on arvokas vasta, kun palautus on kokeiltu ja sen kesto tiedetään.
- Selkeä vastuunjako. Kun omistajat ja eskalaatiot on sovittu etukäteen, häiriössä päästään heti korjaamaan vikaa.
- Elinkaaren hallinta. Laitteet ja alustat uusitaan ennen kuin niiden ikä alkaa näkyä katkoina.
”Näen uudistuksen suurimpana hyötynä kustannussäästöt. Niitä on saavutettu sekä suorissa IT-kustannuksissa että välillisesti IT-lähtöisten tuotantokatkosten lyhentymisenä.”
Valmetilla laitteistot lähestyivät käyttöikänsä loppua, ja Sofor toteutti suunnittelutyökuormille ja Citrix-työpöydille Nutanixin hyperkonvergoidun infrastruktuurin. Valmet lisää nyt kapasiteettia häiriöittä. Lue lisää Valmetin vikasietoisesta suunnittelualustasta.
Yhdessä nämä osa-alueet muodostavat toimintavarman IT-infran. Soforilla sama nimetty tiimi suunnittelee, rakentaa ja ylläpitää ympäristön Define Build Maintain -mallin mukaan, joten ylläpidossa havaitut riskit palaavat suunnitteluun ennen kuin niistä tulee katkoja.
Kuusi kysymystä seuraavaan johtoryhmän kokoukseen
Näillä kysymyksillä näet, onko hyväksyttävä riskitaso teillä jo määritelty.
- Mitkä kolme järjestelmää pysäyttävät tuotantomme tai toimituksemme, jos ne ovat poissa käytöstä?
- Mitä tunnin katko kussakin niistä maksaa?
- Kuinka monta tuntia katkoja niissä oli viimeisen vuoden aikana?
- Kuinka kauan palautuminen kestää, ja milloin se on viimeksi testattu?
- Kuinka paljon tietoa voimme menettää, ja kuka on hyväksynyt sen?
- Kuka vastaa häiriöstä yöllä ja viikonloppuna?
Jos vastaukset löytyvät helposti, riskitaso on määritelty. Jos ne vaativat selvitystä, aloita ensimmäisestä kysymyksestä.
Usein kysytyt kysymykset korkeasta käytettävyydestä ja seisokeista
Mitä korkea käytettävyys tarkoittaa?
Korkea käytettävyys tarkoittaa, että järjestelmä toimii myös yksittäisen laitteen tai yhteyden vikaantuessa. Se toteutetaan kahdennetuilla komponenteilla, palvelinklustereilla ja jatkuvalla valvonnalla. Tavoite ilmoitetaan prosentteina. Esimerkiksi 99,9 prosentin käytettävyys sallii enintään noin 8 tuntia 46 minuuttia katkoa vuodessa.
Paljonko tunnin IT-seisokki maksaa?
Se riippuu siitä, kuinka tiiviisti järjestelmä on kytketty tuotantoon ja myyntiin. Laske tunnilta menetetty kate ja joutokäynnin palkkakustannus ja lisää palautumistyö, hävikki ja jälkiseuraukset. Uptime Instituten vuoden 2025 katkosanalyysissä 54 prosenttia vastaajista arvioi viimeisimmän merkittävän katkonsa maksaneen yli 100 000 dollaria.
Mitä eroa on korkealla käytettävyydellä ja varmuuskopioinnilla?
Korkea käytettävyys estää katkon tai lyhentää sitä, kun yksittäinen osa vikaantuu. Varmuuskopiointi suojaa tietoa ja mahdollistaa palautuksen, kun tieto on vahingoittunut tai kadonnut, esimerkiksi haittaohjelman tai ihmisen virheen jälkeen. Toimintavarma ympäristö tarvitsee molemmat.
Mitä eroa on RTO:lla ja RPO:lla?
RTO (Recovery Time Objective) kertoo, kuinka pitkän katkon liiketoiminta voi hyväksyä. RPO (Recovery Point Objective) kertoo, kuinka paljon tietoa voidaan enintään menettää. Molemmat määritellään järjestelmäkohtaisesti, ja ne ratkaisevat, millaista varmistusta ja käytettävyyttä järjestelmä tarvitsee.
Tarvitaanko kaikkiin järjestelmiin korkeaa käytettävyyttä?
Ei tarvita. Korkea käytettävyys kannattaa järjestelmissä, joiden katkotunti maksaa enemmän kuin varautuminen. Tukijärjestelmille riittää usein toimiva varmistus ja sovittu palautumisaika. Luokittele järjestelmät kriittisyyden mukaan ja mitoita taso kullekin erikseen.
Vastaa