Skip to main content

Niet-technische mensen horen misschien “uitvaltijd” en denken weemoedig aan een vakantie. Maar voor technologieprofessionals is uitvaltijd een vies woord – en terecht. Netwerkuitval betekent een slechte dag op kantoor.

Netwerkuitval betekent ontevreden klanten, kelderende productiviteit en andere problemen. Wanneer je het hebt over klantgerichte apps zoals een website, is uitvaltijd duur: uitvaltijd kost grotere bedrijven ongeveer $9,000 per minuut.

En hoewel uitvaltijd een negatieve impact kan hebben op bedrijven van alle soorten en groottes, is het in bepaalde sectoren bijzonder problematisch. Een detailhandelsbedrijf kan $1.1 miljoen per uur uitvaltijd verliezen.

Want more from The CTO Club?

Create a free account to finish this piece and join a community of CTOs and engineering leaders sharing real-world frameworks, tools, and insights for designing, deploying, and scaling AI-driven technology.

Name*
This field is hidden when viewing the form
This field is hidden when viewing the form
This field is hidden when viewing the form
This field is hidden when viewing the form
By submitting you agree to receive occasional emails and acknowledge our Privacy Policy. You can unsubscribe at anytime.

TL;DR: Uitvaltijd is slecht.

Het verminderen en voorkomen van uitvaltijd is daarentegen goed. Het is zelfs noodzakelijk – want zelfs kleine hoeveelheden netwerkuitval kunnen het bedrijfsresultaat schaden en bijkomende schade veroorzaken, zoals reputatieschade.

In dit artikel definiëren we het probleem en wat nodig is om het op te lossen – waaronder een raamwerk in 13 stappen voor het ontwikkelen van je eigen plan om netwerkuitval te verminderen. Om te beginnen helpt het om uit te gaan van een eenvoudige definitie.

Wat is netwerkuitval?

Netwerkuitval verwijst naar het gedeeltelijk of volledig niet beschikbaar zijn van een IT-netwerk, waardoor zaken als een website of interne applicaties zoals een ERP-systeem gedurende enige tijd ontoegankelijk worden.

Uitvaltijd kan over het algemeen worden onderverdeeld in twee grote categorieën: gepland en ongepland. Geplande uitvaltijd is precies dat: het is opzettelijk en ingepland, meestal voor zaken als routineonderhoud, systeemupdates of een applicatiemigratie.

Wanneer we zeggen dat netwerkuitval slecht is, bedoelen we eigenlijk ongeplande netwerkuitval – dit is wanneer het netwerk onverwacht uitvalt om allerlei mogelijke redenen. Er kunnen allerlei oorzaken voor uitvaltijd zijn, van infrastructuurproblemen en softwarefouten tot menselijke fouten en cyberaanvallen.

Wat – en wie – is nodig om netwerkuitval tot een minimum te beperken?

Gezien de kwantitatieve en kwalitatieve kosten is het de moeite waard om zelfs infrequente netwerkuitval aan te pakken. En als de frequentie begint te verschuiven van infrequent naar frequent, is het tijd om dat probleem met grotere urgentie op te lossen.

mensen, processen, documentatie, & hulpmiddelen om netwerkuitval tot een minimum te beperken

Er is een mix van mensen, processen, documentatie en hulpmiddelen die je eerst moet organiseren, zegt Viacheslav Petrenko, technologiedirecteur bij het softwareontwikkelingsbedrijf LITSLINK.

Petrenko deelde zijn advies over de belangrijkste onderdelen die je op orde moet brengen voordat je aan een nieuw initiatief begint om netwerkuitval te verminderen. Deze kunnen zowel toekomstgericht als historisch zijn. Ze omvatten:

Documentatie

Petrenko adviseert om netwerkdiagrammen, incidentrapporten, servicelevelovereenkomsten (SLAs) en logboeken voor wijzigingsbeheer te verzamelen als fundamentele documentatie. 

Ook andere relevante documentatie die specifiek is voor de organisatie of het netwerk is het waard om bij de hand te houden. 

Processen

Er zijn verschillende processen die experts aanbevelen om te analyseren – of te implementeren als ze momenteel nog niet bestaan – als onderdeel van een initiatief voor netwerkbeschikbaarheid. Deze omvatten:

Protocol voor hoofdoorzaakanalyse (RCA): Dit is een fundamenteel proces voor het verminderen van netwerkuitval, omdat het uiteindelijke doel ervan is om de specifieke oorzaak of oorzaken van het probleem vast te stellen. Hoofdoorzaakanalyse “zorgt voor grondig onderzoek van elk uitvalincident om herhaling te voorkomen”, zegt Petrenko.

Gerelateerd artikel: 5 hulpmiddelen voor hoofdoorzaakanalyse voor beter testen & QA

Proces voor wijzigingsbeheer: Beperkt risico's door alle netwerkwijzigingen zorgvuldig te beheren en te documenteren. Let op: grondigheid moet worden afgewogen tegen flexibiliteit om knelpunten te voorkomen.

Plannen voor herstel na rampen en bedrijfscontinuïteit: Alle inspanningen om netwerkuitval te verminderen moeten worden geïnformeerd door – en omgekeerd – de bredere plannen van de organisatie voor veerkracht bij grote operationele verstoringen.

Gerelateerd artikel: De 25 beste diensten voor herstel na rampen ontcijferd

Onderhoudsschema voor het netwerk: Proactief onderhoud uitvoeren – wat soms geplande uitvaltijd kan inhouden – “helpt problemen te voorkomen voordat ze zich voordoen door netwerkcomponenten regelmatig bij te werken en te optimaliseren”, zegt Petrenko.

Mensen

Vrijwel iedereen in een organisatie is afhankelijk van het netwerk, maar dat betekent niet dat iedereen betrokken moet zijn bij het optimaliseren van de prestaties en betrouwbaarheid ervan. Petrenko noemt de volgende functies als belangrijk om bij het proces te betrekken. Houd er rekening mee dat specifieke functietitels per bedrijf kunnen verschillen.

Netwerkingenieurs: Het spreekt voor zich dat de professionals die uw netwerkinfrastructuur implementeren en onderhouden, deel moeten uitmaken van het proces. 

Systeembeheerders: Ook de mensen die de servers (en andere infrastructuur) en applicaties beheren die afhankelijk zijn van het netwerk, moeten worden betrokken. Verwante functietitels zijn onder meer DevOps-ingenieur, ingenieur voor sitebetrouwbaarheid en infrastructuuringenieur.

Beveiligingsprofessionals: Door uw beveiligingsmedewerkers te betrekken, helpt u “de netwerkbeveiliging te waarborgen en uitval door aanvallen of inbreuken te voorkomen”, zegt Petrenko.

Data-analisten: Zoals blijkt uit de hierboven genoemde documentatie, houdt het optimaliseren van een netwerk in dat grote hoeveelheden prestatiegegevens en andere informatie worden geanalyseerd. U hebt mensen nodig met de vaardigheden om die gegevens te interpreteren en inzichten voor verbetering te genereren.

Projectmanager: Vooral in grote ondernemingen hebt u mogelijk iemand nodig om de inspanningen van verschillende teams te coördineren en ervoor te zorgen dat alles volgens planning verloopt.

Get regular tech leadership wisdom for delivering better software and systems.

Name*
This field is hidden when viewing the form
This field is hidden when viewing the form
This field is hidden when viewing the form

Hulpmiddelen

Hieronder bespreken we hulpmiddelen om netwerkuitval te beperken uitgebreider, maar voor nu volstaat het om te zeggen dat u er enkele nodig hebt, met bijzondere aandacht voor (maar niet beperkt tot) monitoring, logboekregistratie, testen en planning. Specifieke categorieën zijn onder meer:

Netwerkmonitoringsoftware: U kunt problemen niet oplossen als u niet eens weet dat ze bestaan. Deze hulpmiddelen bieden realtime inzicht in uw netwerk en de prestaties ervan en kunnen waarschuwingen genereren over mogelijke problemen.

Hulpmiddelen voor configuratiebeheer: Hulpmiddelen voor configuratiebeheer kunnen wijzigingen in netwerkinfrastructuur en apparaten automatiseren en bijhouden. Petrenko merkt op dat dit het risico op menselijke fouten bij het aanbrengen van wijzigingen kan verkleinen.

Software voor logboekbeheer en hulpmiddelen voor logboekanalyse: Logboekregistratie is een cruciaal middel om basispatronen en “normaal” gedrag op een netwerk vast te stellen – en vervolgens abnormale activiteit te identificeren voordat deze mogelijk een storing veroorzaakt.

Geautomatiseerde testhulpmiddelen: Het automatiseren van test- en QA-inspanningen helpt problemen sneller op te sporen en vermindert ook de hoeveelheid benodigde menselijke inspanning.

Software voor capaciteitsplanning: Capaciteitsplanning – vaak een functie van netwerkmonitoringtools – kan helpen toekomstige netwerkvereisten te voorspellen en uitval door overbelasting te voorkomen. Petrenko merkt op dat hiervoor nauwkeurige gegevensinvoer en regelmatige updates nodig zijn om effectief te blijven.

Beperk netwerkuitval in 13 stappen

Wat doet u nu eigenlijk met al het bovenstaande? Wij helpen u op weg: Petrenko deelde een actieplan in 13 stappen met ons, dat u kunt gebruiken om uw eigen strategie te ontwikkelen op basis van de specifieke kenmerken en doelstellingen van uw organisatie en netwerk.

Laten we beginnen:

  1. Beoordeel de huidige situatie: Hier verzamelt, ordent en analyseert u alle onderdelen die we hierboven hebben besproken, inclusief documentatie en andere relevante gegevens.

Advies van Petrenko: “Overweeg externe consultants in te schakelen voor een onbevooroordeeld beeld, maar zorg ervoor dat alle interne belanghebbenden worden betrokken om een volledig beeld te krijgen.”

  1. Bepaal uw doelstellingen: “Uitval beperken” is een prima overkoepelende doelstelling, maar splits deze op in specifiekere doelen voor de prestaties van uw netwerk. 

Advies van Petrenko: “Deze doelstellingen moeten ambitieus maar realistisch zijn, waarbij rekening wordt gehouden met industrienormen en specifieke bedrijfsbehoeften.”

  1. Stel uw team samen: Stel een multifunctioneel team samen met de vaardigheden, kennis en beslissingsbevoegdheid die nodig zijn om resultaten te behalen. 

Advies van Petrenko: “Vermijd het creëren van silo’s en zorg voor goede communicatiekanalen tussen alle teamleden.”

  1. Implementeer monitoringtools: Uitgebreide software voor netwerkmonitoring en -analyse is van cruciaal belang voor elk initiatief om de netwerkbeschikbaarheid te verbeteren. 

Advies van Petrenko: “U moet op basis van uw infrastructuur kiezen tussen oplossingen op locatie, cloudgebaseerde oplossingen of hybride oplossingen.”

  1. Stel je belangrijkste meetwaarden en nulmetingen vast: Je kunt niet naar een doel toewerken als je niet weet waar je bent begonnen.

Advies van Petrenko: “Meet de huidige prestaties om een startpunt voor verbeteringen vast te stellen. Het is cruciaal dat deze meetwaarden consistent zijn en relevant zijn voor je vastgestelde doelstellingen.”

  1. Identificeer en prioriteer kritieke problemen: Afhankelijk van de huidige staat van je netwerk is het onwaarschijnlijk dat je alle onderliggende problemen tegelijkertijd kunt oplossen. Geef daarom prioriteit aan de belangrijkste oorzaken van uitvaltijd. “Belangrijkheid” kan holistisch worden opgevat op basis van de doelstellingen van je organisatie, zoals Petrenko hieronder opmerkt.

Advies van Petrenko: ”Houd bij het stellen van prioriteiten rekening met zowel de frequentie als de impact van problemen.”

  1. Breid je strategie uit: Ontwikkel een gedetailleerd plan om alle geïdentificeerde problemen aan te pakken (nadat de problemen met hoge prioriteit zijn opgelost), inclusief tijdlijnen en de toewijzing van middelen. 

Advies van Petrenko: ”Vergeet niet dat je niet alles tegelijk moet proberen op te lossen; stel prioriteiten op basis van impact en haalbaarheid.”

  1. Ontwikkel redundantie- en omschakelsystemen: Redundantie in kritieke netwerkcomponenten en geautomatiseerde omschakelprocessen zijn beide belangrijke onderdelen van een langetermijnstrategie voor netwerkprestaties en veerkracht.

Advies van Petrenko: “Dit kan redundante hardware, netwerktopologieën met meerdere paden of cloudgebaseerde omschakelsystemen omvatten. Let erop dat je redundantie geen onnodige complexiteit introduceert die zelf een bron van problemen kan worden.”

  1. Voer wijzigingen door: Het is tijd voor de uitvoering, te beginnen met items met een hoge prioriteit.

Advies van Petrenko: “Zorg ervoor dat je de processen voor wijzigingsbeheer volgt om het risico op de introductie van nieuwe problemen te minimaliseren.”

  1. Monitor en pas aan: Geen enkel plan verloopt ooit perfect, dus wees erop voorbereid om je aan te passen terwijl je je strategie uitvoert. 

Advies van Petrenko: “Volg de prestatiestatistieken voortdurend en pas het plan indien nodig aan. Je kunt geautomatiseerde waarschuwingen instellen voor een snelle reactie op nieuwe problemen.”

  1. Organiseer regelmatig professionele ontwikkeling: Bij elk grootschalig initiatief om uitvaltijd te verminderen zullen mensen onvermijdelijk nieuwe technologieën en processen moeten leren. Verwacht niet dat medewerkers het gaandeweg vanzelf uitzoeken.

Advies van Petrenko: “Implementeer doorlopende trainingsprogramma’s voor medewerkers, zodat zij op de hoogte blijven van beste praktijken en nieuwe technologieën. Dit moet zowel technische als procedurele training omvatten om ervoor te zorgen dat alle teamleden zijn toegerust om problemen met uitvaltijd te voorkomen en erop te reageren.”

  1. Oefen met rampherstel: Zoals bij de meeste soorten noodplanning hoop je natuurlijk dat je deze nooit echt nodig zult hebben. Maar als dat wel gebeurt, wil je zeker weten dat je je plannen hebt getest aan de hand van gesimuleerde uitval en andere problemen.

Advies van Petrenko: “Probeer deze oefeningen zo realistisch mogelijk te maken zonder daadwerkelijke uitvaltijd te riskeren.”

  1. Volg en rapporteer je voortgang: Evalueer regelmatig je voortgang ten opzichte van de doelstellingen (stap 2) en verbeteringen in je nulmetingen, en deel de resultaten met belanghebbenden.

Advies van Petrenko: “Gebruik in je rapportage zowel technische meetwaarden als metingen van de bedrijfsimpact om een volledig beeld te geven.”

Hulpmiddelen om uitvaltijd van het netwerk te verminderen

Welke software en andere hulpmiddelen kunnen een cruciale rol spelen bij het minimaliseren van uitvaltijd en het verbeteren van de algehele netwerkgezondheid en -prestaties? We hebben voorbeelden in elke categorie opgenomen.

1. Hulpmiddelen voor netwerkbewaking

2. Hulpmiddelen voor netwerkbeheer en -configuratie

  • Cisco Prime Infrastructure: Helpt je netwerkinfrastructuur te beheren en te optimaliseren.
  • WhatsUp Gold: Biedt netwerkbewaking en -beheer, inclusief configuratiebeheer.

3. Geautomatiseerde hulpmiddelen voor incidentrespons

  • PagerDuty: Integreert met bewakingstools om incidentrespons en geautomatiseerde waarschuwingen te bieden.
  • Opsgenie: Biedt beheer van bereikbaarheidsdiensten, incidentrespons en waarschuwingen.

4. Hulpmiddelen voor foutbeheer

  • Zabbix: Bewaakt de netwerkprestaties en helpt fouten te detecteren en op te lossen.
  • ManageEngine OpManager: Biedt foutbeheer, prestatiebewaking en netwerkvisualisatie.

5. Hulpmiddelen voor back-up en herstel van netwerkconfiguraties

  • RANCID (Really Awesome New Cisco confIg Differ): Automatiseert back-ups en beheer van configuraties van netwerkapparaten.
  • SolarWinds Network Configuration Manager (NCM): Automatiseert het maken van back-ups en herstel van configuraties en helpt naleving te waarborgen.

6. Hulpmiddelen voor logbeheer en analyse

  • Splunk: Verzamelt en analyseert logs van netwerkapparaten om problemen te identificeren en op te lossen.
  • ELK Stack (Elasticsearch, Logstash, Kibana): Biedt krachtige mogelijkheden voor logbeheer en -analyse.

7. Verkeersanalysehulpmiddelen

  • Wireshark: Een netwerkprotocolanalysator die helpt bij het diagnosticeren van netwerkproblemen.
  • NetFlow Analyzer: Bewaakt patronen in netwerkverkeer en helpt knelpunten te identificeren.

8. Oplossingen voor hoge beschikbaarheid en automatische overschakeling

  • F5 BIG-IP: Biedt belastingverdeling, automatische overschakeling en hoge beschikbaarheid voor netwerkservices.
  • Cisco ASA: Biedt robuuste firewall- en automatische-overschakelingsmogelijkheden.

9. Prestatietestshulpmiddelen

  • iPerf: Meet de netwerkbandbreedte en -prestaties.
  • SolarWinds WAN Killer: Simuleert netwerkverkeer om de netwerkprestaties te testen onder verschillende omstandigheden.

10. Virtueel privénetwerk (VPN)hulpmiddelen

  • OpenVPN: Biedt veilige externe toegang tot het netwerk en zorgt voor connectiviteit tijdens uitval.
  • Cisco AnyConnect: Een veilige VPN-oplossing die externe toegang tot netwerkbronnen biedt.

11. Bewaking van eindpuntenhulpmiddelen

  • Sysdig: Bewaakt en beveiligt gecontaineriseerde omgevingen en cloudinfrastructuur.
  • Datadog: Biedt bewaking van de volledige stack, inclusief netwerk-, server- en applicatiebewaking.

12. Cloudgebaseerde hulpmiddelen voor netwerkbewaking

  • ThousandEyes: Biedt volledig inzicht in netwerkprestaties via internet en cloud.
  • LogicMonitor: Een cloudgebaseerde bewakingstool die uitgebreide mogelijkheden voor netwerkbewaking biedt.

De conclusie

Netwerkuitval is voor de meeste organisaties een realiteit, maar dat betekent niet dat je het ongecontroleerd moet laten gebeuren. Gebruik het bovenstaande stappenplan en de hulpmiddelen om de prestaties van je netwerk te verbeteren en kostbare netwerkuitval tot een minimum te beperken.

Voor meer inzichten in netwerken kun je je op onze nieuwsbrief abonneren. We helpen je SaaS-teams en -systemen te bouwen die kunnen meegroeien!