failover
/ˈfeɪlˌoʊvər/zelfstandig naamwoord
Failover is het overschakelen van een primair systeem naar een reservesysteem wanneer het primaire systeem uitvalt of niet goed meer werkt.
Na de storing leidde de failover het verkeer automatisch naar de reserveserver.
Bij failover neemt een secundaire server, Woordenboek · In het kortdatabaseEen database is een gestructureerde verzameling gegevens die software kan opslaan, opvragen en wijzigen. Een databasebeheersysteem regelt de toegang tot die gegevens.Lees meer, netwerkverbinding of externe dienst het werk van een uitgevallen onderdeel over. Zo kan een applicatie beschikbaar blijven of sneller herstellen en blijft de Woordenboek · In het kortdowntimeDowntime is de periode waarin software, een systeem of een online dienst niet beschikbaar is of essentiële functies niet bruikbaar zijn.Lees meer beperkt. Daarvoor moet een bruikbaar reservesysteem klaarstaan en toegang hebben tot actuele gegevens.
Hoe verloopt een failover?
Woordenboek · In het kortmonitoringMonitoring is het systematisch volgen van software, infrastructuur of processen met meetwaarden en controles. Wijkt een waarde af, dan kan het systeem een waarschuwing geven, zodat een beheerder het probleem kan onderzoeken.Lees meer of een technische controle stelt vast dat het primaire onderdeel niet meer reageert of fouten geeft. Vervolgens stuurt het systeem verkeer of verwerking naar het reserveonderdeel. Bij een database kan een replica de primaire rol overnemen. Bij een webapplicatie kan een load balancer het verkeer naar een andere server leiden.
Die omschakeling kan volledig automatisch verlopen of eerst goedkeuring van een beheerder vragen. Hoe snel dat kan, hangt onder meer af van de gekozen infrastructuur, de synchronisatie van gegevens en de tijd die nodig is om een reserveonderdeel te starten. Na herstel wordt het verkeer vaak gecontroleerd teruggeschakeld naar het oorspronkelijke systeem.
Een reserve alleen is niet genoeg
Een tweede server of provider maakt nog geen werkende failover. Het systeem moet storingen betrouwbaar herkennen, weten wanneer het mag omschakelen en voorkomen dat twee onderdelen tegelijk wijzigingen verwerken. Ook moet duidelijk zijn hoeveel recente gegevens bij een storing verloren mogen gaan.
Daarom testen teams de volledige procedure regelmatig. Ze controleren bijvoorbeeld of verbindingen opnieuw worden opgebouwd, achtergrondtaken doorgaan en gebruikers de juiste gegevens zien. Zo'n test laat ook zien of de reserve genoeg capaciteit heeft om de belasting over te nemen. Failover verkleint de gevolgen van een storing, maar neemt de oorzaak niet weg; die moet daarna nog worden onderzocht en hersteld.