1 open besluit1414 voorstellen

Onderwerp

Het vlootoverzicht

Het vlootbeheer haalt van alle clusters een vaste selectie samengevatte metingen op voor één overzicht van beschikbaarheid, capaciteit en gezondheid. Het overzicht is een aanvulling: valt het uit, dan werken de meldingen per cluster door.

Nog niet bevestigd door een mens. Eigenaar: vdo89. Bron in de atlas

Domein
Volgt uit
Functies
Producten
Verwant

Wat het is

Het vlootoverzicht is één beeld van de hele vloot: welke clusters beschikbaar zijn, hoeveel capaciteit ze gebruiken en hoe gezond ze zijn. Het vlootbeheer haalt daarvoor van ieder cluster een vaste selectie samengevatte metingen op, met een kleine verzamelaar per cluster en eigen verwerkings- en opslagcapaciteit op het vlootcluster. De historie staat in de objectopslag van cel 1.

Waarom zo

Het vlootbeheer heeft de observability al in huis, zodat de eerste levering een vlootoverzicht krijgt zonder te wachten op nieuwe apparatuur. Een vaste lijst begrenst het volume en daarmee de opslag. Omdat het overzicht geen schakel is in de meldingsroute, raakt uitval ervan alleen het overzicht en de historie, niet de signalering per cluster.

Uitspraken

3 vastgesteld7 voorstellen

Alle 7 voorstellen vaststellen

Samengevatte metingen in het vlootbeheer

VastgesteldUitgangspunt#

Het vlootoverzicht draait op het vlootcluster met de observability van Red Hat Advanced Cluster Management, met Thanos voor de historie en Grafana voor de dashboards. Het haalt van alle clusters een vaste selectie samengevatte metingen op en toont één overzicht van beschikbaarheid, capaciteit en gezondheid van de vloot.

Toelichting

Perses-dashboards zijn in deze observability nog Technology Preview en worden daarom in de eerste levering niet gebruikt.

VastgesteldOntwerpbesluit#

De eerste levering werkt met wat het platform al heeft: de bewaking per cluster en de samengevatte metingen in het vlootbeheer, dat de observability al in huis heeft. Er wordt niet gewacht op nieuwe apparatuur; de eigen bewakingsvoorziening, met logopslag en een historie van verkeersstromen, volgt in groeipadstap 2.

Toelichting

Afgewezen alternatief: een tijdelijk bewakingscluster als gehost cluster met eigen werkers en logopslag. Dat vraagt voor een voorziening die weer verdwijnt drie grote virtuele werkers en terabytes aan opslag, en valt uit met het clusterbeheer of de werkervirtualisatie.

VoorstelRegel#

Een nieuw cluster krijgt de verzamelaar van het vlootoverzicht, de bewaking en de doorsturing zonder handeling via het vlootbeheer, en staat binnen 30 minuten na zijn aansluiting in het vlootoverzicht.

Toelichting

Eén inrichting voor alle clusters; de termijn is gelijk aan de aansluittermijn van het vlootbeheer. Voorwaarde bij de acceptatie: de leverancier ondersteunt de observability-addon op gehoste clusters met KubeVirt-infrastructuur, ook in tussenliggende upgradecombinaties. Zonder addon blijven de metingen van een gehost cluster in zijn eigen bewaking en toont het vlootoverzicht alleen zijn status.

VoorstelWaarde#

De samengevatte metingen staan in een eigen bucket van 200 GB in de realm platform van de objectopslag van cel 1; het geheim van die bucket komt via External Secrets uit het geheimenbeheer. Ruwe metingen blijven 7 dagen bewaard, per 5 minuten samengevatte metingen 30 dagen en per uur samengevatte metingen 90 dagen.

Toelichting

De bucket gebruikt HTTPS met het certificaat van de objectgateway en staat in rust op de versleutelde schijven van het opslagcluster. Een certificaatketen buiten de tussen-CA van de cel is een afwijking met reden.

Vaste lijst en volume

VoorstelRegel#

Het vlootbeheer haalt alleen de metingen van de vaste lijst op. De lijst staat als code in versiebeheer; uitbreiding gaat via een wijzigingsvoorstel met een schatting van het volume.

Toelichting

Zo blijft de opslag begrensd; de drempel op de ruimte bewaakt het volume.

VoorstelWaarde#

De vaste lijst bevat de beschikbaarheid van API en applicatie-ingang, de capaciteit en gezondheid per cluster, de opslagbezetting per cluster en de afleverstatus van Alertmanager, en voor de beheerde database de beschikbaarheid, de replicatievertraging en de back-upstatus.

Toelichting

De drempels voor de beheerde database horen bij Beheerde databases & koppelingen. Nieuwe knooppuntsoorten krijgen vanaf groeipadstap 3 hun metingen in de vaste lijst.

VoorstelOntwerpbesluit#

Bij 65 procent van de 200 GB krijgt platformbeheer een melding, gelijk aan de grens voor het vlootcluster; het kort dan de vaste lijst in of vraagt meer ruimte aan. Meer ruimte is een quotumaanvraag bij opslagbeheer, binnen de grenzen van het opslagcluster.

Toelichting

Het volume volgt het aantal clusters en de lengte van de vaste lijst. Bij de uitbreiding naar 24 gehoste clusters in cel 1 worden ruimte en volume herijkt.

Uitval en groei

VoorstelWerking#

Valt het vlootoverzicht uit, dan detecteren de lokale metingen een fout of grensoverschrijding en routeert de Alertmanager van het cluster de melding op eigenaar en profiel, zonder tussenkomst van het vlootbeheer. Beheer gebruikt die lokale signalen en herstelt het overzicht. In de eerste levering is er dan geen volledige centrale historie: ontbrekende meetperioden worden als onbekend weergegeven.

VoorstelWaarde#

In de eerste levering bewaakt het vlootoverzicht ten hoogste 14 clusters: het vlootcluster, het basisdienstencluster, de werkervirtualisatie, het clusterbeheer en tien plaatsen voor gehoste clusters, namelijk het bouwcluster, het portaalcluster, zeven clusters voor teams en één voor de herstelomgeving. Na uitbreiding van het clusterbeheer zijn er 24 gehoste clusters per cel. In groeipadstap 2 krijgt cel 2 dezelfde inrichting en toont het vlootoverzicht beide cellen; in groeipadstap 4 sluiten nieuwe clusterdiensten aan via dezelfde standaardinrichting.

Verwijzen hiernaar

Onderwerpen 2