InfraNestInfraNest
Statistieken & meldingen

Servermetrics en meldingen

InfraNest verzamelt de CPU-, netwerk- en schijfmetrics van elke server, toont ze als grafieken en kan je waarschuwen wanneer iets te lang boven een drempelwaarde blijft.

Bekijk de CPU-, netwerk- en schijfactiviteit van je servers als grafieken, en krijg een melding wanneer iets te lang boven een limiet blijft. Dit is voor iedereen die de gezondheid van servers wil bewaken zonder monitoringexpert te moeten zijn.

Overzicht

  • InfraNest verzamelt automatisch de CPU-, netwerk- en schijfmetrics van elke server en toont ze als grafieken.
  • Je kunt waarschuwingsregels instellen zodat InfraNest je laat weten wanneer een metriek te lang te hoog blijft.
  • Geheugen, schijfruimte en belastingsgemiddelde vereisen dat de server-agent is geïnstalleerd, omdat je provider deze niet rapporteert.
  • Wanneer een service op de server uitvalt, vertelt InfraNest je waarom in begrijpelijke taal, zonder ooit je logs te lezen.

De metrics bekijken

  1. Ga naar Monitors om alle servers in één overzicht te zien.
  2. Open een server om de bijbehorende monitoringpagina te zien, met live grafieken voor CPU, netwerk in/uit en schijf lezen/schrijven, plus schijfruimte en wat er draait.

NoteMonitoring moet voor een server zijn ingeschakeld voordat er iets over wordt verzameld. Tot die tijd staat de server wel vermeld, maar toont hij geen gegevens.

Geheugen, schijfruimte en belastingsgemiddelde worden standaard niet getoond — de API van je provider rapporteert deze niet. Ze bestaan alleen op de server zelf, dus regels voor deze metrics blijven grijs totdat de agent is geïnstalleerd.

Waar waarschuwingsregels vandaan komen

De meeste regels worden één keer ingesteld voor je hele organisatie onder Alert defaults, en elke server erft ze. In de waarschuwingslijst van een server worden deze weergegeven als Organisatiestandaard.

Als één server andere waarden nodig heeft — bijvoorbeeld een buildmachine die bedoeld is om warm te draaien — wijzig je de regel daar, en wordt deze Hier aangepast, wat alleen die server beïnvloedt. Gebruik Resetten om terug te gaan naar de regel van de organisatie. Je kunt ook een regel toevoegen die alleen op één server bestaat en nergens anders.

Het uitschakelen van een organisatieregel schakelt deze overal uit, ook op servers die deze hadden aangepast.

Een melding instellen

  1. Open op de monitoringpagina van de server Waarschuwingsregels en selecteer Metrieksregel toevoegen.
  2. Kies de Statistiek (CPU, netwerk in/uit of schijf lezen/schrijven), een drempelwaarde en hoe lang de overschrijding moet aanhouden.
Servermetrics en meldingen
  1. Selecteer Opslaan.

De duur is het venster waarover InfraNest een gemiddelde berekent, geen stopwatch. Het neemt het gemiddelde van de metriek over die minuten en waarschuwt alleen als het gemiddelde boven je limiet uitkomt — zo wekt een piek van één minuut door een back-up of geplande taak niemand, terwijl echt aanhoudende belasting dat wel doet. Wanneer de melding afgaat, wordt er een incident geopend en worden je meldingsbestemmingen op de hoogte gebracht.

Zodra een melding is afgegaan, moet de metriek duidelijk onder je limiet komen (ongeveer 10% lager) voordat deze als herstel wordt beschouwd. Dat voorkomt dat een waarde die net op de grens schommelt, telkens opnieuw waarschuwt en herstelt.

Wat je ontvangt

Je ontvangt maximaal twee berichten per melding:

  • Wanneer het afgaat — de huidige waarde, de limiet die je hebt ingesteld en hoelang deze al is overschreden.
  • Wanneer het weer normaal is — een bericht dat aangeeft hoelang de waarde boven de limiet is gebleven. Er hoeft niets te gebeuren; het sluit alleen het eerste bericht af.

Als een piek te kort is om de melding te activeren, hoor je helemaal niets — zelfs geen bericht dat alles weer normaal is, omdat er geen melding was om af te sluiten. Het incident wordt automatisch opgelost wanneer de metriek herstelt.

NoteDeze incidenten staan naast je uptime-monitoringincidenten, zodat de gezondheid van je server en de uptime van je diensten op één plek staan.

Als je de agent installeert

Er verandert hier niets — drempelwaarden, duur, herstelgedrag, incidenten en meldingen werken allemaal op dezelfde manier. Je krijgt gewoon meer metrics om regels voor te schrijven, elke minuut een meting in plaats van elke vijf, en de mogelijkheid om een melding in te stellen voor een server die helemaal geen gegevens meer doorstuurt.

Het verwijderen van het laatste agenttoken zet de server direct terug op providermetrics. InfraNest laat je weten wanneer dit gebeurt, omdat de regels die alleen de agent kan meten op dat moment niet meer worden gemeten.

Wanneer een service uitvalt, vertellen we je waarom

Als je de agent hebt geïnstalleerd, toont het tabblad Services wat er is ingesteld om te draaien op de machine, met alles dat is mislukt boven aan de lijst.

Een mislukte service toont waarom deze mislukte, in begrijpelijke taal, naast de naam:

Wat je ziet Wat er gebeurde
Geen geheugen meer Het systeem heeft de service beëindigd om geheugen vrij te maken. Meestal is de machine te klein voor wat erop draait, of heeft de service een geheugenlek.
Gestopt met een fout De service is zelf gestopt met een fout. De foutcode wordt ernaast weergegeven.
Duurde te lang en is gestopt De service is niet binnen de toegestane tijd gestart of afgesloten.
Te vaak mislukt om opnieuw te proberen De service bleef herstarten en gaf het op. Er is iets mis dat een herstart niet oplost.
Reageerde niet meer De service meldde zich niet meer, dus is deze herstart.
Gecrasht De service is onverwacht gestopt en heeft een crashbestand achtergelaten.
Kreeg niet wat nodig was om te starten Iets waarvan de service afhankelijk is, ontbrak — een bestand, een poort, een apparaat.

Dit is meestal voldoende om te weten wat je moet doen: "geen geheugen meer" wijst op de grootte van de server, "kreeg niet wat nodig was om te starten" wijst op configuratie.

Waarom we het logbestand van de service niet tonen

InfraNest stuurt bewust geen logoutput van je services naar het systeem, en heeft dat ook niet in de planning.

Logs bevatten vaak wachtwoorden en toegangssleutels — een databaseverbindingsreeks in een opstartfout, een token in een mislukt verzoek. Die van je server naar InfraNest kopiëren zou je inloggegevens ergens brengen waar ze niet horen te zijn, en geen enkele filtering kan een geheim betrouwbaar onderscheiden van gewone tekst in de uitvoer van een willekeurig programma.

De foutreden die wordt getoond in het tabblad Services beantwoordt de vraag die het log zou beantwoorden, zonder dat er iets van je machine af gaat.

Om het log zelf te lezen, gebruik je de machine die je al vertrouwt: log in via SSH en voer uit

journalctl -u name-of-the-service --since "1 hour ago"

De servicenaam die wordt getoond in het tabblad Services is precies wat er na -u komt.

Problemen oplossen

  • Een regel blijft grijs — die metriek vereist dat de agent op de server is geïnstalleerd; providermetrics alleen kunnen dit niet meten.
  • Geen melding afgegaan voor een piek die je in de grafiek zag — de piek was waarschijnlijk korter dan de duur die je had ingesteld, waardoor het gemiddelde nooit boven je drempelwaarde kwam.
  • Je kreeg geen bericht dat alles weer normaal is — dat betekent dat er nooit een melding is afgegaan voor die daling, dus er was niets om af te sluiten.

Gerelateerde artikelen

Begin in seconden

Breng je hele infrastructuur samen in één modern dashboard.

Gratis plan · Geen creditcard nodig · In enkele minuten ingesteld