| Proces | CPU % | RAM % |
|---|---|---|
| crowdsec | 4.7 | 4.2 |
| clamd | 3.0 | 18.1 |
| mysqld | 1.9 | 11.9 |
| falco | 0.9 | 14.2 |
| apache2 | 0.6 | 0.7 |
| Proces | CPU % | RAM % |
|---|---|---|
| fail2ban-server | 9.0 | 17.5 |
| falco | 4.9 | 1.9 |
| clamd | 3.5 | 11.0 |
| crowdsec | 2.4 | 1.8 |
| mysqld | 1.4 | 4.5 |
top odpovídá na otázku o aktuální vteřině, zatímco otázka, kterou si člověk skutečně klade, se týká minulé noci: proč se ve tři ráno všechno zaseklo a samo se vrátilo. V tu chvíli už není na co se dívat, protože se nic nezaznamenalo. Stavět Prometheus a Grafanu kvůli jedinému VPS je zase problém sám o sobě: pozorující stack váží víc než pozorovaný server.
Sběrač zapíše každých pět minut jeden řádek do databáze a tato stránka z nich vykreslí posledních 24 hodin. Load average, vytížení CPU s odděleně vedeným I/O wait, RAM a swap, příchozí a odchozí síťový provoz, čtení a zápis disku, navázaná TCP spojení, procesy, zaplnění oddílu, inody a souborové deskriptory v procentech svého limitu, spojení MySQL. Vše na jedné stránce a na jedné časové ose, takže souběhy jsou vidět pouhým okem.
Tyto grafy se vyplatí číst po dvojicích. Vysoký I/O wait při klidném CPU znamená, že server čeká na disk, a přidávat jádra nepomůže. Swap, který jednou vystoupal a nikdy se nevrátil na nulu, říká, že špička paměti už proběhla, jakkoli to teď vypadá klidně. Souborové deskriptory blížící se sto procentům jsou too many open files několik hodin předtím, než nastane. A na většině serverů dojdou inody podstatně dřív než volné místo.