Продуктивність

Історія навантаження сервера: 24 години, 7 або 30 днів (збір — раз на 5 хвилин)

Load Average (1m)
1.22
CPU
11.8%
RAM
30.8%
ESTABLISHED
92
Процеси
1 / 397
Load Average
CPU
Пам’ять
Мережа (KB/s)
Диск I/O (KB/s)
TCP-з'єднання
Диск і ліміти (%)
MySQL
Процеси в останньому замірі 01:27
ПроцесCPU %RAM %
apache2 13.4 4.7
clamd 9.8 5.3
crowdsec 6.6 9.6
suricata 4.7 0.9
falco 2.6 16.5
Процеси в момент піку за добу 11.10 08:57 · load 2.00
ПроцесCPU %RAM %
falco 19.5 5.3
mysqld 13.1 9.6
fail2ban-server 8.1 8.8
crowdsec 5.7 13.6
apache2 3.5 11.0

Історія навантаження сервера без Prometheus і Grafana

Команда top відповідає на питання про поточну секунду, а питають зазвичай про минулу ніч: чому о третій усе стало й повернулося саме. На той момент дивитися вже нема на що — дані ніде не збереглися. Розгортати заради одного VPS зв'язку Prometheus і Grafana теж сумнівно: стек, що спостерігає, виходить важчим за сервер, за яким спостерігають.

Збирач раз на п'ять хвилин дописує рядок до бази, а сторінка малює за ним останню добу. Load average, завантаження CPU й окремо I/O wait, RAM і swap, прийом і передача мережею, читання та запис диска, кількість встановлених TCP-з'єднань, процеси, заповнення розділу, inodes і файлові дескриптори у відсотках від ліміту, з'єднання MySQL. Усе на одній сторінці й в одному масштабі часу, тож збіги видно оком.

Читати ці графіки варто парами. Високий I/O wait при спокійному CPU означає, що сервер чекає на диск, і додавати процесорних ядер марно. Swap, який одного разу виріс і не повернувся до нуля, каже, що пік пам'яті вже стався, навіть якщо зараз усе виглядає спокійно. Дескриптори, що підійшли до ста відсотків, — це майбутня помилка too many open files за кілька годин до того, як вона трапиться. А inodes на більшості серверів закінчуються помітно раніше за вільне місце.