/ (/dev/sda1)
53 GB / 80 GB · 66%
/home (/dev/sdb1)
76 GB / 200 GB · 38%
/boot/efi (/dev/sda15)
317 MB / 1 GB · 31%
| Пристрій | Розмір | Модель | Стан (SMART) | Темп. | Годин роботи | Realloc-сектори |
|---|---|---|---|---|---|---|
sda SSD |
80G | QEMU HARDDISK | OK | 34°C | 14,260 | 0 |
sdb SSD |
200G | Samsung SSD 870 | OK | 34°C | 9,241 | 0 |
Два дискові лиха кладуть сервери, і вони ані трохи не схожі. Повільне — це накопичувач, що починає відмовляти, і SMART зазвичай бачить це заздалегідь. Швидке — це файлова система, яка заповнюється і тягне за собою служби: база даних, яка не може писати, — це база даних, яка спиняється.
Ця сторінка покриває обидва: зайнятість за файловою системою, атрибути SMART за накопичувачем і температуру. З атрибутів SMART відмову справді віщують лише кількість перепризначених секторів, сектори в очікуванні та невиправні поза мережею; якщо котрийсь із них відходить від нуля, замовляйте заміну замість чекати підтвердження. Більшість інших значень коливається без наслідків.
Вичерпання i-вузлів показано окремо, бо воно дуже спантеличує, коли трапляється: диск повідомляє про вільне місце, записи все одно не вдаються, і ніщо в очевидних місцях цього не пояснює. Причина — каталог із сотнями тисяч крихітних файлів: дані сеансів, поштова черга, кеш, який ніколи не ротували. Він виїдає сталий запас i-вузлів файлової системи, майже не торкаючись її місткості.
Є й третя дискова біда, яка нічого не ламає, а просто сповільнює: накопичувач зайнятий настільки, що процеси стоять до нього в черзі. У цифрах це I/O wait, і росте він зазвичай не сам собою, а від чогось запланованого — нічного резервного копіювання, перебудови індексів, повної перевірки ClamAV по всій файловій системі. Якщо сервер важчає щоразу в ту саму годину, шукайте не поломку, а розклад.