Disc și stocare

Sisteme de fișiere
/ (/dev/sda1) 54 GB / 80 GB · 67%
/home (/dev/sdb1) 78 GB / 200 GB · 39%
/boot/efi (/dev/sda15) 317 MB / 1 GB · 31%
Unități de stocare
Dispozitiv Dimensiune Model Sănătate (SMART) Temp. Ore de funcționare Sectoare realocate
sda SSD 80G QEMU HARDDISK OK 32°C 14,245 0
sdb SSD 200G Samsung SSD 870 OK 32°C 9,243 0

Starea discului, spațiul liber și capcana inode-urilor

Două probleme de disc pun serverele la pământ și nu seamănă deloc între ele. Cea lentă este un disc care începe să cedeze, lucru pe care SMART îl vede de regulă venind. Cea rapidă este un sistem de fișiere care se umple și trage serviciile după el: o bază de date care nu poate scrie este o bază de date care se oprește.

Pagina acoperă ambele: ocuparea pe fiecare sistem de fișiere, atributele SMART pe fiecare disc și temperatura. Dintre atributele SMART, prevestesc într-adevăr o defecțiune doar numărul de sectoare realocate, sectoarele în așteptare și cele necorectabile offline; dacă vreunul se depărtează de zero, comandă un înlocuitor în loc să aștepți confirmarea. Cele mai multe dintre celelalte valori fluctuează fără însemnătate.

Epuizarea inode-urilor apare separat, fiindcă este foarte derutantă când se întâmplă: discul raportează spațiu liber, scrierile eșuează totuși, iar nimic din locurile evidente nu explică asta. Cauza este un director cu sute de mii de fișiere minuscule — date de sesiune, coadă de mail, un cache nerotit — care consumă rezerva fixă de inode-uri a sistemului de fișiere fără să îi atingă aproape deloc capacitatea.

Există și un al treilea necaz al discului, care nu strică nimic și doar încetinește: unitatea e atât de ocupată încât procesele stau la coadă la ea. În cifre asta e I/O wait, și rareori urcă de la sine — de obicei în spate e ceva planificat: copia de rezervă de noapte, o reconstruire de indecși, o scanare completă ClamAV pe tot sistemul de fișiere. Dacă serverul se îngreunează de fiecare dată la aceeași oră, căutați un orar, nu o defecțiune.