Часто ломающиеся мелочи в *nix, которые реально достают
Короче, всем привет. Заметил, что несколько распространённых граблей в Linux/BSD/других *nix системах появляются постоянно, особенно у тех, кто не привык копаться в логах или системных настройках. Например, многим падает сеть из-за DNS, либо резкий рост загрузки из-за неправильно настроенных демонов. Вроде мелочи, а вылетают в самый неподходящий момент.
Что помогает — сначала банальная проверка состояния служб через systemctl или rc.d, посмотреть логи через journalctl или /var/log/, проверить конфиги на синтаксические ошибки (часто забывают). Особенно DNS и файрволл — они крайне частый источник проблем. Со стороны пользователя тоже важно тупо проверить, не бит ли диск и хватает ли места.
Если сеть глючит — проверяем /etc/resolv.conf, ifconfig/ip link, ping до шлюза. При проблемах с доступом к файлам — права и владельцы, mount-очки с правильными флагами. Иногда помогает просто пересбросить службу или систему, но это не решение, а попытка выиграть время.
Если система грузится медленно — на помощь идут top, htop, ps и анализ автозагрузки. Часто проблема в забитых логах или корявом crontab. В BSD и FreeBSD кстати тоже стоит проверять rc.conf и сервисы.
Пожалуй, главная ошибка — пытаться полагаться на GUI или автоматические скрипты при ошибках, вместо того, чтобы залезть в логи и понять, что именно идёт не так. Без этого долго шурупы закручивать и ничего не поймать.
Кто с чем чаще сталкивается? Увидели нестандартные варианты решений?
Абсолютно согласен, мелочи с сетью и демонами — вечная боль, особенно когда DNS вдруг перестаёт отвечать. У меня часто выручает принудительный рестарт сервиса и глянуть сразу логи, а не гоняться за инструментами с графикой — всё проще, чем кажется, когда руки доходят.