Какие ключевые метрики и показатели можно увидеть в htop и что они означают?

«Какие ключевые метрики и показатели можно увидеть в htop и что они означают?» — вопрос из категории Linux, который задают на 23% собеседований Devops Инженер. Ниже — развёрнутый ответ с разбором ключевых моментов.

Ответ

В htop я в первую очередь смотрю на несколько критичных секций:

1. Load Average (Средняя нагрузка) Показывает среднее количество процессов, ожидающих выполнения CPU, за 1, 5 и 15 минут. Значение выше количества ядер CPU сигнализирует о перегрузке.

Load average: 1.25 0.98 0.75  # На 4-ядерной системе это нормально

2. Использование CPU Разбивка по времени, проведенному в разных режимах:

  • %us (user) – процессы пользователя.
  • %sy (system) – процессы ядра.
  • %wa (iowait) – ожидание ввода-вывода. Высокий %wa часто указывает на проблемы с диском.

3. Использование памяти (RAM и Swap)

  • Mem: общая, использованная, свободная память.
  • Buff/Cache: память, используемая ядром для кэширования дисковых операций. Она может быть быстро освобождена.
  • Swap: активное использование диска под своп. Высокое значение вместе с почти полной RAM – явный признак нехватки оперативной памяти.

4. Tasks (Задачи)

  • running (R) – процессы, выполняемые прямо сейчас.
  • sleeping (S) – процессы, ожидающие события.
  • zombie (Z) – "зомби"-процессы, завершившиеся, но не "убитые" родителем. Даже один такой процесс – повод для расследования.

5. Список процессов Сортирую по %CPU или %MEM, чтобы найти "пожирателей" ресурсов. Смотрю на PID, пользователя (USER), приоритет (PRI) и полную команду (COMMAND).