Load Average — три числа в выводе `uptime`, `top`, `w`, показывающие среднее количество процессов, ожидающих CPU или в состоянии "D" (uninterruptible I/O wait) за последние 1, 5 и 15 минут.
Как читать: если у вас 4 ядра и LA = 4.0 — CPU на 100 %, но процессы не ждут. LA = 2.0 — 50 %, есть запас. LA = 8.0 — критическая перегрузка, каждый процесс ждёт очереди. Тренд важнее абсолютной цифры: LA 15-мин > LA 1-мин = проблема нарастает.
Однако LA считает не только CPU, но и процессы в iowait. Если у вас load average 20 при 4 ядрах, но CPU в top-е 30 % — узкое место в диске, а не в CPU. Смотрите `iostat -x 1` и колонку %util.
На k8s-нодах при этом LA часто высокий из-за короткоживущих контейнеров — не всегда индикатор реальной проблемы. Ориентируйтесь на 99-й перцентиль latency ваших приложений, а не только на LA.