Полезный порог отличается от бесполезного двумя вещами: он выведен из нормы вашего парка, а не взят из статьи, и у него есть длительность. Мгновенная загрузка процессора в 95% — это нормальная работа компьютера; та же загрузка, держащаяся двадцать минут, — сигнал.
Диск: самая полезная метрика
По диску сигнал приходит заранее и почти всегда требует действий. Здесь можно ставить порог сразу, не измеряя норму.
- Меньше 15% свободного на системном диске — предупреждение, время планово разобраться.
- Меньше 5–7% — уже срочно: на этом уровне начинают падать обновления, не создаются временные файлы, тормозит система.
- Для больших дисков процент вводит в заблуждение: 10% от диска на 4 ТБ — это 400 ГБ, и тревожиться рано. Если инструмент позволяет, добавляйте порог в абсолютных величинах.
- Отдельно следите за скоростью заполнения. Диск, потерявший 20% за сутки, интереснее диска, который стабильно держится на 80%.
Процессор и память: сначала измерьте норму
Здесь высокие значения — часть нормальной работы. Порог без длительности сработает на каждом запуске тяжёлой программы.
- Наблюдайте две недели без оповещений и посмотрите, какие значения для этой группы машин обычные.
- Ставьте порог выше привычного максимума, а не «на глаз»: если рабочая станция дизайнера регулярно уходит в 100%, порог в 90% на ней бессмыслен.
- Обязательно добавляйте длительность. Пятнадцать минут — разумная отправная точка для процессора.
- По памяти учитывайте, что современные системы намеренно занимают свободную память под кэш. Само по себе значение 85% ни о чём не говорит; смысл появляется, когда система начинает активно использовать файл подкачки.
- Группируйте машины по назначению. Один набор порогов на весь парк гарантирует шум на одних машинах и слепоту на других.
У каждого порога должно быть действие
Перед тем как включить правило, ответьте: что вы сделаете, когда оно сработает. Если ответа нет — правило не нужно, оно будет создавать работу по нажатию «прочитано».
Хороший порог формулируется вместе с реакцией: «диск меньше 7% — зайти и почистить временные файлы»; «не выходила на связь сутки — проверить питание и сеть». Плохой звучит как «память выше 80%» без продолжения.
Что делать с оповещением дальше — кто разбирает, в какой срок и как не утонуть в потоке — разобрано в статье о настройке оповещений.
Пересматривайте раз в квартал
Парк меняется: добавляются программы, растут базы, обновляются системы. Порог, выведенный год назад, может давно перестать соответствовать норме. Раз в квартал посмотрите, какие правила срабатывали чаще всего и сколько из этих срабатываний привели к реальной работе. Метрики, доступные в кабинете, перечислены на странице управления парком устройств.
Что делать, если порог срабатывает каждый день?
Менять порог или убирать правило, а не привыкать к оповещению. Сигнал, который приходит ежедневно и не требует действий, обучает игнорировать всю категорию — и в тот день, когда он окажется настоящим, его тоже пропустят.
Нужно ли следить за температурой процессора?
На ноутбуках и в запылённых помещениях это имеет смысл: перегрев проявляется как непонятное замедление, причину которого ищут месяцами. На обычных офисных машинах в нормальных условиях эта метрика редко даёт что-то, чего не видно по загрузке процессора.