Что чаще всего выводит из строя серверную и сеть, из чего состоит регламент обслуживания, когда виртуализация оправдана, а когда дешевле арендовать инфраструктуру, и по каким признакам пора менять рабочие станции.
Серверная выходит из строя не от старости, а от отсутствия регламента: диск в массиве отказал полгода назад, место под резервные копии кончилось в марте, обновления не ставились с прошлого лета. Ниже — что стоит держать под наблюдением, как это оформляется в работу и в какой момент разговор об обновлении оборудования превращается в разговор об аренде.
Коротко
- Три источника простоя: питание, дисковая подсистема и просроченные обновления. Все три закрываются наблюдением, а не героизмом.
- Регламент обслуживания — это список проверок с периодичностью и ответственным, а не «звоните, если упало».
- Виртуализация оправдана, когда сервисов больше, чем серверов, и нужны быстрые откаты; аренда инфраструктуры — когда оборудование пора менять, а капитальных затрат нет.
- Рабочие станции меняют не по возрасту, а по времени, которое сотрудник теряет на ожидание.
Что реально ломается
Питание. Источник бесперебойного питания с исчерпанными батареями хуже, чем его отсутствие: он даёт ложное ощущение защиты. Батареи — расходник со сроком, и их замена планируется, а не случается.
Диски. Массив продолжает работать при отказе одного диска — и именно поэтому отказ остаётся незамеченным до второго. Контроль состояния массивов и свободного места — первое, что настраивается в мониторинге.
Обновления. Незакрытые уязвимости в службах, доступных из интернета, — самый частый вход шифровальщика. Ставить обновления «когда-нибудь» не работает: нужен график и тестовый контур для критичных систем.
Регламент обслуживания
- Ежедневно: результаты резервного копирования, свободное место, состояние массивов и очередей.
- Ежемесячно: обновления, проверка журналов, срок действия сертификатов и лицензий.
- Ежеквартально: тестовое восстановление из копии, проверка ИБП, ревизия правил доступа на периметре.
- Ежегодно: оценка загрузки и плана развития — что переносим, что выводим, что арендуем.
Для баз 1С на MS SQL к этому добавляются регламентные задания: проверка целостности, обслуживание индексов и статистики, план резервного копирования. Разбор — в статьях об обслуживании баз MS SQL для 1С и о проверке целостности базы.
Виртуализация и аренда
Виртуализация решает три задачи: изоляцию сервисов, быстрый откат после неудачного обновления и утилизацию железа. Она не решает задачу надёжности: пять виртуальных машин на одном хосте падают вместе с этим хостом, поэтому вместе с виртуализацией планируют резервирование.
Аренда инфраструктуры уместна, когда оборудование выработало ресурс, а покупка нового не оправдана: сезонная нагрузка, короткий горизонт планирования, тестовые контуры. Считать нужно суммарно за три года и вместе с администрированием — тогда сравнение получается честным. Этим занимается услуга облачной инфраструктуры (IaaS).
Рабочие места
Критерий замены прост: если сотрудник ждёт открытия документа или отчёта дольше, чем работает с ним, машину пора менять — и это считается в рабочих часах, а не в годах гарантии. Второй критерий — поддерживаемость операционной системы: работать на системе без обновлений безопасности означает держать открытую дверь в сеть.
Наблюдение за серверами и сетью закрывает регламентное обслуживание, поддержку пользователей и парка — абонентское обслуживание.