Сервер — это сотрудник, который работает круглосуточно, без отпусков и жалоб. Именно поэтому о нём вспоминают в единственный момент: когда он остановился, а вместе с ним — 1С, почта, файлы и половина рабочих процессов компании. Между тем множество серьёзных отказов серверов начинается одинаково: с маленькой задачи по обслуживанию, которую откладывали месяцами.
Ниже — семь регулярных работ, из которых состоит нормальное обслуживание сервера. По этому списку удобно проверить своего сисадмина или подрядчика — у каждой работы есть простой признак того, что она не делается.
Пока за сервером никто не смотрит, о проблемах сообщают пользователи — фразой «у нас всё висит». Это худший из возможных каналов мониторинга: медленный и срабатывающий, когда уже поздно.
Правильно настроенный сервер жалуется сам и заранее: система мониторинга следит за доступностью, нагрузкой на процессор и память, температурой, состоянием служб — и шлёт алерт инженеру при отклонениях, а не после падения. Разница принципиальная: «диск скоро заполнится» — плановая задача, «диск заполнился» — внезапный простой.
Признак, что работа не делается: о падениях сервера первыми узнают сотрудники, а не айтишники.
Необновлённый сервер — открытая дверь: атаки на бизнес раз за разом используют уязвимости, заплатки для которых давно выпущены. Но просто «включить автообновления» на сервере нельзя — незапланированная перезагрузка посреди рабочего дня или обновление, ломающее совместимость с 1С, обходятся дорого.
Поэтому это регулярная ручная работа: отслеживать критичные патчи, ставить их в согласованное с бизнесом окно обслуживания, проверять после установки, что службы поднялись и всё совместимо. Скучно, зато именно это отделяет «нас не взломали» от «нас пока не взломали».
Признак, что работа не делается: никто не может назвать дату последнего обновления сервера и что именно ставилось.
Про бэкапы мы написали отдельный подробный разбор, здесь — суть в двух абзацах. Копии должны быть независимыми друг от друга и версионными, а не зеркалом, куда испорченный файл синхронизируется поверх здорового; ориентир — хотя бы одна копия, изолированная от основной сети.
И главное, что относится именно к обслуживанию: единственное доказательство работоспособности бэкапа — успешно проведённое тестовое восстановление. Не зелёная галочка в программе, а открытая база и рабочие файлы. Периодичность тестов зависит от критичности систем — главное, чтобы они были регулярным пунктом графика, а не разовым событием.
Признак, что работа не делается: вам ни разу не показывали результат тестового восстановления.
Железо умирает не мгновенно — оно предупреждает. Диски копят ошибки SMART задолго до отказа, деградировавший RAID-массив может продолжать работать и молчать до следующего сбоя, батареи ИБП со временем теряют ёмкость, а забитые пылью радиаторы поднимают температуру вплоть до аварийных отключений в жару.
Обслуживание — это регулярно читать эти предупреждения: проверять SMART-статусы и состояние массива, тестировать ИБП под нагрузкой, следить за температурами и раз в год проводить физическую ревизию серверной. Замена диска по предупреждению — плановая операция; восстановление развалившегося массива — лотерея.
Признак, что работа не делается: никто не знает, когда меняли батарею ИБП и в каком состоянии диски.
Сервер помнит всех, кому когда-либо давали доступ: уволенных сотрудников, бывших подрядчиков, «временные» учётки для настройки, пароль от которых знал весь офис. Каждая такая запись — открытый вход в систему, где лежат данные компании.
Регулярная ревизия доступов: отключать учётки ушедших сотрудников без задержки, убирать лишние административные права, менять пароли служебных записей, проверять, кто реально подключается к серверу удалённо. Это часть общей ИТ-гигиены компании — подробнее о ней в описании услуги ИТ-безопасность для бизнеса.
Признак, что работа не делается: учётная запись сотрудника, уволенного полгода назад, всё ещё активна.
Самая недооценённая причина простоев: диск заполнился — и сервер встал. Логи, временные файлы, старые копии баз и «файлы на минутку» растут незаметно, а заканчиваются всегда в неподходящий момент — 1С перестаёт проводить документы, почта — принимать письма, бэкап — выполняться.
Обслуживание здесь — контроль свободного места с порогами предупреждений, ротация журналов, чистка временных файлов и — не менее важно — периодический просмотр самих логов: система заранее пишет и о сбоящей службе, и о попытках подбора пароля. Журналы, которые никто не читает, — это чёрный ящик самолёта, который никто не открывает после тревожных сигналов.
Признак, что работа не делается: свободное место на системном диске сервера на исходе, и это никого не беспокоит.
Представьте: сервер лёг, а единственный человек, который знает, как он устроен, — в отпуске без связи или уволился в прошлом квартале. Схема «всё в голове у одного айтишника» превращает любую аварию в катастрофу, а смену подрядчика — в заложничество.
Нормальное обслуживание оставляет след на бумаге: описание конфигурации, схему сети, список сервисов и их зависимостей, порядок действий при типовых авариях и контакты ответственных. Плюс журнал изменений: что меняли, когда и зачем. Проверка простая — восстановить работу по этой документации должен суметь квалифицированный инженер, который видит ваш сервер впервые.
Признак, что работа не делается: на вопрос «а где у нас описано, как устроен сервер?» ответ — «у Виталика спросите».
Именно поэтому и нужно: у большой компании падение одного сервера — неприятность, у маленькой единственный сервер — это вся ИТ-инфраструктура разом. Объём работ при одном сервере небольшой, но регулярность важна так же, как и в большом парке.
Может — если у него есть время, квалификация и, главное, система: график работ, мониторинг, журнал изменений. На практике штатному специалисту в малом бизнесе обслуживание сервера достаётся «по остаточному принципу» после принтеров и просьб коллег — и список выше выполняется от случая к случаю. Проверить просто: пройдитесь по семи «признакам» из этой статьи.
Зависит от количества серверов, критичности систем и объёма работ, поэтому честный ответ появляется после знакомства с вашей инфраструктурой. Ориентир для оценки другой: сравните стоимость обслуживания не с нулём, а с ценой одного дня простоя вашей 1С и почты. Как устроено серверное сопровождение у нас, описано на странице обслуживания серверов.
Семь работ из этой статьи — не «идеальный мир», а реалистичный ориентир для большинства компаний. Начните с проверки: пройдитесь по семи «признакам» — и вы быстро поймёте, обслуживается ваш сервер или просто пока не сломался.
← Ко всем статьямБесплатная консультация и расчёт стоимости в течение дня
Написать в WhatsAppЗаявка получена, мы свяжемся с вами в ближайшее время.