Типичная история: сервер настроили три года назад, он работает, и трогать его боятся. Обновления не ставились, потому что «а вдруг что-то отвалится». Мониторинга нет, потому что пока не падало. Резервная копия делается скриптом, который никто не проверял. Человек, который все это настраивал, уже не работает в компании.
Такой сервер не сломан. Он просто гарантированно сломается — вопрос только в том, в какой момент и насколько дорого это обойдется.
Цена
До пяти серверов — 35 000 – 70 000 ₽ в месяц. До двадцати — 70 000 – 150 000 ₽ в месяц. Кластеры, высокая нагрузка и критичный режим — от 180 000 ₽ в месяц. Разовое приведение сервера в порядок без подписки — 60 000 – 150 000 ₽.
Что мы делаем в первый месяц
Порядок один и тот же, независимо от того, что за сервер и что на нем крутится.
Сначала инвентаризация: что установлено, что запущено, что слушает порты, чем занят диск, какие задачи в планировщике. Часто на этом шаге обнаруживаются сервисы, о которых никто не помнит, и процессы, которые съедают ресурсы без пользы.
Затем базовая гигиена: обновление пакетов и ядра в согласованное окно, закрытие лишних портов, защита от перебора паролей, разделение учетных записей, актуальные сертификаты. Дальше — мониторинг и резервные копии с проверкой восстановления. И только после этого сервер можно считать управляемым.
Обновления без «а вдруг отвалится»
Страх обновлений — следствие того, что никто не знает, что именно сломается. Лечится не смелостью, а порядком: сначала обновляется тестовая копия, проверяются ключевые сценарии, потом боевой сервер в заранее оговоренное окно, с готовым откатом.
Для систем, которые нельзя останавливать, применяются другие схемы: обновление по одной ноде, переключение трафика, живая миграция виртуальной машины. Что именно подходит, зависит от вашей архитектуры, и это выясняется на аудите, а не в момент, когда критичное обновление безопасности выходит и ставить его надо сегодня.
Безопасность на уровне сервера
Мы не занимаемся аттестацией и лицензируемой защитой информации. Мы занимаемся инженерной гигиеной, которая закрывает большинство реальных сценариев взлома: наружу торчит только то, что должно; доступ по ключам либо по длинным паролям с защитой от перебора; учетки именные и с минимальными правами; обновления безопасности ставятся не через полгода; логи собираются и хранятся отдельно от сервера, чтобы их нельзя было зачистить вместе со следами.
Отдельная вещь — резервные копии, которые нельзя удалить с самого сервера. При шифровальщике это оказывается единственным, что имеет значение, и проверяется это не рассуждениями, а восстановлением на отдельной машине.
Логи и разбор инцидентов
«Перезагрузили, вроде работает» — не решение, а откладывание проблемы. Чтобы разбирать причины, нужны собранные логи и метрики за период до аварии: что происходило с памятью, диском, соединениями, какие ошибки шли в приложении.
Мы настраиваем сбор и храним историю, поэтому после каждого заметного инцидента остается короткий разбор: что произошло, почему, что сделано сейчас и что нужно изменить, чтобы это не повторилось. Скучный жанр, но именно он через несколько месяцев превращает нестабильный сервер в стабильный.
Конфигурация как код
Настройки сервера мы описываем в виде конфигураций, которые хранятся в репозитории. Это дает три вещи: сервер можно поднять заново за предсказуемое время вместо суток ручной работы, видно историю изменений, и одинаковые окружения не расползаются друг от друга.
Для одиночного сервера это может показаться избыточным. Когда серверов больше трех, это единственный способ не тратить каждый раз полдня на выяснение, чем машины отличаются между собой.
Что вы получаете
Управляемый сервер вместо коробки, которую страшно трогать. Обновления по графику и с откатом. Мониторинг, предупреждающий заранее. Копии, которые проверены восстановлением. Логи и разборы инцидентов. Описанную конфигурацию, из которой машину можно поднять заново. И контакт, по которому отвечают в оговоренное время, а не когда освободятся.
Если серверов много и вопрос шире одной машины — смотрите аутсорсинг ИТ-инфраструктуры. Если на сервере живет 1С, есть отдельная страница про обслуживание сервера 1С и PostgreSQL. Общие условия подписки, режимы и SLA — в ИТ-аутсорсинге.