Когда компания работает в одном офисе, состояние ИТ-инфраструктуры относительно легко контролировать. Но с появлением филиалов привычная модель быстро перестает работать.
Десятки площадок, серверов, рабочих станций, сетевых устройств и каналов связи формируют распределенную среду, в которой проблема в одном компоненте может повлиять сразу на несколько подразделений.
При этом ИТ-служба должна понимать не только что произошло, но и где возникла проблема, какой сервис затронут и насколько критичны последствия для бизнеса. Именно поэтому мониторинг ИТ-инфраструктуры для распределенных филиалов становится важным элементом современной модели управления ИТ.
Главная сложность филиальной сети заключается не только в количестве оборудования.
В распределенной инфраструктуре одновременно присутствуют несколько факторов:
В результате даже простая неисправность может потребовать значительного времени на диагностику. Представим ситуацию: сотрудники филиала сообщают, что не могут работать с корпоративной системой. Без централизованного мониторинга специалисту приходится последовательно проверять канал связи, сетевое оборудование, серверы и сервисы. При наличии мониторинга часть этой информации уже доступна в системе. Это позволяет быстрее перейти от сообщения «у нас не работает» к пониманию «какой компонент вышел из строя и на что это влияет».
Эффективная система мониторинга не ограничивается проверкой доступности компьютеров.
Для распределенной компании целесообразно контролировать несколько уровней инфраструктуры.
Для удаленных площадок стабильность сети часто является критически важным условием работы.
Стоит контролировать:
Особое значение имеет анализ динамики.
Если канал регулярно работает на высокой загрузке, это сигнал для ИТ-службы: инфраструктура пока функционирует, но в будущем может потребоваться увеличение пропускной способности.
Маршрутизаторы, коммутаторы, точки доступа и другие устройства являются связующим звеном между пользователями, серверами и корпоративными сервисами.
Мониторинг позволяет отслеживать:
Это особенно важно для филиалов, где отказ одного сетевого устройства способен фактически остановить работу целого офиса.
Серверный мониторинг помогает заранее обнаруживать проблемы с производительностью и доступностью.
В зависимости от инфраструктуры контролируются:
Важна именно динамика показателей.
Например, недостаток свободного пространства на сервере может не привести к немедленному сбою. Но если объем свободного места постоянно сокращается, система мониторинга позволяет обнаружить проблему до того, как она станет критической.
Рабочие станции обычно являются наиболее многочисленной категорией ИТ-активов. В крупной филиальной сети их количество может исчисляться сотнями или тысячами. Централизованный мониторинг позволяет получать информацию о состоянии устройств без необходимости физического присутствия специалиста на площадке.
Можно контролировать:
Это дает ИТ-службе дополнительную возможность выявлять потенциальные проблемы до массового обращения пользователей.
Технические показатели сами по себе не дают полной картины. Для бизнеса гораздо важнее доступность конкретного ИТ-сервиса. Например, сотрудники филиала используют корпоративную систему.
Для ее работы необходимы:
рабочее место → локальная сеть → канал связи → сетевое оборудование → сервер → база данных → приложение.
Если любой элемент этой цепочки перестает работать, пользователь видит одну проблему: сервис недоступен. Поэтому современный мониторинг должен учитывать взаимосвязи между инфраструктурными объектами. Это позволяет перейти от технического контроля к управлению доступностью ИТ-сервисов.
Для руководителя ИТ-службы ценность мониторинга заключается не только в красивом дашборде. Правильно организованная система дает несколько практических преимуществ.
ИТ-директор получает возможность видеть состояние инфраструктуры распределенной организации из единой точки.
Система фиксирует отклонения автоматически, не дожидаясь обращения пользователя.
Специалист получает техническую информацию еще до начала полноценного расследования инцидента.
Контроль качества ИТ-услуг
Данные мониторинга можно использовать для анализа доступности сервисов и выполнения SLA.
Планирование развития инфраструктуры
Исторические показатели помогают определить, какие ресурсы постепенно приближаются к пределу возможностей.
Центральная ИТ-служба получает больше возможностей для удаленной диагностики филиалов.
Традиционный подход к поддержке выглядит следующим образом:
сбой → обращение пользователя → регистрация проблемы → диагностика → устранение.
Это реактивная модель.
При проактивном подходе цепочка меняется:
отклонение → автоматическое обнаружение → анализ → предупреждение проблемы → устранение.
Разница принципиальна.
Если система обнаружила рост загрузки диска или нестабильность канала связи до того, как пользователи столкнулись с последствиями, ИТ-служба получает возможность устранить проблему заранее.
Для распределенных организаций это особенно важно: профилактика часто обходится дешевле и быстрее, чем экстренное восстановление работы удаленного филиала.
Даже самая эффективная система мониторинга не заменяет процессы управления ИТ.
Она отвечает на вопрос:
«Что происходит с инфраструктурой?»
Но после обнаружения события необходимо определить:
Именно здесь появляется связь мониторинга с ITSM, ITAM и CMDB.
Получается единая цепочка:
мониторинг → событие → инцидент → актив/конфигурационная единица → ИТ-сервис → ответственный → устранение → аналитика.
Такой подход позволяет не просто получать технические уведомления, а использовать их для управления ИТ.
Предположим, система сообщает о недоступности сетевого устройства в одном из филиалов.
Само уведомление отвечает только на один вопрос: устройство недоступно.
Если же информация связана с CMDB, специалист может дополнительно увидеть:
Таким образом, контекст сокращает время диагностики.
Именно поэтому мониторинг и управление конфигурациями целесообразно рассматривать не как два изолированных процесса, а как взаимосвязанные элементы управления инфраструктурой.
Внедрение лучше начинать не с установки программного обеспечения, а с определения целей.
Составьте перечень площадок и инфраструктурных объектов.
Необходимо понимать:
Не все ИТ-компоненты одинаково важны.
Для каждого филиала стоит определить сервисы, простой которых напрямую влияет на работу сотрудников или клиентов.
Для каждого критичного сервиса необходимо понимать, от каких технических компонентов зависит его работа.
Это формирует основу для CMDB и анализа влияния.
Не стоит пытаться мониторить абсолютно все показатели. Избыточное количество метрик создает информационный шум и усложняет работу специалистов. Лучше выделить показатели, которые действительно помогают обнаруживать риски.
Важно определить:
Следующий этап — автоматическая передача значимых событий в процесс управления инцидентами. В результате специалистам не приходится вручную переносить информацию из одной системы в другую.
Проблема большого количества филиалов заключается в том, что система может генерировать тысячи событий. Если каждое из них превращается в отдельное уведомление, сотрудники быстро перестают воспринимать сообщения как действительно важные.
Поэтому необходимо разделять события по приоритету.
Критические — требуют немедленной реакции.
Предупреждения — свидетельствуют о потенциальной проблеме.
Информационные — сохраняются для истории и анализа.
Кроме того, важно учитывать взаимосвязи. Если один отказ вызывает десятки вторичных событий, специалист должен видеть первопричину, а не получать десятки одинаково приоритетных уведомлений.
После внедрения системы важно оценивать не количество собранных метрик, а бизнес-результат.
Полезными показателями могут быть:
Если мониторинг работает правильно, ИТ-служба постепенно должна тратить меньше времени на поиск проблемы и больше — на ее предупреждение и устранение первопричин.
Для компаний, которым необходимо не только мониторить инфраструктуру, но и выстроить комплексное управление ИТ, может использоваться продукт 1С:Итилиум.
Решение разработано на платформе «1С:Предприятие» с учетом практик ITIL и предназначено для автоматизации ITSM- и ESM-процессов. В числе возможностей — Service Desk, управление услугами, инцидентами, изменениями, знаниями и другими процессами.
Для распределенной организации особенно важна возможность выстроить взаимосвязь между обращениями, инфраструктурой и сервисами. В таком случае техническая информация становится частью единого процесса управления ИТ, а не остается изолированным набором показателей.
Подробнее о решении можно узнать на странице https://acomps.ru/products/1c-itilium/. На странице продукта также представлены интеграционные возможности, включая U-CONNECT.В распределенной инфраструктуре внедрение мониторинга редко сводится к установке одного программного продукта. Необходимо определить архитектуру решения, состав контролируемых объектов, правила обработки событий и взаимосвязи между инфраструктурой и ИТ-сервисами.
Актив Компьютерс специализируется разработке и внедрении проектов по автоматизации ИТ-процессов и учету ИТ-активов. Компания развивает экосистему ITIL+, объединяющую направления ITSM, SAM и ITAM на базе 1С и U-CONNECT. На сайте компании отдельно отмечен опыт внедрения решений в организациях с филиалами и различными системами учета и CMDB.
Поэтому сотрудничество с профильным интегратором может быть особенно полезно, когда инфраструктура уже сложилась, в разных филиалах используются различные системы, а данные необходимо объединить в единую модель управления.
Вместо подхода «поставить еще одну систему мониторинга» можно выстроить более комплексную архитектуру: от обнаружения инфраструктуры и учета активов до мониторинга, Service Desk, управления конфигурациями и анализа ИТ-сервисов.
Главное изменение происходит не в интерфейсе системы, а в самой модели работы ИТ-службы.
пользователь → проблема → обращение → поиск причины.
мониторинг → обнаружение отклонения → анализ влияния → профилактика или автоматическое создание инцидента.
При этом информация об инфраструктуре не теряется после закрытия инцидента. Она может использоваться для анализа повторяющихся проблем, планирования модернизации и оценки качества ИТ-сервисов.
Для небольшой компании отдельный инструмент мониторинга может решить большинство задач. Но по мере роста количества филиалов возникает потребность в более тесной интеграции процессов.
Зрелая модель управления может объединять:
Discovery → ITAM → CMDB → мониторинг → Service Desk → ITSM → аналитика.
Именно такая связность позволяет превратить разрозненную инфраструктуру филиалов в управляемую систему.
Мониторинг ИТ-инфраструктуры для распределенных филиалов — это не только контроль доступности серверов и сетевого оборудования.
Для крупной организации мониторинг должен стать частью единой системы управления ИТ, в которой связаны инфраструктура, активы, конфигурации, сервисы и процессы поддержки.
Наиболее эффективный подход предполагает:
Такой подход позволяет ИТ-службе перейти от постоянного реагирования на проблемы к проактивному управлению инфраструктурой.
А для бизнеса это означает более предсказуемую работу филиалов, сокращение времени простоев и более прозрачное управление ИТ-ресурсами.