В компаниях обычно есть Zabbix — система, которая круглосуточно следит за работой серверов, сетевого оборудования и другого IT-оборудования. Если что-то «упало» или перестало отвечать, Zabbix фиксирует сбой.
Раньше эту информацию видели только сотрудники ИБ и IT-администраторы. Риск-менеджеры и контролеры узнавали о простоях постфактум — из разговоров или когда проблемы уже отражались на бизнесе.
Теперь, благодаря интеграции, данные о любом сбое автоматически попадают в ТАБ GRC. Это значит, что риск-менеджеры и контролеры начинают видеть технические инциденты в едином контуре управления рисками, как любые другие операционные события — с привязкой к процессам, ответственным и мероприятиям.
Интеграция работает так:
-
В Zabbix возникает инцидент (например, сервер не отвечает на ping).
-
Zabbix отправляет данные в ТАБ GRC через защищенный веб-сервис.
-
В ТАБ GRC автоматически:
-
регистрируется время простоя узла (оборудования);
-
создается сообщение о риске;
-
фиксируется временная метка начала и окончания сбоя.
В результате у компании появляется объективная история всех технических отказов с привязкой к конкретным устройствам, времени и длительности простоя.
Ценность для клиента
Раньше:
Технические сбои были «внутренним делом» IT-службы. Риск-менеджеры не видели их системно и не учитывали при оценке операционных рисков. Простои не анализировались с точки зрения их влияния на бизнес-процессы и потери.
Теперь:
Любой отказ оборудования автоматически становится частью системы управления рисками. Компания получает:
-
Прозрачность — риск-менеджеры и контролеры видят сбои наравне с другими рисковыми событиями.
-
Объективную статистику простоев — время отключения и восстановления фиксируется автоматически, без человеческого фактора.
-
Единую базу инцидентов — технические сбои теперь связаны с бизнес-процессами, мероприятиями и ответственными.
-
Контроль операционной надежности — система автоматически рассчитывает время простоя и долю деградации для отчетности по требованиям ЦБ (850-П, 779-П).
Главный эффект:
Компания перестает «терять» технические инциденты. Они становятся частью общей картины рисков, что позволяет быстрее реагировать, предотвращать повторные сбои и снижать потери от простоев.
Пользовательский сценарий
Сценарий: контроль доступности узлов и реагирование на сбои
-
В Zabbix возникает событие — например, перестал отвечать один из ключевых серверов в дата-центре.
-
Событие автоматически передается в ТАБ GRC.
-
В системе регистрируется сообщение о риске с указанием:
-
имени узла (оборудования);
-
времени начала и окончания сбоя;
-
длительности простоя.
-
Риск-менеджер видит это событие в общем реестре инцидентов. Он оценивает влияние на бизнес-процессы и при необходимости инициирует мероприятия по устранению причин или предотвращению повторения.
-
Контролер (СВК) использует данные о простоях для оценки эффективности IT-служб и проверки выполнения регламентов по обслуживанию.
-
Руководитель получает консолидированную отчетность по простоям оборудования — в дашбордах по операционной надежности.
