Задача · Инфраструктура
Мониторинг серверов, рабочих мест и сети — с инцидентами сразу в сервис-деске
Агенты на Windows и Linux, проверки доступности и SNMP v1–v3 (опрос сетевых устройств) собирают состояние серверов, рабочих мест и сетевого оборудования в одном дереве по площадкам и папкам. Пороги задаются на папке или на узле, а превышение открывает инцидент в сервис-деске (ITSM) — в той же очереди, где работает поддержка, с узлом, услугой и приоритетом. Когда падает целая подсеть, инциденты собираются в одну проблему.

Что получаете
Мониторинг — без отдельной системы
Узлы, пороги, инциденты и бизнес-сервисы живут в том же продукте, что заявки, учёт активов (CMDB, ITAM) и удалённый доступ. Всё ниже работает сразу после установки INFRAX и входит в любую редакцию, включая бесплатную.
Агенты для Windows и Linux
Процессор, память, диски, сеть и процессы. Сборки для x64, ARM и отдельная — для Windows 7 и Server 2008 R2; ставятся из интерфейса на один узел или на целую папку.
Сеть и сервисы без агента
Ping-проверка доступности и времени отклика для любого узла, SNMP v1, v2c и v3 для коммутаторов, маршрутизаторов, ИБП и хранилищ, контроль срока SSL-сертификатов веб-сервисов.
Пороги на папке и на узле
Предупреждение и критический уровень задаются на папке и наследуются вниз; у узла и у отдельного диска могут быть свои. Пороги видны линиями на графиках, а полосы загрузки процессора, памяти и дисков окрашиваются по ним же.
Инцидент без ручной передачи
Превышение после нескольких проверок подряд открывает инцидент в сервис-деске с узлом, услугой и приоритетом. Когда показатель вернулся в норму, инцидент без исполнителя закрывается сам.
Крупный сбой — одна проблема
Пять алгоритмов собирают связанные инциденты в проблему: недоступность нескольких узлов одной сети, неустановленные и пропавшие агенты, нестабильный сигнал, перегрузку ресурсов узла. Диагноз ставит инженер.
Бизнес-сервисы
Сервис собирается из узлов, на которых держится услуга, и показывает «Норма», «Предупреждение» или «Проблемы» по их открытым инцидентам. В инциденте видно, какой сервис затронут.
Как это работает
На реальных экранах
Демонстрационный стенд INFRAX 2.0: вымышленная компания «Северный склад», офис в Москве и площадки в Казани и Твери. Экраны — глазами инженера по инфраструктуре Павла Орлова.
Агенты: Windows, Linux, ARM и Windows 7
Агент ставится из режима «Управление агентами» на один узел или сразу на отмеченные: на Windows — по учётной записи администратора через общий доступ к файлам (SMB), на Linux — по протоколу удалённого доступа SSH. Если автоматическая установка невозможна, сборку для нужной платформы скачивают в окне ручной установки; для Windows 7 и Server 2008 R2 есть отдельная сборка. В списке видно, где агент устарел, где его нет и какой не отвечал больше 10 минут.
- Windows x64, ARM64 и сборка для Windows 7
- Linux amd64, 386, arm64 и arm
- Установка, обновление и удаление — массово

Сетевое оборудование по SNMP
Для коммутатора, маршрутизатора, ИБП или хранилища задаются версия SNMP и учётные данные — обычно один раз на папке, устройства внутри её наследуют. Что опрашивать, определяет шаблон устройства: метрики, таблицы, формулы и пороги; один шаблон назначается всем однотипным устройствам, а пробный сбор проверяет его без записи в историю. Если готового шаблона нет, кнопка «Настроить с ИИ-помощником» открывает мастер: помощник опрашивает само устройство, сопоставляет ответы с описаниями MIB и собирает шаблон с метриками, расчётными показателями и порогами. Помощник работает через облачный сервис производителя INFRAX Cloud или — с модулем «Локальная модель ИИ» — на языковой модели, развёрнутой на вашем сервере. Готовый шаблон инженер проверяет пробным сбором и назначает устройствам.
- SNMP v3 с аутентификацией и шифрованием
- Браузер OID и SNMP Walk
- Шаблоны переносятся между установками в JSON
- Подробнее об ИИ-помощнике

Автообнаружение и проверка доступности
Мастер настройки создаёт сеть, сканирует её и заводит найденные устройства в нужный проект и папку. План адресов показывает каждый адрес подсети: заведён ли он узлом, найден сканированием, отложен или свободен, какая на нём ОС и какие порты открыты. Любой узел, даже без агента, сразу проверяется по ping — с временем отклика и таблицей периодов недоступности.
- Ping, проверка портов, имена через DNS
- Автоматическое пересканирование сети
- Сети филиалов сканирует шлюз площадки

Пороги и инциденты в сервис-деске
Пороги процессора, памяти и дисков задаются на папке и наследуются: по умолчанию для процессора предупреждение — 70 %, критический уровень — 90 %, инцидент — после трёх превышений подряд. У отдельного диска может быть свой лимит, и инцидент заводится по каждому диску отдельно. Инцидент приходит в общую очередь с узлом, услугой, приоритетом и подробностями замера, а после возврата в норму инцидент без исполнителя закрывается сам.
- Подключение к узлу прямо из инцидента
- Узлы, которые выключают на ночь, — без инцидентов
- История изменений порогов: кто, когда и что поменял

Бизнес-сервисы
Бизнес-сервис — набор узлов, на которых держится услуга: для склада это сервер складской системы WMS, сервер терминалов сбора данных (ТСД), коммутатор и оба шлюза площадки. Здоровье сервиса считается по открытым инцидентам мониторинга на его узлах и одинаково показывается в списке сервисов и на дашборде «Мониторинг». В карточке инцидента видно затронутый сервис, а в карточке сервиса — все его открытые инциденты.
- Роль каждого узла — в комментарии
- Один узел может входить в несколько сервисов
- «Норма», «Предупреждение», «Проблемы»
- ИИ-помощник в инциденте знает состав затронутого сервиса и роли узлов

Кейсы
Кейсы с этой задачей
Типовые ситуации ИТ-службы: что происходит, как это решается в INFRAX по шагам и что в итоге получаете. Все кейсы — на странице «Кейсы».

Крупный сбой: от сигнала мониторинга до ответа всем заявителям
Три сервера одной сети перестают отвечать, сотрудники пишут в поддержку. Инциденты собираются в одну проблему, обращения добавляются в её состав, а заявители получают один ответ.
МониторингСервис-деск ITSMУдалённый доступ с записью PAMАналитика и отчётность BIРазобрать по шагам
Портал заказов: запуск, сбой, обновление и вывод сервиса
У внутреннего портала заказов общий пароль, а о его сбоях ИТ узнаёт от склада. За два года портал получает единый вход, проверку ответа по расписанию, написанную с ИИ-помощником, обновление по согласованию с записью работ подрядчика и вывод без забытых прав.
Вход и права IAM · SSOМониторингСервис-деск ITSMАвтоматизация и бэкапПортал и процессы ESM · BPMУдалённый доступ с записью PAMРазобрать по шагам
Не проводится выписка в 1С: заявка, инструкция и сервер под рукой
Главный бухгалтер не может провести выписку. Инженер видит в заявке переписку, находит инструкцию в базе знаний, связи сервера 1С и его нагрузку.
Сервис-деск ITSMЗнания и файлы KBУчёт активов CMDB · ITAMМониторингРазобрать по шагамВ том же продукте
С этой задачей уже работают
Соседние задачи не нужно покупать и подключать: у них общие узлы, пользователи, права и заявки.
Сервис-деск ITSM
Инциденты мониторинга приходят в общую очередь с узлом и услугой; одновременные сбои одной сети собираются в проблему, и заявителям отвечают одним сообщением.
Страница задачиИнфраструктураФилиалы
Узлы филиала опрашивает шлюз площадки изнутри её сети; если пропала связь с площадкой, заводится один инцидент, а не по инциденту на каждый узел.
Страница задачиИнфраструктураУчёт активов CMDB · ITAM
Узел связан с активом: кнопка «Актив» в карточке узла ведёт к владельцу, договору и связям.
Страница задачиДоступ и безопасностьУдалённый доступ с записью PAM
Из карточки узла и из инцидента инженер подключается по SSH или RDP по своим правам; сеанс записывается.
Страница задачиИнфраструктураАвтоматизация и бэкап
По тем же узлам запускаются скрипты и задания планировщика; сбой задания или нужная строка в его выводе по настройке открывают инцидент.
Страница задачиКонтрольАналитика и отчётность BI
Готовый дашборд «Мониторинг» показывает статус узлов, бизнес-сервисы, активные проблемы и самые нагруженные узлы.
Страница задачи
Крупный сбой — одна проблема, а не десятки карточек
Когда несколько серверов одной подсети почти одновременно перестают отвечать, система сама заводит проблему и складывает в неё инциденты, а инженер подтверждает или сужает состав. В проблеме видно, какие узлы затронуты и сколько инцидентов по каждому ещё открыто.
Технические сведения
Для версии 2.0
- Сбор данных
- Агент: процессор, память, диски, сеть, процессы; ping; SNMP v1, v2c, v3; проверка SSL-сертификатов HTTPS-сервисов
- Агент
- Windows x64, ARM64, отдельная сборка для Windows 7 и Server 2008 R2; Linux amd64, 386, arm64, arm; порт 4151
- Пороги по умолчанию
- Процессор 70 / 90 %, память 75 / 90 %, диск 80 / 95 %, SSL — 14 и 3 дня до окончания, доступность — 3 неудачные проверки
- Реакция
- Инцидент в сервис-деске, автозакрытие инцидента без исполнителя; 5 алгоритмов проблем и общий сбой сети
- SNMP
- Шаблоны с метриками, таблицами, формулами и порогами; пробный сбор, браузер OID, SNMP Walk, импорт и экспорт JSON
- Обнаружение
- Ping, порты, DNS; сканирование сетей до /22 (1024 адреса); сети площадок — через их шлюзы
- Где видно
- Карточка узла, список бизнес-сервисов, дашборд «Мониторинг» в разделе аналитики
Вопросы
Частые вопросы
Нужен ли агент на каждом узле?
Нет. Доступность по ping и срок SSL-сертификата проверяются без агента, сетевое оборудование опрашивается по SNMP. Агент нужен там, где важны процессор, память, диски, сеть и процессы, а также для скриптов и файлового менеджера.
Можно ли наблюдать за узлами в филиале без VPN?
Да. В сети филиала ставится шлюз площадки, который сам подключается к серверу INFRAX, — входящие порты в филиале не открывают. Проверку доступности, сканирование и подключения шлюз выполняет изнутри сети филиала, а время отклика меряет рядом с узлом. Подробнее — на странице «Филиалы».
Что будет с инцидентом, если сбой прошёл сам?
Если у инцидента нет исполнителя, он закрывается сам, когда показатель вернулся в норму; для доступности — после того же числа успешных проверок подряд, после которого был открыт. Если исполнитель уже назначен, инцидент остаётся за человеком: в него приходит сообщение о восстановлении, а закрывает его инженер.
Как не получать инциденты по машинам, которые выключают на ночь?
Выключите «Создавать инцидент» на узле или на папке — параметр наследуется. Недоступность таких узлов в дереве показывается приглушённо и не попадает в счётчик недоступных узлов папки.
Принимает ли INFRAX SNMP-трапы и syslog?
Нет: состояние сетевых устройств INFRAX получает опросом по SNMP по шаблону устройства. Пороги задаются в шаблоне и проверяются по текущему значению, по среднему из трёх замеров или по трём превышениям подряд.