Мониторинг Эллес

Сервис metrics_manager в составе Эллес реализует подсистему мониторинга, агрегируя метрики непосредственно из внутренних компонентов системы в реальном времени и предоставляя их в виде иерархической структуры LDAP-объектов в контейнере CN=Monitoring.

Эта структура организована по логическим группам, каждая из которых отражает определенный аспект работы контроллера домена и доступна для сбора через стандартные LDAP-запросы:

CN=Monitoring
 ├── CN=HealthCheck (1)
 │    └── CN=<имя процесса>
 ├── CN=DNS (2)
 ├── CN=Replication (3)
 │    ├── CN=Partitions
 │    │    └── CN=<имя партиции>
 │    │         └──CN=<имя партнера>
 │    ├── CN=Connections
 │    │    └──CN=<имя соединения>
 │    └── CN=<имя партнера>
 ├── CN=SambaDNSUpdate (4)
 ├── CN=LDAPOperations (5)
 ├── CN=KDCOperations (6)
 ├── CN=DBOperations (7)
 │    └── CN=<имя партиции>
 ├── CN=TDO (8)
 ├── CN=Controller (9)
 ├── CN=Auth (10)
 ├── CN=Accounts (11)
 └── CN=GPOperations (12)
1 Метрики работоспособности процессов  — отслеживают состояние всех запущенных служб Эллес (KDC, LDAP, SMB, DNS, KCC и др.) через атрибуты PID и статус, формируемые непосредственно в процессах-демонах, позволяют выявлять аварийные остановки, зависания или некорректные состояния критических сервисов.
2 Метрики DNS  — предоставляют информацию о количестве обслуживаемых DNS-зон и общем объеме запросов, собираемых как с внутреннего DNS-сервера Эллес, так и с внешнего BIND9 через плагин DLZ;
3 Метрики репликации  — генерируются службой KCC и сервисом drepl, отражают состояние топологии репликации, количество успешных/неудачных попыток репликации между контроллерами домена, доступность партнеров по репликации и статус роли Intersite Topology Generator (ISTG);
4 Метрики samba_dnsupdate  — фиксируют частоту, длительность и результаты выполнения скрипта автоматического обновления DNS-записей, используемого для синхронизации записей между контроллерами домена; источник — выходные коды и временные метки процесса samba_dnsupdate.
5 Метрики производительности LDAP  — собираются сервером LDAP и отражают количество и длительность операций bind, search, modify, включая ошибки.
6 Метрики производительности KDC  — отслеживают количество и время выполнения запросов Kerberos AS-REQ и TGS-REQ, а также проксированных запросов RODC.
7 Метрики базы данных (LMDB)  — извлекаются непосредственно из внутренней структуры базы данных LMDB, включая статистику по страницам, глубине дерева, использованию памяти и транзакциям; позволяют оценивать нагрузку на базу данных, фрагментацию и эффективность использования ресурсов.
8 Метрики периодических задач  — отслеживают выполнение фоновых задач (например, очистка, обновление кэшей, проверка целостности), собирая данные о запланированных, выполненных и завершившихся с ошибками запусках из внутреннего планировщика mt.
9 Метрики функций контроллера домена  — отражают распределение ролей контроллера домена (GC, RODC), включая текущего носителя роли ISTG.
10 Метрики аутентификации  — фиксируют количество успешных и неудачных попыток аутентификации по протоколам Kerberos и NTLM, а также общее число аутентификаций пользователей и компьютеров.
11 Метрики учетных записей  — отслеживают изменения паролей (пользовательских, компьютерных, gMSA), блокировки учетных записей и истечение сроков действия паролей.
12 Метрики по групповым политикам  — регистрируют количество созданных и примененных GPO.

Все метрики доступны через отдельный LDAP-порт (по умолчанию 3070), на котором работает сервис metrics_manager. Получение метрик осуществляется посредством LDAP-запросов; прямой доступ к файловой системе или базе данных не требуется.