Установка подсистемы мониторинга

Используйте в качестве управляющего узел, который будет использоваться для управления подсистемой мониторинга.

Системные требования

Системные требования к подсистеме мониторинга зависят от выбранной конфигурации развёртывания входящих в неё компонентов.

CPU и RAM

Рекомендуемое количество ядер CPU и оперативной памяти для различных компонентов подсистемы мониторинга:

Компонент Кол-во ядер CPU ГБ RAM

Сервер (все компоненты на одном узле)

≥ 8

≥ 32

Прокси

≥ 2

≥ 16

Агент

≥ 1

≥ 4

Хранилище

Подсистема мониторинга предъявляет следующие требования к хранилищу:

  • Сервер — в зависимости от количества ПАК в контуре и требуемой глубины хранения метрики, но не менее 600 ГБ SSD на корневой (root, /) раздел.

  • Прокси — в зависимости от требуемой глубины кеширования данных, но не менее 20 ГБ SSD.

  • Агент — в зависимости от требуемой глубины кеширования данных, но не менее 5 ГБ SSD.

Для определения необходимого размера хранилища:

  1. Определите количество активных временных рядов:

    N = (5 + 13 × Nm + 7 × Nh + 9 × Nc) * 1000

    Здесь:

    • Nm — количество ПАК в контуре;

    • Nh — количество серверов в контуре;

    • Nc — количество коммутаторов в контуре.

  2. Рассчитайте размер хранилища в байтах:

    S = 1.2 * N * 2304 * d

    Здесь:

    • N — количество активных временных рядов;

    • 2304 — количество байтов, необходимых для хранения точек одного временного ряда при интервале между снятием метрик, равном 15 секундам;

    • d — срок хранения данных в днях.

Операционные системы

Если подсистема мониторинга развёртывается на одном узле, он должен работать под управлением одной из ОС:

  • Альт Сервер 8 СП р9;

  • Альт Сервер 8 СП р10;

  • Альт Сервер 10.*;

  • РЕД ОС 7.3 Муром;

  • РЕД ОС 8.0 Сервер;

  • Astra Linux Special Edition 1.7.3, режим защищённости «Воронеж»;

  • Astra Linux Special Edition 1.8, режим защищённости «Воронеж» — только агенты на узлах.

Если подсистема мониторинга развёртывается в отказоустойчивой конфигурации:

  • узел управления и узлы ядра должны работать под управлением Альт Сервер c10f2;

  • прочие узлы должны работать под управлением Альт Сервер c10f1 или Альт Сервер c10f2.

Служебная БД

Служебная БД подсистемы мониторинга может храниться в СУБД PostgreSQL, развёрнутой средствами дистрибутива, или во внешней СУБД, например, в одном из облачных сервисов управляемых баз данных.

Таблица 1. Минимальные версии PostgreSQL, развёрнутой средствами Геном
ОС Версия PostgreSQL

Альт Сервер СП c9f2

14

Альт Сервер СП c10f1

15

Альт Сервер c10f2

16

16 Pro

Альт Сервер 10.* (p10)

16

РЕД ОС 7.3 Муром

16

РЕД ОС 8.0 Сервер

16

16 Pro

Astra Linux Special Edition 1.7.3

11

Использование Postgres Pro

Дистрибутив подсистемы мониторинга позволяет использовать Postgres Pro 16 в ОС Альт Сервер СП p10 (c10f2) и РЕД ОС 8.0. При этом:

  • Лицензия на Postgres Pro не входит в состав Геном и приобретается отдельно.

  • В дистрибутиве предусмотрена миграция с сохранением данных с обычной версии PostgreSQL на Postgres Pro 16. Переход с Postgres Pro обратно на обычную версию PostgreSQL невозможен.

Если планируется использование Postgres Pro, перед обновлением создайте резервные копии БД.

Для внешнего сервера PostgreSQL минимально допустимая версия СУБД — 11, рекомендуемая — 18.1.

Отказоусточивость

Если компоненты подсистемы мониторинга развёртываются в отказоусточивых конфигурациях, к окружению предъявляются дополнительные требования:

  • Все узлы должны размещаться в одной и той же подсети */24.

  • Для работы некоторых сервисов понадобятся виртуальные IP-адреса, VIP. Зарезервируйте для VIP несколько адресов в той же подсети, в которой размещены узлы.

  • На узлах должны быть подключены и доступны актуальные репозитории системных пакетов.

Примечания

Основной потребитель ресурсов на стороне сервера подсистемы мониторинга — VictoriaMetrics.

Оценка требований к ресурсам (при периоде извлечения данных каждые 15 секунд для всех временных рядов):

  • 1 ГБ ОЗУ на 1 млн активных временных рядов;

  • 1 ядро CPU на каждые 300 000 вставленных точек данных в секунду;

  • менее байта на точку данных (среднем 0.2-0.5 Б/точка);

  • входящий трафик 100 байт на каждую принятую точку данных;

  • на долю служебных метрик самого мониторинга приходится около 7 000 временных рядов.

Пример 1. Расчёт для ПАК МХД.О

На не нагруженном стенде из 4-х узлов хранения и 2-х балансировщиков получается порядка 30 000 активных временных рядов. Это примерно соответствует 120 Кб на одну точку времени или 700 Мб в сутки при извлечении данных каждые 15 секунд для всех временных рядов.

Данные оценки носят приблизительный характер и могут меняться в обе стороны.

Подготовка управляющего узла

  1. Убедитесь в доступности узлов ПАК и узлов для развёртывания компонентов подсистемы мониторинга с управляющего узла.

    Используйте для этого утилиту ping. Если в выводе команды ping содержатся ошибки, убедитесь в том, что:

    • инсталляционная карта содержит корректные данные;

    • обеспечена сетевая связность между узлами;

    • файрвол не блокирует доступ по протоколу SSH через порт 22.

  2. Установите пакет ansible версии 2.9 или более новый.

  3. Если при подключении к управляемым узлам по SSH используется авторизация по имени пользователя и паролю, установите пакет sshpass.

  4. Скопируйте на управляющий узел архивы vision-distrib-1.11.1-1187.tar.gz и ansible-ha-victoria-cluster-37.tar.gz. Последний необходим в том случае, когда будет развёрнут в отказоустойчивой конфигурации хотя бы один из компонентов подсистемы мониторинга:

    • ядро;

    • VictoriaLogs;

    • VictoriaMetrics.