Диагностика изолированного кластера

Если кластер скрыт за сетевыми барьерами, прямой мониторинг его состояния невозможен. В таком случае для выявления проблем во внутренней среде кластера можно применять механизм сохранения его состояния в файл.

Сбор диагностической информации

Для сбора диагностической информации используйте команду:

ydb [global options...] admin cluster diagnostics collect \
  --duration 200 \
  --period 15 \
  --output diagnostics.tar

Параметры команды

  • --duration — количество секунд, в течение которых будет собираться информация о кластере.
  • --period — интервал в секундах между сборами метрик.
  • --output — путь и имя файла в формате .tar, в который будет записана вся собранная информация о кластере.
  • --no-sanitize — позволяет получить полный отчёт, отключая очистку от пользовательских имён таблиц, колонок и запросов (которые по умолчанию вырезаются).

Команда записывает в указанный файл внутреннее состояние узлов кластера на протяжении заданного времени. Каждые period секунд производится сбор метрик с каждого узла кластера и запись в файл.

Содержимое архива

Полученный файл является архивом и содержит:

  • Метрики, собранные с узлов кластера.
  • Информацию о кластере.

Все данные записаны в формате JSON в человекочитаемом виде.

Информация о кластере

Информация о кластере включает:

  • Отчет Health Check.
  • Запросы к таблицам раздела кластера /Root/.sys и их ответы.
  • Текущую конфигурацию подсистем кластера.
  • Текущее состояние узлов кластера.