Перейти к основному контенту

Панель состояния и ежедневный контроль

Раздел веб-интерфейса: [Состояние системы → Обзор] Маршрут: #dashboard/overview

Назначение

Панель состояния показывает текущее состояние системы: ход сбора писем, нагрузку на сервер, состояние поиска и фоновых задач, а также результат автоматической проверки работоспособности компонентов. Раздел предназначен для администратора.

Как открыть панель состояния

  1. В меню слева выберите [Состояние системы → Обзор]. Либо нажмите ссылку [Клавдий] в хлебных крошках вверху любой страницы.
  2. Панель состояния откроется в содержимом страницы.

{{СКРИНШОТ}}

Из чего состоит панель состояния

Панель состояния содержит плитки ключевых показателей и блоки:

  • Плитки KPI: Активные задачи, Задач в очереди, SMTP: писем/мин, Ошибок (за 1 ч), Архивировано/мин.
  • Статус задач — таблица фоновых задач с бейджем «В реальном времени». Колонки: Задача, Статус, Прогресс, Ошибки.
  • Объём писем (вкладка) — объёмы по почтовым ящикам. Колонки: Почтовый ящик, Писем, Вложений, Объём до дедуп., Объём после дедуп. Показаны только ящики локальных доменов.
  • SMTP-серверы — состояние приёмников почты: IP или сеть, статус, порт, ошибки.
  • Системные метрики — таблица компонентов со значениями за последний час. Обновляется примерно раз в минуту.
  • Самопроверка — проверка работоспособности компонентов с общим статусом.
  • График импорта — динамика поступления писем (писем в минуту) и ошибок.

{{СКРИНШОТ}}

Как проверить, что система в порядке

  1. Откройте панель состояния [Обзор].
  2. Посмотрите общий статус блока [Самопроверка]:
    • ok — всё в порядке;
    • warn — есть предупреждения, нужно разобраться;
    • fail — что-то неработоспособно, требует действий.
  3. Если статус не ok, найдите строку с проблемой в таблице [Системные метрики] или в списке компонентов самопроверки и действуйте по таблице ниже.

Системные метрики

Таблица содержит строки по компонентам и видам активности за последний час:

Строка Содержание
База данных (PostgreSQL) подключений N (свободно X из Y, лимит Z); «недоступен» при сбое
SMTP-сервер (приём почты) обработано, ошибок, в очереди, скорость (писем/мин); «неактивен» при сбое
Полнотекстовый поиск (Solr) «доступен, версия N» либо «не настроен или недоступен». Для кластера SolrCloud — состояние кластера: число инстансов, активных и проблемных реплик, размер индекса, число документов
Очередь оповещений писем в очереди (ожидает отправки); предупреждение при значении более 100
Архивация (за час) писем, ошибок, вложений, объём
Массовый сбор (за час) ящиков обработано, ошибок
Приём SMTP (за час) получено, отклонено, получателей принято и отклонено
Доступ по IMAP (за час) подключений, поиск (Solr и в памяти), выборка, успешных и неуспешных входов
Индексация писем проиндексировано, ошибок, в очереди (предупреждение при значении более 1000)
Оповещения (за час) отправлено, ошибок
Планировщик задач выполняется, с ошибками, зависших
Безопасность (за час) успешных и неуспешных входов, отказов в доступе
Подключения к БД (за час) выдано соединений, неудачных
Ресурсы узла загрузка CPU (%), load average (1/5/15), память (использовано/лимит/кеш), swap, IOPS (чтение/запись), место на диске по точкам монтирования

Ресурсы узла (CPU/память/swap/IOPS/диск) собираются каждые 30 секунд для каждого узла кластера. Метрики читаются из cgroup v2 (корректно per-pod в Kubernetes и per-container в Docker — с учётом лимитов ресурсов), при недоступности cgroupv2 — из /proc (метрики хоста, корректно для standalone(!) и Docker на выделенной машине). Моментные значения отображаются на странице [Кластер → Узлы кластера] (в карточке узла), усреднённые за час/день — в исторических рядах. Точки монтирования для дисковых метрик задаются переменной окружения KLVD_DISK_MOUNTS (через запятую; по умолчанию / и /var/klvd). См. Кластер и узлы.

Самопроверка

Блок [Самопроверка] проверяет ключевые компоненты:

Компонент Что проверяется
PostgreSQL доступность базы
Полнотекстовый поиск (Solr) доступность поиска
SMTP-сервер включён ли приёмник
Планировщик есть ли задачи с ошибками и зависшие задачи
Очередь оповещений количество писем в очереди

{{СКРИНШОТ}}

Как посмотреть объём писем по ящикам

  1. Откройте панель состояния [Обзор].
  2. Переключитесь на вкладку [Объём писем].
  3. Посмотрите колонки по каждому ящику:
    • Объём до дедуп. — суммарный размер тел писем и вложений ящика.
    • Объём после дедуп. — объём за вычетом дубликатов вложений (одинаковые вложения хранятся в одном экземпляре).

Показаны только ящики локальных доменов организации (см. Установка → Общие настройки → Политики отображения и домены).

Как отреагировать на предупреждение

Если на панели состояния появились предупреждения, действуйте по алгоритму:

  1. Определите, о каком компоненте предупреждение (в блоке [Самопроверка] — статус, в [Системных метриках] — строка).
  2. Найдите компонент в таблице ниже.
  3. Выполните действие.
Предупреждение Что делать
Индексация: большое отставание Поиск не успевает индексировать письма. Проверьте службу поиска — см. Поиск и администрирование Solr.
Планировщик: ошибки или зависшие задачи Откройте Задачи и очередь и остановите или перезапустите проблемную задачу.
PostgreSQL: fail Проверьте состояние базы — см. База данных.
Solr: fail Проверьте службу поиска — см. Поиск и администрирование Solr.
Очередь оповещений растёт Проверьте SMTP-сервер для оповещений — см. Установка → Общие настройки → Оповещения.

Примечания

  • Метрики за последний час показываются с детализацией до минуты. Долгосрочная история (тренды за месяцы и годы) хранится в агрегированном виде. См. База данных, раздел [Хранение метрик].

См. также

Что дальше

Навигация по книге