Панель состояния и ежедневный контроль
Раздел веб-интерфейса: [Состояние системы → Обзор] Маршрут:
#dashboard/overview
Назначение
Панель состояния показывает текущее состояние системы: ход сбора писем, нагрузку на сервер, состояние поиска и фоновых задач, а также результат автоматической проверки работоспособности компонентов. Раздел предназначен для администратора.
Как открыть панель состояния
- В меню слева выберите [Состояние системы → Обзор]. Либо нажмите ссылку [Клавдий] в хлебных крошках вверху любой страницы.
- Панель состояния откроется в содержимом страницы.
{{СКРИНШОТ}}
Из чего состоит панель состояния
Панель состояния содержит плитки ключевых показателей и блоки:
- Плитки KPI: Активные задачи, Задач в очереди, SMTP: писем/мин, Ошибок (за 1 ч), Архивировано/мин.
- Статус задач — таблица фоновых задач с бейджем «В реальном времени». Колонки: Задача, Статус, Прогресс, Ошибки.
- Объём писем (вкладка) — объёмы по почтовым ящикам. Колонки: Почтовый ящик, Писем, Вложений, Объём до дедуп., Объём после дедуп. Показаны только ящики локальных доменов.
- SMTP-серверы — состояние приёмников почты: IP или сеть, статус, порт, ошибки.
- Системные метрики — таблица компонентов со значениями за последний час. Обновляется примерно раз в минуту.
- Самопроверка — проверка работоспособности компонентов с общим статусом.
- График импорта — динамика поступления писем (писем в минуту) и ошибок.
{{СКРИНШОТ}}
Как проверить, что система в порядке
- Откройте панель состояния [Обзор].
- Посмотрите общий статус блока [Самопроверка]:
-
ok— всё в порядке; -
warn— есть предупреждения, нужно разобраться; -
fail— что-то неработоспособно, требует действий.
-
- Если статус не
ok, найдите строку с проблемой в таблице [Системные метрики] или в списке компонентов самопроверки и действуйте по таблице ниже.
Системные метрики
Таблица содержит строки по компонентам и видам активности за последний час:
| Строка | Содержание |
|---|---|
| База данных (PostgreSQL) | подключений N (свободно X из Y, лимит Z); «недоступен» при сбое |
| SMTP-сервер (приём почты) | обработано, ошибок, в очереди, скорость (писем/мин); «неактивен» при сбое |
| Полнотекстовый поиск (Solr) | «доступен, версия N» либо «не настроен или недоступен». Для кластера SolrCloud — состояние кластера: число инстансов, активных и проблемных реплик, размер индекса, число документов |
| Очередь оповещений | писем в очереди (ожидает отправки); предупреждение при значении более 100 |
| Архивация (за час) | писем, ошибок, вложений, объём |
| Массовый сбор (за час) | ящиков обработано, ошибок |
| Приём SMTP (за час) | получено, отклонено, получателей принято и отклонено |
| Доступ по IMAP (за час) | подключений, поиск (Solr и в памяти), выборка, успешных и неуспешных входов |
| Индексация писем | проиндексировано, ошибок, в очереди (предупреждение при значении более 1000) |
| Оповещения (за час) | отправлено, ошибок |
| Планировщик задач | выполняется, с ошибками, зависших |
| Безопасность (за час) | успешных и неуспешных входов, отказов в доступе |
| Подключения к БД (за час) | выдано соединений, неудачных |
| Ресурсы узла | загрузка CPU (%), load average (1/5/15), память (использовано/лимит/кеш), swap, IOPS (чтение/запись), место на диске по точкам монтирования |
Ресурсы узла (CPU/память/swap/IOPS/диск) собираются каждые 30 секунд для каждого узла кластера. Метрики читаются из cgroup v2 (корректно per-pod в Kubernetes и per-container в Docker — с учётом лимитов ресурсов), при недоступности cgroupv2 — из
/proc(метрики хоста, корректно для standalone(!) и Docker на выделенной машине). Моментные значения отображаются на странице [Кластер → Узлы кластера] (в карточке узла), усреднённые за час/день — в исторических рядах. Точки монтирования для дисковых метрик задаются переменной окруженияKLVD_DISK_MOUNTS(через запятую; по умолчанию/и/var/klvd). См. Кластер и узлы.
Самопроверка
Блок [Самопроверка] проверяет ключевые компоненты:
| Компонент | Что проверяется |
|---|---|
| PostgreSQL | доступность базы |
| Полнотекстовый поиск (Solr) | доступность поиска |
| SMTP-сервер | включён ли приёмник |
| Планировщик | есть ли задачи с ошибками и зависшие задачи |
| Очередь оповещений | количество писем в очереди |
{{СКРИНШОТ}}
Как посмотреть объём писем по ящикам
- Откройте панель состояния [Обзор].
- Переключитесь на вкладку [Объём писем].
- Посмотрите колонки по каждому ящику:
- Объём до дедуп. — суммарный размер тел писем и вложений ящика.
- Объём после дедуп. — объём за вычетом дубликатов вложений (одинаковые вложения хранятся в одном экземпляре).
Показаны только ящики локальных доменов организации (см. Установка → Общие настройки → Политики отображения и домены).
Как отреагировать на предупреждение
Если на панели состояния появились предупреждения, действуйте по алгоритму:
- Определите, о каком компоненте предупреждение (в блоке [Самопроверка] — статус, в [Системных метриках] — строка).
- Найдите компонент в таблице ниже.
- Выполните действие.
| Предупреждение | Что делать |
|---|---|
| Индексация: большое отставание | Поиск не успевает индексировать письма. Проверьте службу поиска — см. Поиск и администрирование Solr. |
| Планировщик: ошибки или зависшие задачи | Откройте Задачи и очередь и остановите или перезапустите проблемную задачу. |
| PostgreSQL: fail | Проверьте состояние базы — см. База данных. |
| Solr: fail | Проверьте службу поиска — см. Поиск и администрирование Solr. |
| Очередь оповещений растёт | Проверьте SMTP-сервер для оповещений — см. Установка → Общие настройки → Оповещения. |
Примечания
- Метрики за последний час показываются с детализацией до минуты. Долгосрочная история (тренды за месяцы и годы) хранится в агрегированном виде. См. База данных, раздел [Хранение метрик].
См. также
Что дальше
Навигация по книге
- Следующая статья: Очередь задач