Расширение Ceph storage
Осуществляйте мониторинг использования распределенного хранилища Ceph, состояния OSD и производительности пулов на уровне клиента и хоста с помощью метрик Prometheus и информационных панелей.
Начало работы
Обзор
Отслеживайте использование системы хранения Ceph как на стороне клиента, так и на уровне хоста. Используйте расширение Ceph storage для:
- Мониторинга использования и производительности вашей платформы Ceph.
- Постоянного получения актуальной информации о ресурсах хоста и потоке данных.
- Сокращения до минимума времени анализа, необходимого для выявления первопричины возможных системных сбоев.
Варианты использования
- Мониторинг использования ресурсов хоста и уровней его емкости.
- Сбор данных об активных и неактивных демонах объектного хранилища Ceph.
- Наблюдение за потоком данных системы с точки зрения операций записи и чтения, как для кластера в целом, так и для отдельных OSD.
Требования
- Хранилище Ceph, работающее в вашей среде.
- Расширение активировано в вашей среде с помощью встроенного раздела Расширения.
Подробности
Лицензирование и стоимость
Расширение Ceph storage собирает пользовательские метрики, которые, в зависимости от вашей лицензионной модели, могут либо потреблять DDUs, либо учитываться как метрики в рамках вашей подписки на платформу Ключ-АСТРОМ. Ниже приведена формула для оценки потребления лицензии для этого расширения:
- DDUs для всех включенных метрик: ((3 * кол-во мониторов) + (7 * кол-во кластеров) + (13 * кол-во OSD) + (9 * кол-во групп размещения)) * 60 мин * 24 ч * 365 дней * 0.001
- Точек данных для всех включенных метрик: ((3 * кол-во мониторов) + (7 * кол-во кластеров) + (13 * кол-во OSD) + (9 * кол-во групп размещения)) * 60 мин * 24 ч * 365 дней
Наборы функций
При активации расширения с помощью конфигурации мониторинга вы можете ограничить мониторинг одним из наборов функций. Для корректной работы расширение должно собирать хотя бы одну метрику после активации. В сильно сегментированных сетях наборы функций могут отражать сегменты вашей среды. Затем, при создании конфигурации мониторинга, вы можете выбрать набор функций и соответствующую группу АктивныхШлюзов, которая может подключаться к этому конкретному сегменту. Все метрики, не отнесенные ни к одному набору функций, считаются заданными по умолчанию и всегда передаются. Метрика наследует набор функций подгруппы, которая, в свою очередь, наследует набор функций группы. Кроме того, набор функций, определенный на уровне метрики, переопределяет набор функций, определенный на уровне подгруппы, который, в свою очередь, переопределяет набор функций, определенный на уровне группы.
pool
| Название метрики |
Ключ метрики |
Описание
|
| Objects count |
ceph_pool_objects |
Количество объектов в пуле
|
| Recovered objects |
ceph_pool_num_objects_recovered |
Количество восстановленных объектов в пуле
|
| Recovered bytes |
ceph_pool_num_bytes_recovered |
Количество восстановленных байт в пуле
|
| Pool objects quota |
ceph_pool_quota_objects |
Квота объектов, установленная для пула
|
| Pool bytes quota |
ceph_pool_quota_bytes |
Квота байт, установленная для пула
|
health
| Название метрики |
Ключ метрики |
Описание
|
| Health status |
ceph_health_status |
Состояние здоровья кластера
|
| Slow operations |
ceph_healthcheck_slow_ops |
Запросы OSD или монитора, обработка которых занимает много времени
|
osdLatency
| Название метрики |
Ключ метрики |
Описание
|
| OSD apply latency |
ceph_osd_apply_latency_ms |
Задержка операции «применение» на OSD
|
| OSD commit latency |
ceph_osd_commit_latency_ms |
Задержка операции «фиксация» на OSD
|
| OSD write latency sum |
ceph_osd_op_w_latency_sum |
Общая задержка операций «запись» на OSD
|
| OSD read latency sum |
ceph_osd_op_r_latency_sum |
Общая задержка операций «чтение» на OSD
|
osdOperations
| Название метрики |
Ключ метрики |
Описание
|
| Bytes written |
ceph_osd_op_w_in_bytes |
Общий объем байт, записанных на OSD
|
| Bytes read |
ceph_osd_op_r_out_bytes |
Общий объем байт, прочитанных с OSD
|
| Write operations |
ceph_osd_op_w |
Общее количество операций записи, выполненных на OSD
|
| Read operations |
ceph_osd_op_r |
Общее количество операций чтения, выполненных на OSD
|
| Recovery operations |
ceph_osd_recovery_ops |
Количество операций восстановления в OSD
|
Placement Groups
| Название метрики |
Ключ метрики |
Описание
|
| PG active |
ceph_pg_active |
Группа размещения активна на пул
|
| PG down |
ceph_pg_down |
Группа размещения недоступна на пул
|
| PG clean |
ceph_pg_clean |
Группа размещения чиста на пул
|
| PG backfill toofull |
ceph_pg_backfill_toofull |
Группа размещения переполнена на пул
|
| PG degraded |
ceph_pg_degraded |
Группа размещения деградировала на пул
|
| PG failed repair |
ceph_pg_failed_repair |
Группа размещения с ошибкой восстановления на пул
|
| PG incomplete |
ceph_pg_incomplete |
Группа размещения неполная на пул
|
| PG stale |
ceph_pg_stale |
Группа размещения устарела на пул
|
| PG inconsistent |
ceph_pg_inconsistent |
Группа размещения несогласованна на пул
|
default
| Название метрики |
Ключ метрики |
Описание
|
| Total capacity |
ceph_cluster_total_bytes |
Общая емкость кластера в байтах
|
| Used capacity |
ceph_cluster_total_used_bytes |
Использованная емкость кластера в байтах
|
| Monitor metadata |
ceph_mon_metadata |
Метрика-заполнитель для получения измерений метаданных монитора от экспортера
|
| OSD metadata |
ceph_osd_metadata |
Метрика-заполнитель для получения измерений метаданных OSD от экспортера
|
osdState
| Название метрики |
Ключ метрики |
Описание
|
| OSD in |
ceph_osd_in |
Demons хранения в кластере
|
| OSD up |
ceph_osd_up |
Demons хранения запущены
|
| Placement groups |
ceph_osd_numpg |
Группы размещения
|
monState
| Название метрики |
Ключ метрики |
Описание
|
| Open sessions |
ceph_mon_num_sessions |
Количество открытых сессий монитора
|
| Quorum status |
ceph_mon_quorum_status |
Demons монитора в кворуме
|