Ceph: различия между версиями
ENetrebin (обсуждение | вклад) Нет описания правки |
Нет описания правки |
||
| Строка 1: | Строка 1: | ||
= Расширение Ceph storage = | |||
Осуществляйте мониторинг использования распределенного хранилища '''Ceph''', состояния '''OSD''' и производительности пулов на уровне клиента и хоста с помощью метрик '''Prometheus''' и информационных панелей. | |||
== Обзор == | == Начало работы == | ||
=== Обзор === | |||
Отслеживайте использование системы хранения '''Ceph''' как на стороне клиента, так и на уровне хоста. Используйте расширение '''Ceph storage''' для: | |||
* Мониторинга использования и производительности вашей платформы '''Ceph'''. | |||
* Постоянного получения актуальной информации о ресурсах хоста и потоке данных. | |||
* Сокращения до минимума времени анализа, необходимого для выявления первопричины возможных системных сбоев. | |||
* | === Варианты использования === | ||
* | * Мониторинг использования ресурсов хоста и уровней его емкости. | ||
* | * Сбор данных об активных и неактивных демонах объектного хранилища '''Ceph'''. | ||
* Наблюдение за потоком данных системы с точки зрения операций записи и чтения, как для кластера в целом, так и для отдельных '''OSD'''. | |||
=== | === Требования === | ||
* Хранилище '''Ceph''', работающее в вашей среде. | |||
* Расширение активировано в вашей среде с помощью встроенного раздела '''Расширения'''. | |||
== Подробности == | |||
* | === Лицензирование и стоимость === | ||
* | Расширение '''Ceph storage''' собирает пользовательские метрики, которые, в зависимости от вашей лицензионной модели, могут либо потреблять '''DDUs''', либо учитываться как '''метрики в рамках вашей подписки на платформу Ключ-АСТРОМ'''. Ниже приведена формула для оценки потребления лицензии для этого расширения: | ||
* '''DDUs''' для всех включенных метрик: ((3 * кол-во мониторов) + (7 * кол-во кластеров) + (13 * кол-во '''OSD''') + (9 * кол-во групп размещения)) * 60 мин * 24 ч * 365 дней * 0.001 | |||
* Точек данных для всех включенных метрик: ((3 * кол-во мониторов) + (7 * кол-во кластеров) + (13 * кол-во '''OSD''') + (9 * кол-во групп размещения)) * 60 мин * 24 ч * 365 дней | |||
== | == Наборы функций == | ||
При активации расширения с помощью '''конфигурации мониторинга''' вы можете ограничить мониторинг одним из наборов функций. Для корректной работы расширение должно собирать хотя бы одну метрику после активации. В сильно сегментированных сетях наборы функций могут отражать сегменты вашей среды. Затем, при создании конфигурации мониторинга, вы можете выбрать набор функций и соответствующую группу АктивныхШлюзов, которая может подключаться к этому конкретному сегменту. Все метрики, не отнесенные ни к одному набору функций, считаются заданными по умолчанию и всегда передаются. Метрика наследует набор функций подгруппы, которая, в свою очередь, наследует набор функций группы. Кроме того, набор функций, определенный на уровне метрики, переопределяет набор функций, определенный на уровне подгруппы, который, в свою очередь, переопределяет набор функций, определенный на уровне группы. | |||
== | == pool == | ||
{| class="wikitable" | {| class="wikitable" | ||
|- | |- | ||
! Название метрики !! Ключ метрики !! Описание | |||
|- | |- | ||
| | | Objects count || ceph_pool_objects || Количество объектов в пуле | ||
| | |- | ||
| | | Recovered objects || ceph_pool_num_objects_recovered || Количество восстановленных объектов в пуле | ||
| | |- | ||
| Recovered bytes || ceph_pool_num_bytes_recovered || Количество восстановленных байт в пуле | |||
|- | |||
| Pool objects quota || ceph_pool_quota_objects || Квота объектов, установленная для пула | |||
|- | |||
| Pool bytes quota || ceph_pool_quota_bytes || Квота байт, установленная для пула | |||
|} | |} | ||
== health == | |||
{| class="wikitable" | {| class="wikitable" | ||
|- | |- | ||
! Название метрики !! Ключ метрики !! Описание | |||
|- | |- | ||
| | | Health status || ceph_health_status || Состояние здоровья кластера | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | Slow operations || ceph_healthcheck_slow_ops || Запросы '''OSD''' или монитора, обработка которых занимает много времени | ||
| | |} | ||
| | == osdLatency == | ||
{| class="wikitable" | |||
|- | |- | ||
| | ! Название метрики !! Ключ метрики !! Описание | ||
| | |- | ||
| | | OSD apply latency || ceph_osd_apply_latency_ms || Задержка операции «применение» на '''OSD''' | ||
|Общая задержка операций | |- | ||
| OSD commit latency || ceph_osd_commit_latency_ms || Задержка операции «фиксация» на '''OSD''' | |||
|- | |||
| OSD write latency sum || ceph_osd_op_w_latency_sum || Общая задержка операций «запись» на '''OSD''' | |||
|- | |||
| OSD read latency sum || ceph_osd_op_r_latency_sum || Общая задержка операций «чтение» на '''OSD''' | |||
|} | |} | ||
== osdOperations == | |||
{| class="wikitable" | {| class="wikitable" | ||
|- | |- | ||
| | ! Название метрики !! Ключ метрики !! Описание | ||
| | |- | ||
| | | Bytes written || ceph_osd_op_w_in_bytes || Общий объем байт, записанных на '''OSD''' | ||
| | |||
|- | |- | ||
| | | Bytes read || ceph_osd_op_r_out_bytes || Общий объем байт, прочитанных с '''OSD''' | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | Write operations || ceph_osd_op_w || Общее количество операций записи, выполненных на '''OSD''' | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | Read operations || ceph_osd_op_r || Общее количество операций чтения, выполненных на '''OSD''' | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | Recovery operations || ceph_osd_recovery_ops || Количество операций восстановления в '''OSD''' | ||
| | |||
| | |||
| | |||
|} | |} | ||
== Placement Groups == | |||
{| class="wikitable" | {| class="wikitable" | ||
|- | |- | ||
| | ! Название метрики !! Ключ метрики !! Описание | ||
| | |- | ||
| | | PG active || ceph_pg_active || Группа размещения активна на пул | ||
| | |- | ||
| PG down || ceph_pg_down || Группа размещения недоступна на пул | |||
|- | |||
| PG clean || ceph_pg_clean || Группа размещения чиста на пул | |||
|- | |- | ||
| | | PG backfill toofull || ceph_pg_backfill_toofull || Группа размещения переполнена на пул | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | PG degraded || ceph_pg_degraded || Группа размещения деградировала на пул | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | PG failed repair || ceph_pg_failed_repair || Группа размещения с ошибкой восстановления на пул | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | PG incomplete || ceph_pg_incomplete || Группа размещения неполная на пул | ||
| | |- | ||
| | | PG stale || ceph_pg_stale || Группа размещения устарела на пул | ||
| | |- | ||
| PG inconsistent || ceph_pg_inconsistent || Группа размещения несогласованна на пул | |||
|} | |} | ||
== default == | |||
{| class="wikitable" | {| class="wikitable" | ||
|- | |- | ||
! Название метрики !! Ключ метрики !! Описание | |||
|- | |- | ||
| | | Total capacity || ceph_cluster_total_bytes || Общая емкость кластера в байтах | ||
| | |||
| | |||
| | |||
|- | |- | ||
| | | Used capacity || ceph_cluster_total_used_bytes || Использованная емкость кластера в байтах | ||
| | |- | ||
| | | Monitor metadata || ceph_mon_metadata || Метрика-заполнитель для получения измерений метаданных монитора от экспортера | ||
| | |- | ||
| OSD metadata || ceph_osd_metadata || Метрика-заполнитель для получения измерений метаданных '''OSD''' от экспортера | |||
|} | |} | ||
== | == osdState == | ||
{| class="wikitable" | |||
|- | |||
! Название метрики !! Ключ метрики !! Описание | |||
|- | |||
| OSD in || ceph_osd_in || Демоны хранения в кластере | |||
|- | |||
| OSD up || ceph_osd_up || Демоны хранения запущены | |||
|- | |||
| Placement groups || ceph_osd_numpg || Группы размещения | |||
|} | |||
== monState == | |||
{| class="wikitable" | |||
|- | |||
! Название метрики !! Ключ метрики !! Описание | |||
|- | |||
| Open sessions || ceph_mon_num_sessions || Количество открытых сессий монитора | |||
|- | |||
| Quorum status || ceph_mon_quorum_status || Демоны монитора в кворуме | |||
|} | |||
Версия от 18:20, 26 мая 2026
Расширение Ceph storage
Осуществляйте мониторинг использования распределенного хранилища Ceph, состояния OSD и производительности пулов на уровне клиента и хоста с помощью метрик Prometheus и информационных панелей.
Начало работы
Обзор
Отслеживайте использование системы хранения Ceph как на стороне клиента, так и на уровне хоста. Используйте расширение Ceph storage для:
- Мониторинга использования и производительности вашей платформы Ceph.
- Постоянного получения актуальной информации о ресурсах хоста и потоке данных.
- Сокращения до минимума времени анализа, необходимого для выявления первопричины возможных системных сбоев.
Варианты использования
- Мониторинг использования ресурсов хоста и уровней его емкости.
- Сбор данных об активных и неактивных демонах объектного хранилища Ceph.
- Наблюдение за потоком данных системы с точки зрения операций записи и чтения, как для кластера в целом, так и для отдельных OSD.
Требования
- Хранилище Ceph, работающее в вашей среде.
- Расширение активировано в вашей среде с помощью встроенного раздела Расширения.
Подробности
Лицензирование и стоимость
Расширение Ceph storage собирает пользовательские метрики, которые, в зависимости от вашей лицензионной модели, могут либо потреблять DDUs, либо учитываться как метрики в рамках вашей подписки на платформу Ключ-АСТРОМ. Ниже приведена формула для оценки потребления лицензии для этого расширения:
- DDUs для всех включенных метрик: ((3 * кол-во мониторов) + (7 * кол-во кластеров) + (13 * кол-во OSD) + (9 * кол-во групп размещения)) * 60 мин * 24 ч * 365 дней * 0.001
- Точек данных для всех включенных метрик: ((3 * кол-во мониторов) + (7 * кол-во кластеров) + (13 * кол-во OSD) + (9 * кол-во групп размещения)) * 60 мин * 24 ч * 365 дней
Наборы функций
При активации расширения с помощью конфигурации мониторинга вы можете ограничить мониторинг одним из наборов функций. Для корректной работы расширение должно собирать хотя бы одну метрику после активации. В сильно сегментированных сетях наборы функций могут отражать сегменты вашей среды. Затем, при создании конфигурации мониторинга, вы можете выбрать набор функций и соответствующую группу АктивныхШлюзов, которая может подключаться к этому конкретному сегменту. Все метрики, не отнесенные ни к одному набору функций, считаются заданными по умолчанию и всегда передаются. Метрика наследует набор функций подгруппы, которая, в свою очередь, наследует набор функций группы. Кроме того, набор функций, определенный на уровне метрики, переопределяет набор функций, определенный на уровне подгруппы, который, в свою очередь, переопределяет набор функций, определенный на уровне группы.
pool
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| Objects count | ceph_pool_objects | Количество объектов в пуле |
| Recovered objects | ceph_pool_num_objects_recovered | Количество восстановленных объектов в пуле |
| Recovered bytes | ceph_pool_num_bytes_recovered | Количество восстановленных байт в пуле |
| Pool objects quota | ceph_pool_quota_objects | Квота объектов, установленная для пула |
| Pool bytes quota | ceph_pool_quota_bytes | Квота байт, установленная для пула |
health
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| Health status | ceph_health_status | Состояние здоровья кластера |
| Slow operations | ceph_healthcheck_slow_ops | Запросы OSD или монитора, обработка которых занимает много времени |
osdLatency
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| OSD apply latency | ceph_osd_apply_latency_ms | Задержка операции «применение» на OSD |
| OSD commit latency | ceph_osd_commit_latency_ms | Задержка операции «фиксация» на OSD |
| OSD write latency sum | ceph_osd_op_w_latency_sum | Общая задержка операций «запись» на OSD |
| OSD read latency sum | ceph_osd_op_r_latency_sum | Общая задержка операций «чтение» на OSD |
osdOperations
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| Bytes written | ceph_osd_op_w_in_bytes | Общий объем байт, записанных на OSD |
| Bytes read | ceph_osd_op_r_out_bytes | Общий объем байт, прочитанных с OSD |
| Write operations | ceph_osd_op_w | Общее количество операций записи, выполненных на OSD |
| Read operations | ceph_osd_op_r | Общее количество операций чтения, выполненных на OSD |
| Recovery operations | ceph_osd_recovery_ops | Количество операций восстановления в OSD |
Placement Groups
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| PG active | ceph_pg_active | Группа размещения активна на пул |
| PG down | ceph_pg_down | Группа размещения недоступна на пул |
| PG clean | ceph_pg_clean | Группа размещения чиста на пул |
| PG backfill toofull | ceph_pg_backfill_toofull | Группа размещения переполнена на пул |
| PG degraded | ceph_pg_degraded | Группа размещения деградировала на пул |
| PG failed repair | ceph_pg_failed_repair | Группа размещения с ошибкой восстановления на пул |
| PG incomplete | ceph_pg_incomplete | Группа размещения неполная на пул |
| PG stale | ceph_pg_stale | Группа размещения устарела на пул |
| PG inconsistent | ceph_pg_inconsistent | Группа размещения несогласованна на пул |
default
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| Total capacity | ceph_cluster_total_bytes | Общая емкость кластера в байтах |
| Used capacity | ceph_cluster_total_used_bytes | Использованная емкость кластера в байтах |
| Monitor metadata | ceph_mon_metadata | Метрика-заполнитель для получения измерений метаданных монитора от экспортера |
| OSD metadata | ceph_osd_metadata | Метрика-заполнитель для получения измерений метаданных OSD от экспортера |
osdState
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| OSD in | ceph_osd_in | Демоны хранения в кластере |
| OSD up | ceph_osd_up | Демоны хранения запущены |
| Placement groups | ceph_osd_numpg | Группы размещения |
monState
| Название метрики | Ключ метрики | Описание |
|---|---|---|
| Open sessions | ceph_mon_num_sessions | Количество открытых сессий монитора |
| Quorum status | ceph_mon_quorum_status | Демоны монитора в кворуме |