gpfs_performance_monitoring
Differences
This shows you the differences between two versions of the page.
| Both sides previous revisionPrevious revisionNext revision | Previous revision | ||
| gpfs_performance_monitoring [2026/07/31 19:32] – podman config bbruzzo | gpfs_performance_monitoring [2026/08/14 13:56] (current) – [Containerizando el bridge] bbruzzo | ||
|---|---|---|---|
| Line 1: | Line 1: | ||
| ====== Performance Monitoring ====== | ====== Performance Monitoring ====== | ||
| + | |||
| + | |||
| + | ===== Intro a componentes ====== | ||
| La [[https:// | La [[https:// | ||
| Está habilitada por default e incluye // | Está habilitada por default e incluye // | ||
| - | ===== Collector | + | ==== Collector ==== |
| Un collector soporta hasta 150 sensor nodes. Con un collector debería ser suficiente para nuestro sistema. Se pueden armar esquemas con más de un collector (multi-collector federation) por razones de escala y de tolerancia a fallas. | Un collector soporta hasta 150 sensor nodes. Con un collector debería ser suficiente para nuestro sistema. Se pueden armar esquemas con más de un collector (multi-collector federation) por razones de escala y de tolerancia a fallas. | ||
| Line 11: | Line 14: | ||
| Podemos utilizar mmgt01 como Node Collector en el cluster de storage y vlmgt02 en el cluster cliente, ya que es buena práctica mantener servicios extra (como monitoreo) fuera de los quorum nodes. | Podemos utilizar mmgt01 como Node Collector en el cluster de storage y vlmgt02 en el cluster cliente, ya que es buena práctica mantener servicios extra (como monitoreo) fuera de los quorum nodes. | ||
| - | ===== Sensors | + | ==== Sensors ==== |
| El componente que recopila datos de performance de un nodo | El componente que recopila datos de performance de un nodo | ||
| - | ===== Proxy ===== | + | ==== Proxy ==== |
| Se corre un proxy por cada protocolo para recopilar métricas de ese protocolo. | Se corre un proxy por cada protocolo para recopilar métricas de ese protocolo. | ||
| Line 145: | Line 148: | ||
| Leer archivo ubicado en ''/ | Leer archivo ubicado en ''/ | ||
| - | ==== Set Up ==== | + | ==== Set Up de prueba |
| [[https:// | [[https:// | ||
| Line 177: | Line 180: | ||
| </ | </ | ||
| - | === Containerizando el bridge === | + | ==== Containerizando el bridge |
| - | Como vamos a correr el bridge en un nodo con un collector, necesitamos setear | + | Utilizamos |
| - | Podman ya está instalado en todos los nodos, pero necesitamos crearle un usuario y asignarle subuid y subgid. | + | < |
| - | En vlmgt01: | + | Actualmente estamos trabajando con la [[https:// |
| + | | release 9.1.0]] del bridge. | ||
| + | |||
| + | Tiene un bug que debemos parchear para poder ver correctamente las métricas que son counters. | ||
| + | |||
| + | Editar el archivo source/ | ||
| + | |||
| + | Cambiar la sección que figura como: | ||
| < | < | ||
| - | mkdir / | + | 345- if self.raw_data or " |
| - | useradd | + | 346: |
| - | chown -R podman:podman / | + | 347- self.logger.debug(MSG[' |
| - | echo " | + | |
| - | echo " | + | |
| </ | </ | ||
| - | Ya podemos usar podman en vlmgt01. | + | Para que skipNullValues sea False |
| + | |||
| + | < | ||
| + | 345- if self.raw_data or " | ||
| + | 346: attrs.update({' | ||
| + | 347- self.logger.debug(MSG[' | ||
| + | </ | ||
| + | |||
| + | Esto generaba que se inyecte la flag -s en la REST API de GPFS, que no era soportada. Generaba un log: | ||
| + | |||
| + | < | ||
| + | |||
| + | < | ||
| + | [podman@vlmgt02 ~]$ cd ibm-spectrum-scale-bridge-for-grafana-9.1.0 | ||
| + | </ | ||
| + | |||
| + | Buildeamos la imagen | ||
| + | |||
| + | < | ||
| + | |||
| + | Generamos unit file en / | ||
| + | |||
| + | El contenido del unit file es: | ||
| + | |||
| + | < | ||
| + | [Unit] | ||
| + | Description=GPFS Grafana Bridge | ||
| + | After=pmcollector.service | ||
| + | |||
| + | [Container] | ||
| + | ContainerName=gpfs_bridge | ||
| + | Image=localhost/ | ||
| + | Volume=/ | ||
| + | Volume=/ | ||
| + | Volume=/ | ||
| + | |||
| + | Network=host | ||
| + | |||
| + | [Install] | ||
| + | WantedBy=default.target | ||
| + | </ | ||
| + | |||
| + | Asegurarse que los permisos de / | ||
| + | |||
| + | Luego se puede lanzar o detener el container con systemd. | ||
| + | |||
| + | < | ||
| + | podman $ systemctl --user daemon-reload | ||
| + | podman $ systemctl --user start gpfs-bridge | ||
| + | podman $ podman logs gpfs_bridge | ||
| + | </ | ||
| - | < | ||
gpfs_performance_monitoring.1785526324.txt.gz · Last modified: by bbruzzo
